LuxTTS:小而快的开源语音克隆,单卡 150× 实时、48kHz 原生、1GB 显存本地跑
博主 bkdgiffug(lumxss)推荐的开源语音克隆新秀 LuxTTS:基于 zipvoice 的轻量 TTS 模型,主打「小而快」——① 快:单卡最高约 150× 实时,CPU 也能超实时(CUDA/MPS/CPU 三端支持);② 清:原生 48kHz 高保真输出(多数 TTS 只有 24kHz);③ 省:约 1GB 显存即可运行,老显卡也能玩。小模型的克隆效果可与体积大 10 倍的模型掰手腕(SOTA 级克隆)。关键卖点:完全本地推理,不用把声音交给云端;pip 一装即用,另有 HuggingFace Space/Colab 在线体验。适合配音、Agent 语音输出等本地化场景。注:该推文仅配图无视频,内容经 fxtwitter API 与 GitHub README 交叉核实。





