实时听写、零样本语音克隆、电影级视频配音——全部在桌面端完成。
开源、无需 API 密钥、完全本地运行。支持 646 种语言。
快速开始 · 功能 · 为什么选择 OmniVoice Studio? · TTS 引擎 · 参与贡献 · Discord · English
🎙️ 语音克隆3 秒音频 → 复制任何声音。 |
🎨 声音设计性别、年龄、口音、音高、语速、 |
🎬 视频配音YouTube 链接或文件 → 转录 → |
⌨️ 听写工具从任何应用中按 |
🔊 人声分离基于 Demucs。从背景音乐中 |
👥 说话人分离Pyannote + WhisperX。 |
📦 批量队列一次拖入 50 个视频,然后离开。 |
🤖 MCP 服务器从 Claude、Cursor 或 |
🛡️ AI 水印AudioSeal(Meta)。不可见, |
🔐 完全本地无需密钥、云端、账号。 |
⚡ GPU 自动检测CUDA · MPS · ROCm · CPU。 |
🧩 可扩展继承 |
语音克隆 拖入 3 秒音频 → 复制任何声音。646 种语言,零样本。 |
声音设计 从头构建新声音——性别、年龄、口音、音高、风格。 |
视频配音 上传或粘贴 YouTube 链接。转录、翻译、重新配音、导出。 |
声音库 搜索 YouTube、浏览分类、下载片段、构建你的收藏。 |
设置 → 模型 15 个模型。一键安装。自动检测你的平台(CUDA / MPS / CPU)。 |
项目 配音项目、声音配置、生成历史、导出——全部可搜索。 |
设置 → 日志 实时后端、前端和 Tauri 运行时日志。筛选、刷新、清除。 |
|
backend/services/tts_backend.py 中继承 TTSBackend,然后将其添加到底部的 _REGISTRY 字典中。内置六个引擎:OmniVoice、CosyVoice、MLX-Audio(14+ 子引擎)、VoxCPM2、MOSS-TTS-Nano 和 KittenTTS。详情请参见 TTS 引擎部分。