拓冰建站拓冰建站
首页 / 资讯中心 / 正文

MoneyPrinterTurbo 离线 TTS 部署指南:AI视频生成本地配音,零 API 成本

MoneyPrinterTurbo 离线 TTS 部署指南AI视频生成本地配音零 API 成本【免费下载链接】MoneyPrinterTurbo利用 AI 大模型和自动化工作流根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.项目地址: https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurboMoneyPrinterTurbo 是一款 AI视频生成 工具能把一个主题变成高清短视频它的离线语音合成把配音全程放在本地跑不走云端 API文本不出本机零调用成本。下文是一份本地 TTS 部署与离线字幕生成的完整指南。 它到底解决了什么问题MoneyPrinterTurbo 让关键词自动走完脚本、配音、字幕、剪辑全流程而配音环节可以完全离线这是它的核心价值。全程本地合成TTS 请求在本地进程内完成没有网络依赖弱网环境也能出片数据不出机器脚本文本不上传第三方服务器规避隐私泄露风险零调用成本无按量 API 计费部署一次即可无限次生成批量生产成本可控双引擎架构V1 引擎基于 edge-tts 库快速稳定V2 引擎集成 Azure Cognitive Services SDK音色更真实字级字幕时间戳更精确⚡ 三步跑起来第一步克隆仓库git clone https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo cd MoneyPrinterTurbo第二步安装依赖pip install -r requirements.txt第三步配置并启动。把模板配置复制为config.toml后填入语音参数WebUI 与 API 两个入口二选一cp config.example.toml config.toml sh webui.sh # Windows 用 webui.bat python main.py # 或启动 API 服务文档见 http://127.0.0.1:8080/docs⚙️ 关键配置速览配置由app/config/config.py统一加载与离线语音合成相关的项不多参数作用示例值是否必填speech_keyAzure Speech 服务密钥V2 引擎前提你的服务密钥选填V2 必填speech_regionAzure 服务区域与密钥配套eastasia选填V2 必填voice_name发音人名称zh-CN-XiaoxiaoNeural选填voice_rate语速倍率可调范围 -50%~50%1.1选填subtitle_provider字幕生成模式edge 或 whisperedge选填语音库内置 1000 种发音人覆盖数十种语言中文有 zh-CN-XiaoxiaoNeural晓晓、zh-CN-YunxiNeural云希英文有 en-US-JennyNeural还有日文、法文、德文等完整清单见docs/voice-list.txt。 edge 还是 whisper字幕模式怎么选模式生成速度质量硬件要求适用场景edge快良好低批量生产、快速验证whisper慢高中高正式发布内容切换只需在config.toml中设置subtitle_provider whisper其余保持不变。 三类场景直接抄作业中文教育视频需求讲解清晰自然字幕对齐不能出错。音色zh-CN-XiaoxiaoNeural女声柔和适合教学场景语速voice_rate设 1.110% 跟上课件节奏字幕whisper 模式逐句对齐更稳中英双语商业演示需求一条视频内按语言切换音色统一横屏交付。音色中文段 zh-CN-YunxiNeural英文段 en-US-JennyNeural语速保持 1.0商务内容避免急促感字幕中英双语字幕、16px 字号输出 1920x1080 横屏批量短视频流水线需求每天产大批量短视频吞吐量优先。音色同音色内容复用已合成的语音缓存不重复计算语速1.0 默认值即可保证产出风格统一字幕edge 模式求快同时调大max_concurrent_tasks并配好material_directory硬件与调优建议组件最低配置推荐配置最佳配置CPU4 核8 核12 核以上内存8GB16GB32GB存储256GB SSD512GB NVMe SSD1TB NVMe SSD软件层面四条一句话建议给 Python 进程留足内存余量避免频繁 GC 拖慢流程用max_concurrent_tasks把并发任务数压在机器承受范围内复用已合成的语音结果同一文本不重复计算语音与素材文件放 SSD直接提升读写吞吐常见问题合成速度慢先看 CPU 与内存占用降并发字幕生成改用 edge 引擎也能明显提速。音色怎么选用 WebUI 的试听功能逐个预览候选听完再定1000 全量清单见docs/voice-list.txt。能自定义语音模型吗当前版本支持 Azure TTS 标准模型GPT-SoVITS 等本地自定义模型在计划中。字幕不准把subtitle_provider切到 whisper同时保证音频清晰重新生成即可。源码导读代码分四层控制器层app/controllers/负责请求入口与业务编排服务层app/services/装 TTS、字幕、视频合成等核心能力模型层app/models/定义请求参数结构工具层app/utils/提供通用函数。TTS 核心在 app/services/voice.py一次配音依次经过文本预处理清洗括号等符号、选音色、调用引擎合成音频、采集字级边界时间戳、生成 SRT 字幕并转格式五步azure_tts_v1与azure_tts_v2两个引擎实现都在这里。功能路线上GPT-SoVITS 本地自定义模型、情感化合成、接入更多 TTS 服务商、一键发布到 YouTube 等平台都已列入计划。MoneyPrinterTurbo 已把配音与字幕整条链路做成开箱即用的本地工具你只需提供主题。把仓库克隆下来用默认配置跑出第一条视频遇到坑或想要新特性时直接向社区提交 Issue 或 PR 是最快的参与方式。【免费下载链接】MoneyPrinterTurbo利用 AI 大模型和自动化工作流根据主题或关键词一键生成高清短视频。Generate HD short videos from a topic or keyword with an automated AI workflow.项目地址: https://gitcode.com/GitHub_Trending/mo/MoneyPrinterTurbo创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门