拓冰建站拓冰建站
首页 / 资讯中心 / 正文

输入一个主题拿到一条解说视频:AI自动视频生成新手实操,10分钟出第一条视频

输入一个主题拿到一条解说视频AI自动视频生成新手实操10分钟出第一条视频【免费下载链接】auto-video-generateor自动视频生成器给定主题自动生成解说视频。用户输入主题文字系统调用大语言模型生成故事或解说的文字然后进一步调用语音合成接口生成解说的语音调用文生图接口生成契合文字内容的配图最后融合语音和配图生成解说视频。项目地址: https://gitcode.com/gh_mirrors/au/auto-video-generateor你需要在一周内发出一条解说视频。传统做法要走写脚本、录配音、找配图、后期剪辑4个环节每个环节都要专门技能。如果这些你都不想干呢auto-video-generateor自动视频生成器就是干这个的你输入主题文字它调用大语言模型生成解说文案再用语音合成出旁白按句生成匹配配图最后把语音和图像合成一条解说视频。你只负责打字和点按钮。它是个基于 Gradio 的网页工具所有参数都有默认值本地跑起来、浏览器打开就能用。下面是最短路径从零到拿到第一条视频。首次体验10分钟跑通自动视频生成第一步克隆代码并进入项目目录git clone https://gitcode.com/gh_mirrors/au/auto-video-generateor cd auto-video-generateor执行后你会得到项目目录后面所有命令都在里面执行。第二步安装依赖pip install -r requirements.txt包含 gradio、moviepy、edge-tts 等库网络慢的话可换国内 pip 镜像。第三步填写密钥。编辑根目录config.env填入5个密钥DEEPSEEK_API_KEY生成故事文案文本生成默认用它DOUBAO_TTS_APPID、DOUBAO_TTS_ACCESS_TOKEN豆包语音合成QIANFAN_ACCESS_KEY、QIANFAN_SECRET_KEY千帆文生图第四步启动python main.py无参数默认启动免费校对版。浏览器打开http://127.0.0.1:9020该版本代码里端口是 9020README 写的 8000 是旧版出现登录页时用户名随便填密码和用户名填同一个字符串即可。核心能力自动视频生成能做什么自动视频生成主界面上方是参数设置区中间是一键生成按钮下方列表随进度逐条填充文本与语音右侧显示当前配图一键生成填主题和代号点一键生成依次执行生成故事、切分文本、合成语音、生成图像、生成视频下方列表可以看着进度逐条填充。素材校对每一句是一个素材格文本和生图提示词可改语音、图像可单独重新生成勾已确认的格子才会被合成进最终视频。代号管理按代号名称保存一整套参数和素材加载参数恢复设置、加载资源恢复已生成素材同参数批量做同类系列。PPT/PDF 转视频PPT 的幻灯片当视频画面、备注当逐字稿PDF 也可先让 AI 解说再转视频需另装 LibreOffice。多版本可选python main.py后加 1~4 启动不同版本启动命令版本特点python main.py无参v4 免费校对默认推荐素材可逐条校对重生成python main.py 1v1 极简版快速验证完整流程python main.py 2v2 千帆版基于千帆大模型生成故事和图像python main.py 3v3 全免费版全免费资源零 API 花费参数设置与一键生成代号用于保存和恢复整套参数所有下拉框除选择外也支持自定义输入常改参数的默认值参数默认值说明图像大小1280x720/抖音B站竖版短视频选 720x1280高清选 1920x1080字体参数msyh.ttc-1-1 自动识别字幕大小0 为不加字幕发音人zh-CN-YunxiNeural/Male下拉可选其他中文发音人语速/音量/音调50/50/50讲解类内容语速可降到 40~45流程拆解从主题文字到视频的5步主题输入 → 大模型生成解说 → 分句 → 逐句合成语音与生成配图 → 合成视频主题输入网页输入框填主题文字故事框里手动写了内容时主题为空就直接用你写的主题有内容则用 AI 生成的覆盖。生成故事大模型按提示词模板产出口语化文案默认模板要求前半部分讲内容核心后半部分讲案例故事并限制总字数。切分文本文案被切成短句一句对应一个素材格按顺序存到text/text_100.txt起。语音与配图TTS 逐句合成 mp3 存到audio/文生图逐句出一张匹配图存到image/。合成视频moviepy 把音频和图片按时间轴排好叠上字幕输出video.mp4。场景实操三种典型做法场景一给抖音做1分钟竖版短视频目标与需求把一个话题变成竖屏解说视频直接发布到抖音。推荐参数图像大小选720x1280/竖版720p要更清晰选1080x1920/竖版抖音字体参数msyh.ttc-1主题控制在 50 字内写具体话题语速 55、音量 50。预期效果出一条1分钟上下、底部带字幕的竖版视频素材和成片都保存在mnt/materials/用户名/代号/目录。场景二PPT 转培训视频目标与需求已有培训 PPT不重新录课直接转成视频。推荐参数先安装 LibreOffice 并加入环境变量把逐字稿写进 PPT 备注语速 45、音量 50图像大小选1920x1080/全高清1080p。预期效果每页幻灯片成为一帧画面备注成为旁白点击生成后得到完整培训视频。场景三零花费先试效果免费版目标与需求不想先花钱买 API只想看看效果。推荐参数python main.py 3启动全免费版申请免费的千帆密钥填入config.env。预期效果文本、语音、图像全走免费通道0 花费跑通整个流程看完效果再决定要不要用付费版。常见坑与优化最容易遇到的6个问题打开 127.0.0.1:8000 是空白→ 该版本代码里默认端口是 90208000 是旧版说明 → 以终端打印的地址为准。登录页一直进不去→ 校验逻辑要求密码与用户名相同不区分大小写→ 用户名密码填同一个字符串。有的配图是纯文字卡片→ 图像生成服务异常系统用文字图兜底 → 取消该格已确认点生成图像重试过一会儿再试。生成很久页面断开、视频没出来→ 素材逐句串行调用三类 API耗时较长 → 先设好代号断开后用加载参数/加载资源恢复进度不必从头再来。视频没有字幕→ 字体参数设了 0含义就是不加字幕 → 改回msyh.ttc-1或选固定字号 24/32/40。PPT 转视频报错→ 系统要调 LibreOffice 把 PPT 页面转成图片缺依赖 → 安装 LibreOffice 并加入系统环境变量。素材校对界面左侧是可编辑的文本与生图提示词右侧是语音波形和对应配图勾已确认后该格素材才会进视频加载流程先更新代号列表下拉选之前的代号再加载参数恢复设置、加载资源恢复已生成的故事、图像、语音FAQ完全不会剪辑能用吗能。全流程在网页上完成输入主题点一键生成就行不需要任何剪辑操作。一条视频大概花多少钱文本走 DeepSeek、语音走豆包、图像走千帆几分钟的视频通常几元python main.py 3免费版则 0 API 花费。生成质量能直接发吗适合抖音、B站这类解说场景效果取决于主题描述和参数不满意的某句语音、某张图可以单独重生成。参数改错了会崩吗不会参数只是文本和滑杆改错不影响程序建议先点保存参数留底随时加载参数恢复。能批量做系列视频吗可以。每集设一个代号、保存参数换主题再生成也可以用加载资源复用已有素材。报错先看什么先查config.env的5个密钥是否填对再查网络还不行就分步骤生成单独跑故事、语音、图像定位卡在哪一环。能导入自己的图片或录音吗当前版本不支持素材都是 AI 生成不过 PPT 转视频可以用你自己的幻灯片和备注当素材比较接近这个需求。输入一个主题、等它出片这就是自动视频生成给非专业者的最短路径。跑通第一条之后建议先用 50 字以内的小主题生成一集完整走一遍再谈优化成功后给项目设代号并点保存参数再试加载资源恢复不满意的素材只重生成那一格全部已确认后再点生成视频有 PPT 素材就先装 LibreOffice把逐字稿写进备注再上传【免费下载链接】auto-video-generateor自动视频生成器给定主题自动生成解说视频。用户输入主题文字系统调用大语言模型生成故事或解说的文字然后进一步调用语音合成接口生成解说的语音调用文生图接口生成契合文字内容的配图最后融合语音和配图生成解说视频。项目地址: https://gitcode.com/gh_mirrors/au/auto-video-generateor创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门