拓冰建站拓冰建站
首页 / 资讯中心 / 正文

输入一个主题就能出片:Pixelle-Video AI 短视频引擎完整新手教程

输入一个主题就能出片Pixelle-Video AI 短视频引擎完整新手教程【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一个 AI 全自动短视频引擎你用一句话写下视频主题它就把文案撰写、AI 配图、语音解说、背景音乐和最终合成全部包办下来最后直接给你一个能发布的短视频文件。整个过程不需要你会剪辑、会写脚本也不强制你懂技术跟着这篇教程走第一次就能跑出自己的第一条 AI 短视频。Pixelle-Video 替你解决了什么问题做一条短视频传统上要干五件事写脚本、找配图、录配音、挑音乐、进剪辑软件拼画面。哪怕每件事都只用十几分钟加起来也是一小时起步而且每一步都要你自己动手。Pixelle-Video 的思路是把这五件事都交给 AI你只负责出主意。整个流程在一条流水线上完成输入文本 → 生成剧本 → 生成配图提示词 → 生成音频/图片/合成帧 → 拼接BGM → 输出视频具体来说它会为你完成这些事环节它做什么你做什么文案根据你的主题自动写解说词并拆成若干分镜给一个主题或直接贴入自己的文案配图每个分镜自动生成一张风格统一的插图选模板、调提示词前缀可选配音调用 TTS 把文案读成语音选一个语音工作流上传参考音频可克隆音色音乐给视频铺上背景音乐选无 BGM、内置音乐或往bgm/目录扔自己的 MP3合成把画面、语音、音乐拼成成片等进度条走完视频自动播放并保存到output/它还支持三种扩展玩法对新手来说相当于免费加餐上传自己的照片和视频做「自定义素材」AI 分析后反推脚本用图生视频把静态图变成动态画面用「数字人口播」让虚拟人替你出镜。三步启动 Pixelle-Video 并生成第一条视频第一步装好并启动按你的系统二选一Windows去项目 Releases 下载 Windows 一键整合包解压后双击start.bat。这个包把 Python、uv、ffmpeg 全打包好了完全不用装环境。macOS / Linux从源码安装需要你先装好uvPython 包管理器和ffmpeg视频处理工具然后执行git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py两种方式启动后浏览器都会自动打开http://localhost:8501的 Web 界面。第二步配置一次 API首次使用要展开「⚙️ 系统配置」面板填两类信息之后就不用再动了LLM 配置选一个大语言模型通义千问、GPT、DeepSeek 都行并填入 API Key这是负责写文案的。有本地显卡的用户可以用 Ollama 跑本地模型一分钱不花。图像/视频生成三条路任选其一——本地 ComfyUI填地址后点「测试连接」、云端 RunningHub填 API Key或直连 DashScope、OpenAI、可灵、Seedream 等模型厂商的 API。只跑图不加视频的话配好图像这一项就够了。费用上不用太担心本地 ComfyUI Ollama 是零成本方案用通义千问写文案的成本极低全云端方案最省事但贵一些。第三步输入主题点生成界面是三栏布局跟着走就行左侧「 内容输入」选「AI 生成内容」模式输入主题比如为什么要养成阅读习惯。也可以选「固定文案内容」直接贴自己的稿子跳过 AI 写稿。中间栏语音设置里挑一个 TTS 工作流默认 Edge-TTS 就能用视觉设置里选图像工作流和视频模板推荐竖屏 1080x1920默认 5 个分镜。右侧栏点「 生成视频」进度条会依次显示生成文案、逐分镜生成插图、合成语音、合成视频。5 个分镜的片子大约 2~5 分钟出片完成后右侧直接播放文件落在output/文件夹里。最实用的几个功能模板、音色克隆和批量生成模板决定视频长什么样模板分三类从命名就能看懂static_*.html是纯文字静态模板不用 AI 生成媒体速度快image_*.html用 AI 生成的图片做背景video_*.html用 AI 生成的视频做动态背景。模板按尺寸分竖屏1080x1920适合抖音、小红书、横屏1920x1080适合 B 站、YouTube、方形1080x1080三组在界面下拉菜单里按尺寸分组显示点「预览模板」还能填参数先看效果再决定。风格从简约现代到复古时尚都有竖屏模板就有书籍、治愈、霓虹、卡通、长文本等二十多种。声音克隆让 AI 用你的声音配音在语音设置里上传一段参考音频MP3/WAV/FLAC 均可选择支持声音克隆的 TTS 工作流如 Index-TTSAI 就能模仿这个音色来念你的文案。上传后可以直接试听效果不满意换一段再传。批量模式一次生成一组视频需要日更或者做系列内容的用户把「 批量生成模式」打开即可每行输入一个主题系统会为每个主题各出一条视频并且共用同一套 TTS、模板、工作流配置。好处很直接——系列视频的视觉风格天然统一你只需要把主题列好然后去干别的事。自定义素材你的照片也能变成视频除了纯 AI 生成你还可以上传自己的照片和视频AI 会分析这些素材并围绕它生成脚本适合手里有实拍素材但懒得写文案的人。什么内容最适合用它来做Pixelle-Video 生成的片子形态是一张或一段画面 解说词 配音 BGM所以它特别适合以信息传递为主的竖屏内容知识科普养生常识、效率方法、行业入门AI 写稿能力在这类主题上最稳读书/历史/文化解读搭配书籍风格或水墨风模板配上克隆音色很像你在刷到的那种文化解说号个人成长与情感治愈、生活感悟类选治愈系模板和柔和的音色氛围感直接到位固定栏目批量更新一个账号每周三、五各更一条用批量模式一次排好风格永远一致。相对而言强情节、多机位、真人出镜的内容不适合它它的甜区就是一个话题讲明白的单画面解说视频。遇到问题先看这四处大部分生成失败都出在四个地方按顺序排查基本能解决LLM 调用失败先核对 API Key 填对没有、网络通不通、账户余额够不够。文案是整条流程的起点它不跑通后面全都白搭。ComfyUI 连不上确认 ComfyUI 服务正在运行地址一般是http://127.0.0.1:8188在配置面板点「测试连接」最直观还连不上就在浏览器里直接访问这个地址试试。图像/视频生成失败多半是 ComfyUI 里缺对应模型或者工作流 JSON 文件不完整。可以先在 ComfyUI 里手动跑一遍同一工作流验证。生成太慢换本地 ComfyUI比云端快、减少分镜数量、换个响应更快的 LLM这三招立竿见影。依赖装不上时用uv cache clean清缓存再uv sync重装一次通常就好。更详细的问题清单在 docs/zh/troubleshooting.md运行日志在项目根目录的api_server.log报错信息基本都能在里面找到。想玩得更深自定义模板、工作流和 API三个进阶方向用到哪个看哪个自定义模板模板就是 templates/ 目录下的 HTML 文件会一点 HTML/CSS 就能改布局、颜色、字体或者照现有模板抄一个改出来。新建文件按static_/image_/video_前缀命名Web 界面会自动识别并按尺寸归类。自定义工作流图像、视频、TTS 三类能力都对应 workflows/ 下的 ComfyUI 工作流 JSON。自己在 ComfyUI 里搭好工作流、导出 JSON 丢进这个目录界面下拉菜单里就能选到。不想搭 ComfyUI 的话直连 API 厂商的工作流也已经预置好填 Key 就能用。API 集成想把这个能力嵌进自己的程序可以用 Python 接口PixelleVideoCore调用传入主题和分镜数异步返回视频文件路径同时项目带了一组 REST 接口api/ 目录支持提交任务、查进度、取结果详见 docs/zh/user-guide/api.md。跑通第一条视频之后建议先去历史记录页回看之前生成的片子和参数再针对不满意的地方换模板、换音色各试一轮——你会发现改一个参数就能得到一个完全不同的片子这正是这个工具最好玩的地方。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门