拓冰建站拓冰建站
首页 / 资讯中心 / 正文

Open Generative AI 入门指南:免费开源的 AI 图像与视频生成,从安装到出图的完整路径

Open Generative AI 入门指南免费开源的 AI 图像与视频生成从安装到出图的完整路径【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI想不花订阅费、也不被提示词审查拦截就把 Flux、Midjourney、Kling、Sora、Veo 这类主流模型放进同一个工作台里生成自己的第一张 AI 图像或第一段 AI 视频——这就是 Open Generative AI 要解决的事。它是 MIT 协议的开源项目聚合 400 个模型packages/studio/src/models.js 是全仓库的模型清单内置图像、视频、音频、口型同步、电影感镜头等 14 个工作室支持自托管桌面端还内置本地推理引擎。本文按选安装方式 → 跑通第一次生成 → 进阶用法 → 排障的顺序带你把这套工具真正用起来。三种上手方式按你的身份选一条只想先看看效果用官方在线版浏览器打开即可用全部工作室无需 Node 环境。注意云端模型需要填写 API Key如果只用桌面端的本地模型可以跳过。要日常创作、偶尔离线装桌面应用macOS 提供 DMGWindows 提供 EXE 安装包Linux 提供 AppImage 和 .deb。本地推理是桌面端独有的能力在线版固定走云端 API。要改代码或贡献功能从源码构建仓库带有 git submodule必须一并检出否则会报找不到 pages 目录之类的构建错误。macOS 桌面应用未经 Apple 公证首次启动会被 Gatekeeper 拦住只需处理一次xattr -cr /Applications/Open Generative AI.app执行后右键应用选打开即可。Linux 用户装 AppImage 后同样要做一次执行权限处理Ubuntu 24.04 及以上版本受沙箱策略影响建议直接装 .deb 包。源码构建的最小路径要求 Node.js 18 及以上git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run electron:dev # 桌面端要跑 Web 版改用 npm run dev访问 http://localhost:3000npm run setup会依次完成装依赖和构建 studio、workflow、agents 等 workspace 子包只跑npm install是不够的。第一次实操在图像工作室跑通一张图下面带你完整做完一次生成全程不超过五分钟。打开。启动应用后进入 Image Studio图像工作室默认就是文本到图像模式如果你上传了参考图模型列表会自动切换成图像到图像那组这一步不用手动操作。输入。在提示词框里按主体 环境 光线 风格来组织句子例如橘色虎斑猫蜷在窗台阳光里毛发细节清晰暖调逆光写实摄影风格。越具体模型要猜的越少出图越可控只写一只猫基本等于把构图权交给模型。调整。挑一个模型通用需求选 Flux 或 Nano Banana 2 这类主力模型再按用途选宽高比横屏素材用 16:9竖屏用 9:16方形头像用 1:1。分辨率和质量档位会随所选模型变化只在该模型支持的范围内可改。生成。点 Generate完成后在历史面板一键下载全分辨率文件。参考图会被存进上传历史下次直接复用不用重复上传。按场景对照着选不用逐个模型试使用场景推荐选项通用出图Nano Banana 2分辨率 2K 起写实人像Midjourney v750mm 焦距、f/1.4 光圈在电影工作室图生图 / 风格迁移Nano Banana 2 Edit最多 14 张参考图文生视频Kling、Seedance 2.0时长 5–15 秒图生视频Seedance 2.0 I2V上传一张起始帧让图片开口说话Infinite Talk480p / 720p 两档电影感镜头Cinema Studio胶片机型 变形宽银幕镜头进阶用法按场景各给一条可照做的建议追求更高质量先用基础质量档把构图和提示词敲定确认构图对了再切到高质量档重跑同一提示词分辨率同时提到 2K/4K。这是最省额度的顺序不要反过来。多图参考输入选一个支持多参考图的编辑模型——Nano Banana 2 Edit 最多 14 张Flux Kontext Dev 最多 10 张。一次勾选全部参考图后点Use Selected确认图片按你勾选的顺序传给模型所以第一张图就是最强约束把最关键的构图或风格参考放在第一位。电影感镜头控制在 Cinema Studio 里用真实摄影参数代替形容词——机身选 70mm 胶片、镜头选变形宽银幕、焦距 35mm 拍环境、50mm 拍人物光圈 f/1.4 做浅景深虚化f/11 让前后景都清晰。这些选择会被翻译成模型能理解的镜头语言比在提示词里堆电影感大片感有效得多。让静态图开口说话进 Lip Sync Studio保持默认肖像图模式上传一张正脸图加一段音频480p / 720p 两档选 Infinite Talk 出 talking video如果手里已有视频切到 Video 模式做口型重同步。搭一条自动流程用 Workflow Studio 把概念图生成 → 分辨率提升 → 风格化编辑 → 批量导出连成四步链路跑通后存进 My Workflows 反复执行也可以直接跑社区发布的模板。工作流的每个环节同样能通过 API 触发方便接入你自己的系统。高频故障照现象→原因→解决排查现象macOS 首次打不开桌面应用。原因应用未经 Apple 公证Gatekeeper 默认拦截。解决终端执行xattr -cr /Applications/Open Generative AI.app或在系统设置 → 隐私与安全性里点仍要打开仅需做一次。现象Windows 安装时提示已保护你的电脑。原因安装包未做代码签名SmartScreen 例行提醒。解决点更多信息再选仍要运行安装本身不受影响。现象Linux 的 AppImage 无反应或启动即退出。原因文件缺少执行权限、旧系统缺依赖或 Ubuntu 24.04 的沙箱策略。解决chmod x加执行权限、sudo apt install libfuse2补依赖24.04 以上直接改装 .deb 包它自带所需的安全策略配置。现象出图偏糊、细节丢失。原因用了基础质量档或分辨率偏低。解决切高质量模式并把分辨率提到 2K 或 4K 重跑同一提示词。现象生成速度明显慢。原因云端排队或所选模型本身开销大。解决先用基础质量档出图桌面端可在设置 → 本地模型里启用 sd.cpp 引擎走本地推理离线也能出图。现象提示词报不被支持或选了模型不出结果。原因模型类型和输入不匹配例如把纯文字需求交给了必须传参考图的编辑模型。解决核对模型类别——纯文字出图选文本到图像模型上传参考图后系统会自动切到图像到图像列表。适用边界与下一步这套工具适合个人创作、设计打样、批量素材生产免费、无内容过滤、代码可改可托管但它不适合对延迟和稳定性有 SLA 要求的生产链路也不适合需要完整内容审核流水线的合规场景——云端模型统一走外部 API 网关离线生成只覆盖本地引擎支持的图像模型。延伸方向有三个一是翻模型清单 packages/studio/src/models.js按分类找适合你项目的型号并核对参数二是查 app/api/ 下的接口代码所有调用都是POST 提交任务、GET 轮询结果两步照此即可把生成能力接进自己的应用三是参与开源提交前可先跑一遍 tests/ 里的本地推理相关测试确认环境。现在就打开图像工作室输入你准备好的第一句提示词按下 Generate。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门