Open Generative AI 免费 AI 图像生成与 AI 视频生成:400+ 模型的本地工作站
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
想自己用 AI 出图、出视频,却总卡在三个地方:商业平台要订阅、提示词被内容过滤拦下、数据只能存在别人的云里。Open Generative AI 是免费、开源、MIT 协议的替代方案:内置 400+ 个模型,覆盖文生图、文生视频和口型同步,没有内容过滤,还能自托管。
三步从源码跑起来
最快的路径是从源码启动 Next.js 网页版,三步就出图。需要 Node.js 18 以上。
git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run dev浏览器打开http://localhost:3000即进入界面。两点注意:--recurse-submodules不能省,工作流和智能体包在子模块里;npm run setup必须跑,它负责装依赖并构建 packages/studio 等工作区包,只npm install是起不来的。首次使用会让你填 MuAPI 访问密钥,只用本地模型可以跳过。
另外两条路:桌面版直接下载预构建安装包(macOS DMG、Windows EXE、Linux AppImage/DEB),无需 Node.js;源码方式则留给要改界面、加模型的人。
检查点:页面左侧能看到图像、视频等工作室标签页,就说明跑通了。
四种任务各要什么输入
工作室按任务拆分,每个输入什么、点哪里、得到什么都很明确。
出图。图像工作室是双模式:不传参考图,走文生图,70+ 模型(Flux、Nano Banana 2、Midjourney、GPT-4o 等),提示词必填;上传参考图后自动切到图生图,70+ 模型,提示词可选。兼容模型最多同时吃 14 张参考图,比如 Nano Banana 2 Edit。
文生视频 / 图生视频。视频工作室同样双模式:不传图走文生视频,85+ 模型(Kling、Sora 2、Veo 3、Seedance 2.0 等);传一张起始帧切到图生视频,120+ 模型。
让照片开口说话。口型同步工作室有 9 个专用模型、两种输入:人像图 + 音频,得到说话视频;已有视频 + 音频,得到对口型视频。人像模式分辨率可选 480p、720p、1080p。
电影感画面。电影工作室管虚拟相机:焦距 8mm 超广角到 85mm 特写,光圈 f/1.4 浅景深到 f/11 深景深,还能选机身与胶片质感,选择会自动转成提示词修饰。
检查点:同一个任务里换不换参考图,模型列表会不会跟着变——会,说明双模式识别正常。
参数怎么调才稳
效果稳不稳,一半在提示词,一半在默认值。三条经验:
- 提示词写"主体 + 风格 + 细节"。一句具体描述胜过大段形容词,例如"一只橘色虎斑猫在阳光下的花园里打盹,油画风格,毛发有光泽,暖色光"。
- 先选稳的模型再谈别的。各任务都有公认稳妥的起点:
| 任务场景 | 稳妥起点 |
|---|---|
| 通用文生图 | Flux |
| 要高清细节的文生图 | Nano Banana 2 |
| 文生视频 | Kling |
| 多比例 / 长时长视频 | Seedance 2.0 |
| 图片人物开口说话 | Infinite Talk |
- 默认值先别动,不满意再升档。宽高比默认 1:1,16:9、9:16、4:3 按需挑;分辨率从 512x512 到 4K,质量分基础 / 高质量两档;视频时长 5、10、15 秒可选。步数越多细节越足。
想批量出变体再挑优,用桌面版切到本地引擎:设置 → 本地模型里装 sd.cpp(Mac M 系列可跑 Metal GPU 加速),再到图像工作室点"本地"开关,全程不需要 API key,数据不出本机。
检查点:同一提示词连跑两次,构图和细节可复现,就说明模型和参数对路了。
五个常见问题怎么解
| 现象 | 处理 |
|---|---|
| macOS 打不开桌面应用 | 未做公证,终端跑xattr -cr "/Applications/Open Generative AI.app"再打开 |
| Windows 弹 SmartScreen | 安装程序未签名,点"更多信息"→"仍要运行" |
| Linux AppImage 启动失败 | chmod +x补执行权限;Ubuntu 24.04+ 建议改装 .deb,自带 AppArmor 配置 |
| 出图质量差 | 分辨率或质量档位偏低,升到 4K / 高质量再试 |
| 模型无响应 | 输入模式不匹配:没传参考图就用文生图模型,传了就切图生图 / 图生视频 |
检查点:每条都试过仍无输出,看应用控制台日志,多数是网络或密钥问题。
接到自己的项目里
生成能力要往外扩,入口有现成的:
- 走 API:两步模式——
POST /api/v1/{模型端点}提交任务,再轮询GET /api/v1/predictions/{request_id}/result直到完成,请求头带x-api-key。路由在 app/api/v1/。 - 加模型:往 packages/studio/src/models.js 加一条定义,它就会出现在模型选择器里,这个文件是所有模型的唯一来源。
- 参与贡献:界面组件集中在 packages/studio/src/components/,改完提 PR 即可。
接下来做三件事:打开图像工作室生成第一张图确认链路;用"主体 + 风格 + 细节"的提示词把质量调到高质量档跑一次对比;需要本地跑推理就下载桌面版,装好 sd.cpp 引擎。
【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考