☰
Open Generative AI 免费 AI 图像生成与 AI 视频生成:400+ 模型的本地工作站
2026/10/8 2:05:41 网站建设 项目流程

Open Generative AI 免费 AI 图像生成与 AI 视频生成:400+ 模型的本地工作站

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

想自己用 AI 出图、出视频,却总卡在三个地方:商业平台要订阅、提示词被内容过滤拦下、数据只能存在别人的云里。Open Generative AI 是免费、开源、MIT 协议的替代方案:内置 400+ 个模型,覆盖文生图、文生视频和口型同步,没有内容过滤,还能自托管。

三步从源码跑起来

最快的路径是从源码启动 Next.js 网页版,三步就出图。需要 Node.js 18 以上。

git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run dev

浏览器打开http://localhost:3000即进入界面。两点注意:--recurse-submodules不能省,工作流和智能体包在子模块里;npm run setup必须跑,它负责装依赖并构建 packages/studio 等工作区包,只npm install是起不来的。首次使用会让你填 MuAPI 访问密钥,只用本地模型可以跳过。

另外两条路:桌面版直接下载预构建安装包(macOS DMG、Windows EXE、Linux AppImage/DEB),无需 Node.js;源码方式则留给要改界面、加模型的人。

检查点:页面左侧能看到图像、视频等工作室标签页,就说明跑通了。

四种任务各要什么输入

工作室按任务拆分,每个输入什么、点哪里、得到什么都很明确。

出图。图像工作室是双模式:不传参考图,走文生图,70+ 模型(Flux、Nano Banana 2、Midjourney、GPT-4o 等),提示词必填;上传参考图后自动切到图生图,70+ 模型,提示词可选。兼容模型最多同时吃 14 张参考图,比如 Nano Banana 2 Edit。

文生视频 / 图生视频。视频工作室同样双模式:不传图走文生视频,85+ 模型(Kling、Sora 2、Veo 3、Seedance 2.0 等);传一张起始帧切到图生视频,120+ 模型。

让照片开口说话。口型同步工作室有 9 个专用模型、两种输入:人像图 + 音频,得到说话视频;已有视频 + 音频,得到对口型视频。人像模式分辨率可选 480p、720p、1080p。

电影感画面。电影工作室管虚拟相机:焦距 8mm 超广角到 85mm 特写,光圈 f/1.4 浅景深到 f/11 深景深,还能选机身与胶片质感,选择会自动转成提示词修饰。

检查点:同一个任务里换不换参考图,模型列表会不会跟着变——会,说明双模式识别正常。

参数怎么调才稳

效果稳不稳,一半在提示词,一半在默认值。三条经验:

  • 提示词写"主体 + 风格 + 细节"。一句具体描述胜过大段形容词,例如"一只橘色虎斑猫在阳光下的花园里打盹,油画风格,毛发有光泽,暖色光"。
  • 先选稳的模型再谈别的。各任务都有公认稳妥的起点:
任务场景稳妥起点
通用文生图Flux
要高清细节的文生图Nano Banana 2
文生视频Kling
多比例 / 长时长视频Seedance 2.0
图片人物开口说话Infinite Talk
  • 默认值先别动,不满意再升档。宽高比默认 1:1,16:9、9:16、4:3 按需挑;分辨率从 512x512 到 4K,质量分基础 / 高质量两档;视频时长 5、10、15 秒可选。步数越多细节越足。

想批量出变体再挑优,用桌面版切到本地引擎:设置 → 本地模型里装 sd.cpp(Mac M 系列可跑 Metal GPU 加速),再到图像工作室点"本地"开关,全程不需要 API key,数据不出本机。

检查点:同一提示词连跑两次,构图和细节可复现,就说明模型和参数对路了。

五个常见问题怎么解

现象处理
macOS 打不开桌面应用未做公证,终端跑xattr -cr "/Applications/Open Generative AI.app"再打开
Windows 弹 SmartScreen安装程序未签名,点"更多信息"→"仍要运行"
Linux AppImage 启动失败chmod +x补执行权限;Ubuntu 24.04+ 建议改装 .deb,自带 AppArmor 配置
出图质量差分辨率或质量档位偏低,升到 4K / 高质量再试
模型无响应输入模式不匹配:没传参考图就用文生图模型,传了就切图生图 / 图生视频

检查点:每条都试过仍无输出,看应用控制台日志,多数是网络或密钥问题。

接到自己的项目里

生成能力要往外扩,入口有现成的:

  • 走 API:两步模式——POST /api/v1/{模型端点}提交任务,再轮询GET /api/v1/predictions/{request_id}/result直到完成,请求头带x-api-key。路由在 app/api/v1/。
  • 加模型:往 packages/studio/src/models.js 加一条定义,它就会出现在模型选择器里,这个文件是所有模型的唯一来源。
  • 参与贡献:界面组件集中在 packages/studio/src/components/,改完提 PR 即可。

接下来做三件事:打开图像工作室生成第一张图确认链路;用"主体 + 风格 + 细节"的提示词把质量调到高质量档跑一次对比;需要本地跑推理就下载桌面版,装好 sd.cpp 引擎。

【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询