OpenCreator:3步完成多语言视频翻译,字幕和配音一次产出
2026/9/15 13:05:38 网站建设 项目流程

OpenCreator:3步完成多语言视频翻译,字幕和配音一次产出

【免费下载链接】OpenCreatorFormerly KrillinAI. Open-source AI workspace for creators, powered by Codex. Create videos, images, voice, avatars, translations, and edits with Agents in one place.项目地址: https://gitcode.com/GitHub_Trending/kr/OpenCreator

同一条视频要发国内账号,又要发海外账号时,翻译、配音、重新剪,往往还没开工就被报价劝退。开源工作台 OpenCreator(原 KrillinAI)就是为此做的:导入一段本地视频,视频翻译、双语字幕和 AI 配音一次完成,还能直接导出可用的成片与 SRT 文件。

一句话定位:跑在本机的 AI 创作工作台

OpenCreator 以 Codex 作为执行引擎,在本地 Runtime(apps/daemon)上运行视频翻译、视频下载、图像与视频生成、智能配音等 6 个创作工具,数据默认全部留在你自己的机器上。

  • 个人创作者:同一内容在 B 站、小红书、YouTube 分发,想自己出多语言版本
  • 小型内容团队:存量视频多,想批量本地化而不想外包给译制机构
  • 已有 Codex 账号的用户:Agent 直接复用现成登录态,没有额外学习成本
  • 不适合:不想装本地环境、不想配置任何 API Key、只想把视频丢给网页 SaaS 的人

核心能力:四类可以直接交给它的任务

仪表盘(Dashboard)汇总了当前可用的创作工具,按需点进任意一个工作区即可开工:

OpenCreator 仪表盘首页:Featured 推荐位加 6 个创作工具入口,按视频、图像、音频分类

把已有视频翻成外语成片

输入一段本地视频或公开链接,Whisper 先把语音转成文字,LLM 再结合上下文做翻译,负责字幕断句、对齐和术语处理。你拿到的是一组结果:双语字幕、配音音频(支持上传自己的声音样本做克隆)、横屏或竖屏成片,以及可单独导出的 SRT。仓库 README 里有一个实际案例:46 分钟的本地视频一次跑完,字幕完整覆盖、没有重叠。

视频翻译工作区的双语字幕效果:目标语言字幕与原语言译文在同一时间轴上对齐

把公开视频下载到项目里

输入 YouTube、Bilibili 等平台的公开链接,它会列出全部可用格式——示例中从 2160p 到 144p 共 11 档——你可以选 MP4 视频或只提取 MP3 音频,直接存进项目作为后续翻译、剪辑的素材。

视频下载工作区:右侧是任务摘要,左侧列出所有分辨率与音频格式供选择

从文字生成视频和封面

Seedance 根据提示词或参考图生成视频:设置画幅(如 16:9)、分辨率(如 1280x720)和时长后,成片可预览、重新生成、按版本下载。GPT Image 负责图像生成,封面生成器则结合主题与参考图产出多版封面供对比挑选。

视频生成工作区:右侧任务摘要展示 Seedance 2.5 的模型、格式与版本信息

让 Agent 在后台跑创作任务

用自然语言描述任务,Agent 负责执行;运行中可以排队追加下一个任务,也可以立即打断再改方向。每条计划任务拥有专属的长期会话,每次修改都会生成新版本而不是覆盖上一次的结果,对话与可视化工作区共享同一份任务状态,说过的话不用重复。

上手路径:3 步从克隆到第一个成片

前置条件:Node.js 22+ 与 pnpm,以及已登录的 Codex CLI(真实模型任务必需)。桌面端应用内置了 Codex CLI,开箱即用,可以不装环境。

  1. 克隆并启动git clone https://gitcode.com/GitHub_Trending/kr/KrillinAI,进入目录执行pnpm installpnpm web:dev,浏览器打开http://127.0.0.1:19861
  2. 配置服务:在 设置 → AI Services 里填入语音识别(如 OpenAI Whisper)和 LLM 的 API Key;想省成本可把语音识别切换为本地 faster-whisper
  3. 第一个任务:进 Dashboard 选 Video Translation,导入视频、选目标语言,等待 SRT 与成片产出

常见问题:成本、隐私和安装方式

  • 云端识别还是本地识别:云端 Whisper 准确率更高,但音频会上传、费用随视频时长增长;本地 faster-whisper 免费且私密,但要求机器能跑动模型。建议隐私敏感或短素材用本地,长视频且要求准确用云端。
  • 数据到底在哪:本地 Runtime 只监听127.0.0.1,数据库、附件和成片都在.runtime/目录,整体复制即可完成备份;但视频内容在翻译、配音时仍会发送到模型服务方,这一步不属于“本地”范畴,敏感素材请先确认服务方的数据政策。
  • 源码版还是桌面端:源码版需要 Node.js 22+ 与 pnpm,适合想锁版本、调试或参与贡献的人;桌面端内置 Codex CLI、按需拉起 Runtime,配置最少。两者共用apps/web同一套前端,界面和行为一致。

延伸资源

  • docs/zh/README.md:完整中文说明,含全部工具列表、支持模型矩阵与系统架构
  • docs/opencreator-user-guide-and-troubleshooting.md:日常运维手册,覆盖备份恢复、401 与连接卡住等常见故障
  • docs/operations/opencreator-desktop-release-runbook.md:桌面端发布手册,签名、公证与 Windows 构建要求
  • runtime/krillinai/config/config-example.toml:KrillinAI 服务端版配置示例,语音识别与 LLM 的字段样例值

收尾建议

先挑一条自己发布的成片丢进 Video Translation,目标语言选你实际在做的平台,再看产出的 SRT 需要人工修多少——这是判断它是否适合你生产线最快的办法。跑通之后,可以接着把旧视频挂进计划任务,让 Agent 在后台批量处理,第二天早上多语言版本就已经排好了。

【免费下载链接】OpenCreatorFormerly KrillinAI. Open-source AI workspace for creators, powered by Codex. Create videos, images, voice, avatars, translations, and edits with Agents in one place.项目地址: https://gitcode.com/GitHub_Trending/kr/OpenCreator

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询