krillinai/OpenCreator

发布时间 2026-09-22 9 天前
来源 GitHub TypeScript
字数 2,880 字
查看原文

AI智能总结

开源项目 OpenCreator(前身为 KrillinAI)发布,作为本地化 AI 创意与开发工作空间,整合可视化创作工具、可复用的 Skills 与 Agents,覆盖脚本、视频、图片、语音、数字人、翻译与剪辑等场景。

开源 AI 工作空间与创作者技能(Skills)

把可视化创作工具、可复用的 Skills 与 Agents 整合到同一个工作空间,覆盖脚本、视频、图片、语音、数字人、翻译与剪辑等场景。

OpenCreator 的前身是 KrillinAI。

OpenCreator Agent 工作空间

项目概览

OpenCreator 面向希望在本地持续推进创意与开发工作的个人与团队。它不再重复实现一套 Agent 循环,而是直接以 Codex CLI 作为执行引擎,并在其外围提供稳定的本地 Runtime(运行时)、可视化工作空间以及桌面端宿主。

OpenCreator 提供两种相互衔接的工作方式:

  • 内容工作空间:使用可视化工具与创作模板,完成视频翻译与下载、图片与视频生成、配音、文章与社媒帖文写作、短视频脚本撰写以及火柴人动画。
  • Agent 对话:用自然语言发起并引导创意或开发任务,按项目组织会话,让运行(Runs)在后台持续工作,并在一个统一的位置管理审批、附件、文件、Skills、MCP、定时任务、通知、记忆与诊断。

Web 是唯一的前端实现。桌面端加载同一套 Web 构建产物,仅在其上叠加操作系统所必需的能力,例如目录选择、窗口生命周期、托盘行为与系统通知。由于数据与内容视图保持一致,两个平台共享同一套通用 UI 与 Runtime 行为。

项目亮点

  • 🤖 原生 Codex:复用 Codex 的 Agent 循环、模型、推理、工具调用、会话、Skills 与 MCP,无需再维护第二套执行引擎。

  • 🚀 开箱即用的桌面应用:直接从桌面应用启动 OpenCreator,已内置 Codex CLI;本地 Runtime 按需启动,并自动准备好默认项目。

  • 🔄 托管的 Runtime 组件:查看打包中、当前使用与最新版本的 yt-dlp;周期性地检查更新,并在更新失败时保留当前可用版本,支持手动更新。

  • 🎨 多模态创作:通过一套相互衔接的工作流,统一创建并管理视频、图片、音频、字幕与文档。

  • 🧩 创作模板:无需从零搭建提示词与参数设置,直接基于可复用模板开始图片与视频创作。

  • 🔗 双模式工作流:既可通过可视化工作空间工作,也可通过 Agent 对话工作;同一套共享状态机会让步骤、进度与结果始终保持同步。

  • 🕘 版本管理:每一次修订都会生成新版本,同时保留先前的设置与输出,便于回溯与对比。

  • 🧩 可复用 Skills:使用视频工作流相关 Skills,自行扩展 Agent 能力,并通过 Codex 原生配置管理 MCP。

  • 🧠 记忆:维护全局、项目与线程级记忆,附带摘要与可复现的 Run 输入快照。

  • 🔐 本地安全:默认将数据、附件与日志保留在本地,配合审批流程与脱敏后的诊断信息。

  • 🌐 本地化界面:Web 与桌面客户端均支持简体中文、英文与瑞典语;可自动检测系统语言,也可手动选择。

创作者工具

当前版本包含十款创作者工具。可用的模型与服务取决于本地 Codex 环境与 AI 服务设置。

打开仪表盘(Dashboard)即可撰写文章、小红书帖子或短视频脚本;制作火柴人动画;对视频进行翻译或下载;生成封面、图片或视频;以及通过智能配音生成语音。

OpenCreator 创作者仪表盘

更多创作者工具正在持续加入中。

工作空间 状态 能力
视频翻译 ✅ 已可用 导入本地或公网视频;通过云端或本地 Whisper 服务进行转录;借助 LLM 上下文完成字幕分段、对齐、术语与翻译;可配置双语字幕、配音或自定义声音样本、字幕样式、横屏或竖屏构图;支持导出 SRT、音频或视频
视频下载器 ✅ 已可用 解析 YouTube、Bilibili 及其他受支持的公网链接,查看可用画质与格式选项,并下载视频或音频用于后续工作流
封面生成器 ✅ 已可用 结合主题、视频链接与可选的参考图,生成并对比多种内容封面方案
图片生成 ✅ 已可用 基于提示词与可选参考图,通过 GPT Image 生成图片;可配置画面比例与输出数量,并逐张预览与下载
文章撰写 ✅ 已可用 将主题、链接、视频或源文档转化为可编辑的主题选项、大纲与完整文章;可加入生成的图片,并导出 Markdown、HTML 或 PDF
小红书帖子 ✅ 已可用 基于主题或素材生成完整的小红书帖子,支持设置目标受众、帖子类型与篇幅,并复制或下载结果
短视频脚本 ✅ 已可用 根据主题或素材生成可直接拍摄的、分段式的脚本,针对受众、平台、时长与风格进行定制,并支持编辑、复制或下载
火柴人动画 ✅ 已可用 将文字或 YouTube 内容转换为旁白、语音、保持角色一致性的分镜画面、字幕,并生成可下载的火柴人动画
自动切片 🚧 开发中 分析长视频,识别高光片段,并将选定片段转化为可复用的短视频
智能配音 ✅ 已可用 将脚本转换为配音,支持选择声音、节奏与情感控制
视频生成 ✅ 已可用 基于提示词与参考图,通过 Seedance 生成视频,支持预览、重新生成与逐版本下载
数字人 🚧 开发中 整合脚本、语音与数字人形象,生成可讲解的头像视频

创作模板

无需从零搭建每一处提示词与设置,直接从模板开始创作。可按分类浏览精选模板,包括视频创作与图片设计,快速找到契合你想法的起点。

模板库既包含 OpenCreator 官方创建的模板,也收录独立创作者提交的模板。第三方模板会在详情页标注作者,并链接到原始来源。

覆盖视频与图片分类的精选创作模板

打开模板即可预览示例效果,并查看其提示词、参数、标签、作者与原始来源。选择「使用此模板」即可基于它开始创作,随后按需调整输入以适配自己的内容。

图片创作模板详情,展示示例效果、参数与提示词

Skills

创作者工具提供可视化控制能力,Skills 则为 Agent 提供可复用的指令与工具工作流。OpenCreator 在仓库内自带视频生产相关的 Skills,同时也支持管理本地 Codex Skills。

仓库中的 skills/ 目录提供了供 Agent 操作内嵌 KrillinAI CLI 时使用的可复用指令。

Skill 能力
KrillinAI CLI 选择命令、检查配置,并解读进度、清单、输出与错误信息
Subtitle(字幕) 下载平台字幕或对媒体进行转录,翻译字幕,并生成双语或竖屏短视频字幕
TTS(语音合成) 基于字幕生成目标语言配音,并可选择性地合成带配音的视频
Landscape Render(横屏渲染) 渲染横屏视频,支持双语字幕或配音音频与目标语言字幕
Portrait Render(竖屏渲染) 合成竖屏视频,包含标题、双语字幕或配音
Cover(封面) 基于完整的文本提示词生成封面图,并保存图片与最终提示词
Pipeline Plan(流水线规划) 在 dry-run(试运行)模式下校验多阶段输出计划;通过各阶段对应的 Skill 执行实际工作

通过自定义 Skills 进行扩展

OpenCreator 支持由 SKILL.md 定义的本地 Codex Skills,因此你可以补充自己的方法与工作流,而不仅限于使用固定的创作者工具。Skill 的可用性取决于当前激活的 Codex home 与已安装的 Skills;视频工作流相关 Skills 需要正确配置 CLI 与相关服务。被收录到仓库中,并不意味着每个 Skill 都已自动安装,也不是所有外部服务都已捆绑提供。

对话与工作空间协同运作

用自然语言描述任务,需要精细控制时再切入可视化工具。

OpenCreator 对话与可视化工作空间协同工作

精细化的工作空间控制

精确调整字幕、镜头、音频与生成参数。

灵活的对话式编辑

用自然语言告诉 Agent 需要修改的内容,并迭代完善结果。

状态同步

对话与工作空间共享同一任务的当前状态,无需重复描述。