· TongFlow 团队 · 产品公告 · 7 min read
TongFlow 现在是 DeepSeek Harness 插件了——顺带盘点 v0.2.1 以来的更新
dsh-tongflow 把一个剧组装进你的 agent:每张图、每句配音、每段视频,agent 都先写一个 TongFlow 工作流文件,再跑出来给你看片。上次盘点之后还有:应用模式、撤销/重做、手动连线、带模型选择器的路由插件,以及 8 个新官方插件。
距离上次盘点以来最大的变化不是某个模型,而是 TongFlow 能跑在哪儿。 TongFlow 现在可以作为插件装进 DeepSeek Harness(dsh,DeepSeek 开源的 agent 框架)。这条头条之下,还有一个月的小版本(v0.2.2 → v0.3.3):表单式的应用模式、撤销/重做、手动拖线、一把钥匙开几十个模型的路由插件,以及 8 个新的官方插件。
第一次听说 TongFlow?它是一个开源的多模态 AIGC 工作流工作室——每个模型都是无限画布上的一个节点。可以先看这篇介绍。
dsh-tongflow:把剧组装进 agent
一行装好:
npx @deepseek-ai/dsh@next plugin --profile web add dsh-tongflow然后开一个新对话,第一句话以 @tongflow 开头。这个会话就变成了片场:左边是对话,中间是项目目录树,右边是预览或 TongFlow 画布——不用另起 TongFlow 服务,画布直接嵌在 dsh 自己的网页界面里。
三方分工划得很死,这正是设计意图:
- dsh 管框架——会话、模型、工具、后台任务、网页壳。
- agent 管创作——梗概、剧本、人物、分镜表、审片笔记。都是普通文件,用你的语言写。
- TongFlow 管确定性的生成——每张图、每句台词、每段配乐、每个镜头,都是跑一个工作流文件(
*.tongflow.json)经 TongFlow 插件生成的。
我们故意没有做”生成一张图”这种工具。agent 给每个资产单独写一个工作流,文件就放在它产出的 take 旁边;把输入绑到项目资产上(tf://CHR_MEI/REF、tf://EP01_SC003_SH0010/dialogue/2),跑,看结果,圈选好的那条。你可以在画布上打开同一个文件,改个节点再跑一遍。一个镜头做完,一键把它的各个资产工作流串成一个大工作流——由人来确认、微调整条链路,再让整集出片。
磁盘上的项目按真实剧组的方式组织:story/、world/(角色、场景、道具、带一致性套件的风格圣经)、episodes/、shots/、notes/、export/。镜头叫 EP01_SC003_SH0010,take 是 T01…,每条 take 都带一份 provenance.json——用的哪个工作流、绑了什么、哪些插件、跑了多久。首发模板是漫剧(剧本 → 角色定妆 → 分镜 → 关键帧 → 配音 → 图生视频 → 合成),自带中英文起步文件。
底层还是你在工作室里用的那套 TongFlow 引擎,通过新的 tongflow npm 包(不依赖任何框架的工作流核心,外加 tongflow/canvas React 入口)和 Python SDK 0.3.0 驱动。任何想让 agent 搭建并运行工作流的项目,都可以直接用这两块。
在哪儿:TongFlow 仓库里的 packages/dsh-tongflow、npm 上的 dsh-tongflow,很快也会出现在 awesome-dsh-plugin 列表里。
说句实话:v0.3.0 曾在 TongFlow 画布里面加过一个帮你搭工作流的聊天面板,v0.3.3 把它去掉了。agent 搭工作流这件事应该发生在 agent 框架里,dsh-tongflow 比一个侧边面板做得好得多——TongFlow 自己回到纯粹的工作流产品。
画布更顺手了
- 应用模式(v0.3.0)——把任何工作流变成一个简单表单:上面输入,下面结果,画布隐藏。做好的工作流就是一个可复用的小工具。
- 撤销 / 重做(v0.3.0)——
Cmd+Z/Cmd+Shift+Z,连续打字合并成一步。 - 手动连线(v0.3.2)——在任意两个把手之间拖一条边;拖的过程中实时校验契约,只有合法的连接能落下。
- 一键自动排版、统一的节点间距(v0.3.1)。
- 设置页重做 + 首次引导(v0.3.0)——可读的卡片、引导横幅、Modal 令牌一次粘贴自动拆分;失败信息带错误码、本地化说明和直达该填字段的链接。
- 一键执行支持动态拆分(v0.2.3)——把文档拆成 N 段,下游每个节点按顺序跑 N 次。以前只处理第一段。
- 开放词汇声音分离(v0.2.2)——
separate-sound节点:用文字描述一种声音(“狗叫”),把它从混音里分出来,由 SAM-Audio 或 fal 提供。 - 全参考视频(v0.3.1)——任选图片、视频、音频的组合,智能岛直接给出
refs-gen-video;提示词里用<Picture 1>/<Video 1>/<Audio 1>指代。
路由插件:一把钥匙,几十个模型
聚合类插件拆成了 tongflow-router-*,每个都带节点级模型选择器:Replicate、fal.ai、APIMart、OpenRouter。粘一个 API key,在节点上直接选 FLUX、Seedream、Veo、Kling、Whisper 或 Hunyuan3D。
8 个新官方插件
- Krea 2 Turbo——开源权重 12B 文生图,8 步,最高 2K。
- Qwen3.8-27B——多模态文本:图像和视频理解、转写,跑在你自己的 Modal GPU 上。
- IndexTTS-2.5——零样本声音克隆 + 情绪控制(“情感语音”)。
- MiniMax-Music3——自托管音乐生成。
- SenseNova-Vision——视觉问答、检测与 OCR、法线、抠图、姿态。
- DeepSeek——V4 flash / pro,思考开或关;推理时节点旁有实时的思考气泡。
- xAI 和 Runway——API 插件。
- 还有单独一篇讲过的 MiniMax-H3:带原生立体声的视频生成。
另外新增了 tongflow-local-* 前缀,给跑在你本机上的插件——第一个是在 Apple 芯片上原生运行 MiniMax-H3。
官方插件目前 45 个。LTX 和 FastWan 已下架;内置示例工作流的图生视频一步改用 MiniMax-H3。
试试看
- 工作室:app.tongflow.com,或到 Releases 下载 v0.3.3 桌面壳。
- 在你的 agent 里:
npx @deepseek-ai/dsh@next plugin --profile web add dsh-tongflow,然后说@tongflow,描述你想拍的片子。 - 拿去做东西:
npm i tongflow·pip install tongflow。
觉得有用的话,到 GitHub 点个 star,对我们帮助很大。
放开想象,把点子拉长——来试试吧。
