· TongFlow 团队 · 产品公告  · 7 min read

TongFlow 现在是 DeepSeek Harness 插件了——顺带盘点 v0.2.1 以来的更新

dsh-tongflow 把一个剧组装进你的 agent:每张图、每句配音、每段视频,agent 都先写一个 TongFlow 工作流文件,再跑出来给你看片。上次盘点之后还有:应用模式、撤销/重做、手动连线、带模型选择器的路由插件,以及 8 个新官方插件。

距离上次盘点以来最大的变化不是某个模型,而是 TongFlow 能跑在哪儿。 TongFlow 现在可以作为插件装进 DeepSeek Harnessdsh,DeepSeek 开源的 agent 框架)。这条头条之下,还有一个月的小版本(v0.2.2 → v0.3.3):表单式的应用模式、撤销/重做、手动拖线、一把钥匙开几十个模型的路由插件,以及 8 个新的官方插件。

第一次听说 TongFlow?它是一个开源的多模态 AIGC 工作流工作室——每个模型都是无限画布上的一个节点。可以先看这篇介绍

dsh-tongflow:把剧组装进 agent

一行装好:

npx @deepseek-ai/dsh@next plugin --profile web add dsh-tongflow

然后开一个新对话,第一句话以 @tongflow 开头。这个会话就变成了片场:左边是对话,中间是项目目录树,右边是预览或 TongFlow 画布——不用另起 TongFlow 服务,画布直接嵌在 dsh 自己的网页界面里。

三方分工划得很死,这正是设计意图:

  • dsh 管框架——会话、模型、工具、后台任务、网页壳。
  • agent 管创作——梗概、剧本、人物、分镜表、审片笔记。都是普通文件,用你的语言写。
  • TongFlow 管确定性的生成——每张图、每句台词、每段配乐、每个镜头,都是跑一个工作流文件*.tongflow.json)经 TongFlow 插件生成的。

我们故意没有做”生成一张图”这种工具。agent 给每个资产单独写一个工作流,文件就放在它产出的 take 旁边;把输入绑到项目资产上(tf://CHR_MEI/REFtf://EP01_SC003_SH0010/dialogue/2),跑,看结果,圈选好的那条。你可以在画布上打开同一个文件,改个节点再跑一遍。一个镜头做完,一键把它的各个资产工作流串成一个大工作流——由人来确认、微调整条链路,再让整集出片。

磁盘上的项目按真实剧组的方式组织:story/world/(角色、场景、道具、带一致性套件的风格圣经)、episodes/shots/notes/export/。镜头叫 EP01_SC003_SH0010,take 是 T01…,每条 take 都带一份 provenance.json——用的哪个工作流、绑了什么、哪些插件、跑了多久。首发模板是漫剧(剧本 → 角色定妆 → 分镜 → 关键帧 → 配音 → 图生视频 → 合成),自带中英文起步文件。

底层还是你在工作室里用的那套 TongFlow 引擎,通过新的 tongflow npm 包(不依赖任何框架的工作流核心,外加 tongflow/canvas React 入口)和 Python SDK 0.3.0 驱动。任何想让 agent 搭建并运行工作流的项目,都可以直接用这两块。

在哪儿:TongFlow 仓库里的 packages/dsh-tongflow、npm 上的 dsh-tongflow,很快也会出现在 awesome-dsh-plugin 列表里。

说句实话:v0.3.0 曾在 TongFlow 画布里面加过一个帮你搭工作流的聊天面板,v0.3.3 把它去掉了。agent 搭工作流这件事应该发生在 agent 框架里,dsh-tongflow 比一个侧边面板做得好得多——TongFlow 自己回到纯粹的工作流产品。

画布更顺手了

  • 应用模式(v0.3.0)——把任何工作流变成一个简单表单:上面输入,下面结果,画布隐藏。做好的工作流就是一个可复用的小工具。
  • 撤销 / 重做(v0.3.0)——Cmd+Z / Cmd+Shift+Z,连续打字合并成一步。
  • 手动连线(v0.3.2)——在任意两个把手之间拖一条边;拖的过程中实时校验契约,只有合法的连接能落下。
  • 一键自动排版、统一的节点间距(v0.3.1)。
  • 设置页重做 + 首次引导(v0.3.0)——可读的卡片、引导横幅、Modal 令牌一次粘贴自动拆分;失败信息带错误码、本地化说明和直达该填字段的链接。
  • 一键执行支持动态拆分(v0.2.3)——把文档拆成 N 段,下游每个节点按顺序跑 N 次。以前只处理第一段。
  • 开放词汇声音分离(v0.2.2)——separate-sound 节点:用文字描述一种声音(“狗叫”),把它从混音里分出来,由 SAM-Audio 或 fal 提供。
  • 全参考视频(v0.3.1)——任选图片、视频、音频的组合,智能岛直接给出 refs-gen-video;提示词里用 <Picture 1> / <Video 1> / <Audio 1> 指代。

路由插件:一把钥匙,几十个模型

聚合类插件拆成了 tongflow-router-*,每个都带节点级模型选择器Replicatefal.aiAPIMartOpenRouter。粘一个 API key,在节点上直接选 FLUX、Seedream、Veo、Kling、Whisper 或 Hunyuan3D。

8 个新官方插件

  • Krea 2 Turbo——开源权重 12B 文生图,8 步,最高 2K。
  • Qwen3.8-27B——多模态文本:图像和视频理解、转写,跑在你自己的 Modal GPU 上。
  • IndexTTS-2.5——零样本声音克隆 + 情绪控制(“情感语音”)。
  • MiniMax-Music3——自托管音乐生成。
  • SenseNova-Vision——视觉问答、检测与 OCR、法线、抠图、姿态。
  • DeepSeek——V4 flash / pro,思考开或关;推理时节点旁有实时的思考气泡
  • xAIRunway——API 插件。
  • 还有单独一篇讲过的 MiniMax-H3:带原生立体声的视频生成。

另外新增了 tongflow-local-* 前缀,给跑在你本机上的插件——第一个是在 Apple 芯片上原生运行 MiniMax-H3。

官方插件目前 45 个。LTX 和 FastWan 已下架;内置示例工作流的图生视频一步改用 MiniMax-H3。

试试看

  • 工作室:app.tongflow.com,或到 Releases 下载 v0.3.3 桌面壳。
  • 在你的 agent 里:npx @deepseek-ai/dsh@next plugin --profile web add dsh-tongflow,然后说 @tongflow,描述你想拍的片子。
  • 拿去做东西:npm i tongflow · pip install tongflow

觉得有用的话,到 GitHub 点个 star,对我们帮助很大。

放开想象,把点子拉长——来试试吧。