tong-io/tongflow
Modality-First GenAI Platform
TongFlow – 开源多模态 GenAI 工作流工作室
是什么
- 一个可视化“工作室”,您可以通过拖拽节点来封装生成式 AI 模型。每个节点执行一个简单操作——添加(引入数据)、转换(运行模型)或合并(合并结果)。系统将每个模型视为一种模态转换(例如:文本→图像,音频→文本),让您无需编写代码即可将它们串联起来。
核心功能
| 类别 | 示例节点(官方插件) |
|---|---|
| 添加 | 文本、图像、草图、音频、视频、文档、URL、3D 模型、摄像头/照片捕获 |
| 转换 | • 文本生成 / 重写 |
| • 图像生成、编辑、放大、姿态检测、抠图、分割、法线生成 | |
| • 视频生成、图像→视频、插值、编辑、放大、字幕/水印移除 | |
| • 音频:音乐生成、语音合成、语音识别、降噪、音源分离、音轨提取 | |
| 合并 | 图像融合、唇形同步、情感化语音、角色替换、动作迁移、文本合并 |
| 辅助 | Clip 拼接、mux/demux、镜头检测、文本分块、批量分组 |
| 其他 | 图像 → 3D、视频 → 动作捕捉、文档 → 文本、网页 → 文本 |
如何运行
- 桌面应用 – 一个约 10 MB 的安装包(macOS DMG 或 Windows MSI),启动一个轻量级客户端,指向云端工作室
app.tongflow.com。使用 Google 或微信登录。 - 完全本地化 – 您可以自托管后端(源码或 Docker),在自己的计算资源上运行插件。仓库提供了“从源码运行”和“使用 Docker 运行”的指南,以及用于接入您自己的 API 密钥或 Modal 令牌的“自托管设置”。
插件生态系统
- API 插件 暴露商业模型提供商(Google Gemini、OpenAI、DeepSeek、ByteDance、xAI、Runway),并提供每个节点的模型选择器。
- 路由插件 将多个第三方模型聚合到一个节点中(OpenRouter、CometAPI、ToAPIs、APIMart、Replicate、fal.ai)。
- GPU/CPU 插件 在 Modal(或本地)运行,实现重型媒体处理:图像生成(Z-Image、ERNIE、Krea2、Flux-2)、视频生成(MiniMax-H3、Bernini-R)、音频/音乐套件(ACE-Step、LeVo、MiniMax-Music3)、视觉工具(SAM-3、Sapiens2、SenseNova)、OCR/文档提取等。
为何重要
- 低门槛,高上限 – 您只需放置三种类型的节点;UI 隐藏了模型特定参数。
- 多模态 – 在一个画布中支持文本、图像、视频、音频、3D 和文档。
- 开放且可扩展 – 任何人都可以发布遵循相同节点接口的新插件;核心保持轻量,而生态系统可无限扩展。
安装与许可
- 从 GitHub Releases 页面安装桌面客户端(macOS universal dmg,Windows MSI)。macOS 构建目前需要清除隔离标志(
xattr -cr)。 - 该项目采用 AGPL-3.0 许可证,因此以服务形式部署的任何修改都必须开源。
获取帮助
- Discord 社区:https://discord.gg/K7V8az94Zf
- 完整文档和多语言 README 在
docs/文件夹中。
TL;DR: TongFlow 是一个开源的、可视化的多模态生成式 AI 模型串联工作流平台。它提供轻量级桌面前端、云端托管工作室和一个连接数十个商业及开源模型 API 的插件系统,让用户无需编写代码即可构建从简单文本到图像提示到完整音乐视频制作的任何内容。
相关
- 项目
- 项目
- 项目
- 项目
- 项目