tong-io/tongflow
Modality-First GenAI Platform
TongFlow – 開源多模態 GenAI 工作流工作室
是什麼
- 一個可視化的「工作室」,您可透過拖曳節點來封裝生成式 AI 模型。每個節點執行簡單操作——新增(引入資料)、轉換(執行模型)或合併(合併結果)。系統將每個模型視為一種模態轉換(例如:文字→影像,音訊→文字),讓您無需撰寫程式碼即可將它們串接起來。
核心功能
| 類別 | 例子節點(官方插件) |
|---|---|
| 新增 | 文字、影像、草圖、音訊、影片、文件、URL、3D 模型、相機/照片擷取 |
| 轉換 | • 文字生成 / 重寫 |
| • 影像生成、編輯、放大、姿態偵測、遮罩、分割、法線生成 | |
| • 影片生成、影像→影片、插值、編輯、放大、字幕/水印移除 | |
| • 音訊:音樂生成、語音合成、語音辨識、降噪、音源分離、音軌提取 | |
| 合併 | 影像融合、唇形同步、情感化語音、角色替換、動作傳遞、文字合併 |
| 輔助 | Clip 拼接、mux/demux、鏡頭偵測、文字分塊、批次分組 |
| 其他 | 影像 → 3D、影片 → 動作捕捉、文件 → 文字、網頁 → 文字 |
如何執行
- 桌面應用 – 一個約 10 MB 的安裝檔(macOS DMG 或 Windows MSI),啟動一個輕量級客戶端,指向雲端工作室
app.tongflow.com。使用 Google 或 WeChat 登入。 - 完全本地化 – 您可自架後端(原始碼或 Docker),在自己的運算資源上執行插件。倉儲提供「從原始碼執行」和「使用 Docker 執行」的指南,以及用於接入您自己的 API 金鑰或 Modal 令牌的「自架設設定」。
插件生態系統
- API 插件 暴露商業模型供應商(Google Gemini、OpenAI、DeepSeek、ByteDance、xAI、Runway),並提供每個節點的模型選擇器。
- 路由插件 將多個第三方模型聚合至一個節點中(OpenRouter、CometAPI、ToAPIs、APIMart、Replicate、fal.ai)。
- GPU/CPU 插件 在 Modal(或本地)執行,實現重型媒體處理:影像生成(Z-Image、ERNIE、Krea2、Flux-2)、影片生成(MiniMax-H3、Bernini-R)、音訊/音樂套件(ACE-Step、LeVo、MiniMax-Music3)、視覺工具(SAM-3、Sapiens2、SenseNova)、OCR/文件提取等。
為何重要
- 低門檻,高上限 – 您只需放置三種類型的節點;UI 隱藏模型特定參數。
- 多模態 – 在一個畫布中支援文字、影像、影片、音訊、3D 和文件。
- 開放且可擴展 – 任何人都可發布遵循相同節點介面的新插件;核心保持輕量,而生態系統可無限擴展。
安裝與授權
- 從 GitHub Releases 頁面安裝桌面客戶端(macOS universal dmg,Windows MSI)。macOS 建構目前需清除隔離標誌(
xattr -cr)。 - 此專案採用 AGPL-3.0 授權,因此以服務形式部署的任何修改都必須開源。
取得協助
- Discord 社群:https://discord.gg/K7V8az94Zf
- 完整文件與多語言 README 在
docs/資料夾中。
TL;DR: TongFlow 是一個開源的、可視化的多模態生成式 AI 模型串接工作流平台。它提供輕量級桌面前端、雲端託管工作室和一個連接數十個商業與開源模型 API 的插件系統,讓使用者無需撰寫程式碼即可從簡單的「文字→影像」提示到完整音樂影片製作,構建任何內容。
相關
- 專案
- 專案
- 專案
- 專案
- 專案