tong-io/tongflow

Modality-First GenAI Platform

TongFlow – 開源多模態 GenAI 工作流工作室

是什麼

  • 一個可視化的「工作室」,您可透過拖曳節點來封裝生成式 AI 模型。每個節點執行簡單操作——新增(引入資料)、轉換(執行模型)或合併(合併結果)。系統將每個模型視為一種模態轉換(例如:文字→影像,音訊→文字),讓您無需撰寫程式碼即可將它們串接起來。

核心功能

類別 例子節點(官方插件)
新增 文字、影像、草圖、音訊、影片、文件、URL、3D 模型、相機/照片擷取
轉換 • 文字生成 / 重寫
• 影像生成、編輯、放大、姿態偵測、遮罩、分割、法線生成
• 影片生成、影像→影片、插值、編輯、放大、字幕/水印移除
• 音訊:音樂生成、語音合成、語音辨識、降噪、音源分離、音軌提取
合併 影像融合、唇形同步、情感化語音、角色替換、動作傳遞、文字合併
輔助 Clip 拼接、mux/demux、鏡頭偵測、文字分塊、批次分組
其他 影像 → 3D、影片 → 動作捕捉、文件 → 文字、網頁 → 文字

如何執行

  1. 桌面應用 – 一個約 10 MB 的安裝檔(macOS DMG 或 Windows MSI),啟動一個輕量級客戶端,指向雲端工作室 app.tongflow.com。使用 Google 或 WeChat 登入。
  2. 完全本地化 – 您可自架後端(原始碼或 Docker),在自己的運算資源上執行插件。倉儲提供「從原始碼執行」和「使用 Docker 執行」的指南,以及用於接入您自己的 API 金鑰或 Modal 令牌的「自架設設定」。

插件生態系統

  • API 插件 暴露商業模型供應商(Google Gemini、OpenAI、DeepSeek、ByteDance、xAI、Runway),並提供每個節點的模型選擇器。
  • 路由插件 將多個第三方模型聚合至一個節點中(OpenRouter、CometAPI、ToAPIs、APIMart、Replicate、fal.ai)。
  • GPU/CPU 插件 在 Modal(或本地)執行,實現重型媒體處理:影像生成(Z-Image、ERNIE、Krea2、Flux-2)、影片生成(MiniMax-H3、Bernini-R)、音訊/音樂套件(ACE-Step、LeVo、MiniMax-Music3)、視覺工具(SAM-3、Sapiens2、SenseNova)、OCR/文件提取等。

為何重要

  • 低門檻,高上限 – 您只需放置三種類型的節點;UI 隱藏模型特定參數。
  • 多模態 – 在一個畫布中支援文字、影像、影片、音訊、3D 和文件。
  • 開放且可擴展 – 任何人都可發布遵循相同節點介面的新插件;核心保持輕量,而生態系統可無限擴展。

安裝與授權

  • 從 GitHub Releases 頁面安裝桌面客戶端(macOS universal dmg,Windows MSI)。macOS 建構目前需清除隔離標誌(xattr -cr)。
  • 此專案採用 AGPL-3.0 授權,因此以服務形式部署的任何修改都必須開源。

取得協助


TL;DR: TongFlow 是一個開源的、可視化的多模態生成式 AI 模型串接工作流平台。它提供輕量級桌面前端、雲端託管工作室和一個連接數十個商業與開源模型 API 的插件系統,讓使用者無需撰寫程式碼即可從簡單的「文字→影像」提示到完整音樂影片製作,構建任何內容。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案