crisng95/flowboard

Flowboard — open-source infinite canvas for AI product videos. Drag nodes for model, product, scene, video — connect them, click Generate. Auto-prompts write themselves. Runs locally; powered by Google Flow + Claude CLI.

解決的問題

Flowboard 是為重複性的電商影片製作而設計,專注於在角色、產品與場景之間維持一致性所面臨的困難。它以圖形基礎的工作流程取代每次重新上傳參考素材與重複輸入提示詞的手動過程,確保特定模型或服裝等資產的單一真實來源能在整個行銷活動中持續存在。

運作方式

本專案使用無限畫布工作區,將資產視為有向圖中的節點:

  • 參考節點: 使用者只需一次設定「角色」與「視覺資產」節點。這些節點作為錨點,由具備視覺能力的 LLM 描述這些資產以產生 aiBrief,並傳遞至下游。
  • 組合節點: 透過將參考節點連接到「影像」節點,系統會自動使用連結的 LLM CLI(例如 Claude Code)合成時尚編輯提示詞。一次批次生成多個姿態不同的變體。
  • 影片節點: 這些節點以影像為輸入,使用 Google 的 Veo 3.1 i2v 生成影片。系統會根據偵測到的場景(例如,工作室 vs. 街道)使用客製化的「動作詞彙」,以確保動作自然流暢。
  • 代理架構: 由於目標是 Google Flow,因此使用 Chrome 擴充功能,將使用者瀏覽器中的認證請求與 reCAPTCHA 憑證代理至本地 FastAPI 代理。

適用對象

專為使用 Google Flow(Pro/Ultra 計畫)製作一致性的產品與角色驅動影片內容的電商創意製作人與 AI 藝術家所設計。

核心亮點

  • 圖形基礎工作流程: 每個資產都是可重用的節點,每條邊代表真實的資料依賴關係。
  • 環境感知提示: 根據場景是工作室、街道、咖啡廳還是自然環境,自動切換動作詞彙。
  • 本地優先隱私保護: 所有畫板狀態與媒體均透過 SQLite 與本地儲存資料夾本地儲存。
  • 基於 CLI 的 LLM 集成: 呼叫現有的 LLM CLI(Claude Code、Gemini CLI、OpenAI Codex)以避免直接使用雲端 API 的成本。
  • 批量 i2v 生成: 若上游影像包含多個變體,僅需點擊一次即可生成多個影片變體。

相關

  • 專案
  • 專案
  • 專案
  • 專案