VILA-Lab/FigMirror

An Automated AI Agent Tool for Plotting Your Data in Any Paper's Figure Style.

解決的問題

FigMirror 消除了手動編輯繪圖程式碼以匹配特定學術論文視覺風格的繁瑣過程。使用者只需提供參考圖與自己的資料,即可自動產生精緻、可直接投稿的 PDF 檔案,以及完全可編輯的 matplotlib 程式碼,其風格與目標論文一致。

工作原理

該系統採用由繪圖者(Drawer)與審查者(Reviewer)組成的代理循環:

  1. 繪圖者代理:使用「基於基礎測量」(Grounded Measurement)技術渲染候選圖。該技術利用基礎模型回傳視覺目標的 x/y 坐標,並轉換為可執行的檢查(例如,檢查像素顏色)。
  2. 審查者代理:透過將候選圖與參考圖進行比對,執行視覺審計。提供結構化回饋,包括邊界框、修改檢查清單以及「保留清單」,以防止迭代過程中風格漂移。
  3. 協調器:管理代理之間的任務委派,並將審查回饋轉換為帶註解的影像與說明,供下一個繪圖階段使用。

對於 3D 圖形,系統使用幾何感知提示來處理相機角度、光照與比例。當代理之間意見不一致或置信度較低時,Aesthetic Lib 提供備用風格規則。

適用對象

需要創建符合特定風格指南或與特定論文系列視覺風格一致的高品質、可發表圖表的研究人員與資料科學家。

主要亮點

  • 代理迭代:採用角色分離的繪圖者/審查者循環,實現持續的視覺優化。
  • 基於基礎測量:使用基於坐標的視覺目標與基於程式碼的像素檢查,確保精確度。
  • 可編輯輸出:生成完整的 matplotlib 程式碼,而不僅是靜態影像。
  • 多介面支援:支援本地 Web UI,也可作為 Claude Code 與 Codex 的技能使用。
  • 3D 支援:包含針對 3D 組合與幾何的專用提示。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案