dezoito/ollama-grid-search

A multi-platform desktop application to evaluate and compare LLM models, written in Rust and React.

解決的問題

Ollama Grid Search 自動化了手動測試不同大型語言模型(LLMs)、提示詞和推論參數,以找到特定用例最佳組合的繁瑣過程。無需逐一測試,它允許使用者同時在多個組態上執行實驗。

工作原理

該工具連接到 Ollama 伺服器(本地或遠端),並取得可用模型。使用者定義一組模型、提示詞和參數值。應用程式隨後遍歷這些輸入的所有可能組合——本質上執行「網格搜尋」——並產生一組回應,供視覺檢查與比較。

適用對象

使用 Ollama 在本地執行 LLM,並需要系統化方式評估與優化其提示詞與模型選擇的開發者與 AI 研究人員。

主要亮點

  • 多維度測試:可同時迭代多個模型、提示詞與參數。
  • A/B 測試:可直接並排比較不同提示詞或模型的結果。
  • 提示詞管理:內建提示詞資料庫,支援自動補全功能(使用 /)。
  • 效能指標:可選擇輸出回應元資料,包括推論時間與每秒令牌數。
  • 實驗追蹤:可列出、檢視並以 JSON 格式下載實驗日誌。
  • 併發控制:支援有限併發或同步呼叫,防止伺服器過載。

相關

  • 專案
  • 專案
  • 專案
  • 專案