aidatatools/ollama-benchmark

LLM Benchmark for Throughput via Ollama (Local LLMs)

解決的問題

此工具提供了一種測量透過 Ollama 執行的本地大型語言模型(LLM)實際吞吐量(每秒令牌數)的方法,讓使用者能了解其硬體在不同模型大小下的表現。

作法原理

CLI 工具與 Ollama 安裝互動。它會自動偵測系統的 RAM 大小,以決定哪些 LLM 模型適合下載與測試。接著對這些模型執行基準測試,以計算性能指標。

適用對象

透過 Ollama 執行本地 LLM,並希望量化其硬體在不同模型層級(從 2B 到 20B 參數)下推論速度的使用者。

主要特色

  • 支援 Windows、Linux 與 macOS 的跨平台 CLI 工具。
  • 基於可用系統 RAM 自動選擇模型。
  • 支援透過 YAML 檔案自訂基準測試模型清單。
  • 可選擇停用系統資訊與結果傳送到遠端伺服器。

相關

  • 專案
  • 專案
  • 專案
  • 專案