aidatatools/ollama-benchmark
LLM Benchmark for Throughput via Ollama (Local LLMs)
解决的问题
该工具提供了一种测量通过 Ollama 运行的本地大型语言模型(LLM)实际吞吐量(每秒令牌数)的方法,使用户能够了解其硬件在不同模型大小下的性能表现。
工作原理
CLI 工具与 Ollama 安装进行交互。它会自动检测系统的 RAM 大小,以确定哪些 LLM 模型适合下载和测试。然后对这些模型运行基准测试,以计算性能指标。
适用人群
通过 Ollama 运行本地 LLM 且希望量化其硬件在不同模型层级(从 2B 到 20B 参数)下推理速度的用户。
主要亮点
- 支持 Windows、Linux 和 macOS 的跨平台 CLI 工具。
- 基于可用系统 RAM 自动选择模型。
- 支持通过 YAML 文件自定义基准测试模型列表。
- 可选择禁用向远程服务器发送系统信息和结果。
相关
- 项目
- 项目
- 项目
- 项目