Ollama 上的 IBM Granite 3.0 模型
IBM Granite 3.0 模型現在可以透過 Ollama 執行,提供一系列在 Apache 2.0 授權下發布的 Dense 模型與 Mixture of Experts (MoE) 模型。此版本讓開發者能夠部署高效能、開放權重的模型,用於工具型使用場景、RAG 以及低延遲的裝置端應用程式。
Dense Models: High Performance and Benchmark Rivalry
Granite 3.0 Dense 模型提供 2B 與 8B 參數規模。這些純文字 LLM 是在超過 12 兆個 token 的數據上進行訓練,與先前版本相比,在速度與效能上有顯著提升。
Granite 8B Instruct 模型在 OpenLLM Leaderboard v1 與 OpenLLM Leaderboard v2 基準測試中,其效能表現可與 Llama 3.1 8B Instruct 媲美。
Mixture of Experts (MoE) Models: Optimized for Low Latency
IBM 已在 Granite 系列中推出了首款 Mixture of Experts (MoE) 模型,提供 1B 與 3B 參數規模。這些模型是在超過 10 兆個 token 的數據上進行訓練。
由於採用 MoE 架構,這些模型專為低延遲使用而設計,非常適合部署於裝置端應用程式或需要即時推理的場景。
Core Capabilities and Use Cases
IBM Granite 3.0 系列旨在支援工具型使用場景與檢索增強生成 (RAG)。其核心能力包括:
- Content Processing: 摘要生成、文本分類與文本提取。
- Technical Tasks: 程式碼生成、翻譯、錯誤修復與 function-calling。
- Question Answering: 一般問答與多語言對話使用場景。
Deployment via Ollama
使用者可以透過以下 Ollama 指令來執行這些模型:
- Dense 2B:
ollama run granite3-dense - Dense 8B:
ollama run granite3-dense:8b - MoE 1B:
ollama run granite3-moe - MoE 3B:
ollama run granite3-moe:3b
Sources
- OriginalIBM Granite 3.0 models
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch