Google Gemma 2 在 Ollama 上發布
TL;DR
Google Gemma 2 現在可在 Ollama 上使用,提供三種尺寸(2 B、9 B、27 B),並採用全新的架構,提供同級領先的性能,使 27 B 模型能夠超越其規模兩倍以上的開源模型。
全新架構與效率提升
Gemma 2 引入了專為高參數性能而設計的全新模型架構。27 B 版本在基準測試中取得的結果超越了擁有超過 50 B 參數的模型,為開源大型語言模型建立了新的效率基準。
模型尺寸與存取方式
Ollama 發布了三種參數配置:
- Gemma 2 2B – 佔用空間最小,適合低資源環境。指令:
ollama run gemma2:2b。 - Gemma 2 9B – 能力與成本的中階平衡。指令:
ollama run gemma2。 - Gemma 2 27B – 最大容量版本,提供最高品質,同時仍比更大的競爭對手更有效率。
指令:
ollama run gemma2:27b。
所有三種模型都託管在 Ollama 的函式庫中,並可以透過單一 CLI 指令進行拉取。
與熱門工具的整合
Gemma 2 可以直接透過常見的 LLM 封裝器從 Python 使用。
LangChain
from langchain_community.llms import Ollama
llm = Ollama(model="gemma2")
llm.invoke("Why is the sky blue?")
LlamaIndex
from llama_index.llms.ollama import Ollama
llm = Ollama(model="gemma2")
llm.complete("Why is the sky blue?")
這些程式碼片段展示了開發者可以透過極少的程式碼變動,利用現有的 LangChain 或 LlamaIndex 流水線來切換至 Gemma 2。
Gemma 2 透過 Ollama 分發;下載連結與更多細節請參閱官方部落格文章。
Sources
- OriginalGoogle Gemma 2
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch