Google Gemma 2 在 Ollama 上發布

TL;DR

Google Gemma 2 現在可在 Ollama 上使用,提供三種尺寸(2 B、9 B、27 B),並採用全新的架構,提供同級領先的性能,使 27 B 模型能夠超越其規模兩倍以上的開源模型。

全新架構與效率提升

Gemma 2 引入了專為高參數性能而設計的全新模型架構。27 B 版本在基準測試中取得的結果超越了擁有超過 50 B 參數的模型,為開源大型語言模型建立了新的效率基準。

模型尺寸與存取方式

Ollama 發布了三種參數配置:

  • Gemma 2 2B – 佔用空間最小,適合低資源環境。指令:ollama run gemma2:2b
  • Gemma 2 9B – 能力與成本的中階平衡。指令:ollama run gemma2
  • Gemma 2 27B – 最大容量版本,提供最高品質,同時仍比更大的競爭對手更有效率。 指令:ollama run gemma2:27b

所有三種模型都託管在 Ollama 的函式庫中,並可以透過單一 CLI 指令進行拉取。

與熱門工具的整合

Gemma 2 可以直接透過常見的 LLM 封裝器從 Python 使用。

LangChain

from langchain_community.llms import Ollama
llm = Ollama(model="gemma2")
llm.invoke("Why is the sky blue?")

LlamaIndex

from llama_index.llms.ollama import Ollama
llm = Ollama(model="gemma2")
llm.complete("Why is the sky blue?")

這些程式碼片段展示了開發者可以透過極少的程式碼變動,利用現有的 LangChain 或 LlamaIndex 流水線來切換至 Gemma 2。


Gemma 2 透過 Ollama 分發;下載連結與更多細節請參閱官方部落格文章。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch