Google Gemma 2 在 Ollama 上发布

TL;DR

Google Gemma 2 现在已在 Ollama 上提供,共有三种尺寸(2 B、9 B、27 B),并采用了全新的架构,可提供同类领先的性能,使 27 B 模型能够超越其规模两倍以上的开源模型。

全新的架构与效率提升

Gemma 2 引入了专为高参数性能而设计的新型模型架构。27 B 版本在基准测试中取得的结果超过了拥有超过 50 B 参数的模型,为开源大语言模型建立了新的效率基准。

模型尺寸与访问方式

Ollama 发布了三种参数配置:

  • Gemma 2 2B – footprint 最小,适用于低资源环境。命令:ollama run gemma2:2b
  • Gemma 2 9B – 能力与成本的中端平衡。
  • Gemma 2 27B – 最大规格,在提供最高质量的同时,仍然比更大的竞争对手更高效。命令:ollama run gemma2:27b

所有三个模型都托管在 Ollama 的库中,可以通过单个 CLI 命令进行拉取。

与流行工具的集成

Gemma 2 可以直接通过常见的 LLM 封装器从 Python 中使用。

LangChain

from langchain_community.llms import Ollama
llm = Ollama(model="gemma2")
llm.invoke("Why is the sky blue?")

LlamaIndex

from llama_index.llms.ollama import Ollama
llm = Ollama(model="gemma2")
llm.complete("Why is the sky blue?")

这些代码片段表明,开发者可以利用现有的 LangChain 或 LlamaIndex 流水线,通过极少的代码更改即可切换到 Gemma 2。


Gemma 2 通过 Ollama 分发;请参阅官方博客文章以获取下载链接和更多详情。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch