Google Gemma 2 在 Ollama 上发布
TL;DR
Google Gemma 2 现在已在 Ollama 上提供,共有三种尺寸(2 B、9 B、27 B),并采用了全新的架构,可提供同类领先的性能,使 27 B 模型能够超越其规模两倍以上的开源模型。
全新的架构与效率提升
Gemma 2 引入了专为高参数性能而设计的新型模型架构。27 B 版本在基准测试中取得的结果超过了拥有超过 50 B 参数的模型,为开源大语言模型建立了新的效率基准。
模型尺寸与访问方式
Ollama 发布了三种参数配置:
- Gemma 2 2B – footprint 最小,适用于低资源环境。命令:
ollama run gemma2:2b。 - Gemma 2 9B – 能力与成本的中端平衡。
- Gemma 2 27B – 最大规格,在提供最高质量的同时,仍然比更大的竞争对手更高效。命令:
ollama run gemma2:27b。
所有三个模型都托管在 Ollama 的库中,可以通过单个 CLI 命令进行拉取。
与流行工具的集成
Gemma 2 可以直接通过常见的 LLM 封装器从 Python 中使用。
LangChain
from langchain_community.llms import Ollama
llm = Ollama(model="gemma2")
llm.invoke("Why is the sky blue?")
LlamaIndex
from llama_index.llms.ollama import Ollama
llm = Ollama(model="gemma2")
llm.complete("Why is the sky blue?")
这些代码片段表明,开发者可以利用现有的 LangChain 或 LlamaIndex 流水线,通过极少的代码更改即可切换到 Gemma 2。
Gemma 2 通过 Ollama 分发;请参阅官方博客文章以获取下载链接和更多详情。
Sources
- OriginalGoogle Gemma 2
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch