google-deepmind/gemma
Gemma open-weight LLM library, from Google DeepMind
解决的问题
提供基于 JAX 的实现,用于使用和微调基于 Gemini 研究与技术构建的 Gemma 系列开源权重大语言模型(LLM)。
工作原理
该项目以 PyPI 包(gemma)形式提供,利用 JAX 在 CPU、GPU 或 TPU 上运行。包含用于处理多轮和多模态对话的 ChatSampler API,以及加载模型检查点和执行微调的工具。
适用人群
希望将 Gemma 模型集成到应用中,或使用 JAX 生态系统针对特定任务进行微调的开发者和研究人员。
主要亮点
- 多模态能力:支持包含文本和图像的多轮对话。
- 硬件灵活性:兼容 CPU、GPU 和 TPU 硬件。
- 专为 JAX 设计的库:专为通过 JAX 实现高性能机器学习操作而设计。
- 支持微调:内置对微调和 LoRA(低秩适配)的支持。
相关
- 项目
- 项目
- Dispatch
- Dispatch
- 项目