Ollama 官方 Docker 镜像发布

Ollama 现已作为官方 Docker 赞助的开源镜像提供,允许用户在 Docker 容器中本地运行大型语言模型(LLMs),确保私有数据保留在本地机器上,不会发送至第三方服务。

GPU 加速与平台支持

Ollama 提供 CLI 和 REST API 用于应用程序交互,硬件加速支持因平台而异:

Linux

在 Linux 上,Ollama 支持在 Docker 容器内使用 Nvidia GPU 进行 GPU 加速。要启用此功能,用户必须在运行容器前安装 Nvidia 容器工具包,并使用 --gpus=all 标志运行容器。

macOS

在 macOS 上,用户应将 Ollama 作为独立应用程序运行,而非在 Docker 容器内。这是因为 Docker Desktop 目前不支持 GPU 加速,而 GPU 加速对于实现最佳模型性能是必需的。

部署与配置

Ollama 可通过 Docker 部署,具体配置取决于可用硬件:

仅 CPU 部署

要仅使用 CPU 运行 Ollama,请使用以下命令:

docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

Nvidia GPU 部署

安装 Nvidia 容器工具包后,使用以下命令启用 GPU 加速:

docker run -d --gpus=all -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

在容器内运行模型

Ollama 容器启动后,用户可使用 docker exec 命令在容器内直接运行模型,例如 Llama 2:

docker exec -it ollama ollama run llama2

更多模型可通过 Ollama 库获取。

Sources

相关

  • 项目
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch