Ollama 编程模型与集成更新

Ollama 已发布 GLM-4.6 和 Qwen3-Coder-480B 模型的云端访问权限,同时更新了 Qwen3-Coder-30B 模型以改进工具调用能力。这些更新通过 Ollama 的云服务和本地部署选项扩展了高性能编程模型的可用性。

新的编程模型与可用性

Ollama 现在提供多种具有不同部署选项的高容量编程模型:

  • GLM-4.6: 可通过 Ollama 的云服务使用命令 ollama run glm-4.6:cloud 进行访问。
  • Qwen3-Coder-480B: 可通过云服务使用 ollama run qwen3-coder:480b-cloud 进行访问。对于显存(VRAM)超过 300GB 的用户,该模型也可作为 qwen3-coder:480b 进行本地部署。
  • Qwen3-Coder-30B: 该模型可通过 ollama run qwen3-coder:30b 在本地使用,并在 Ollama 的新引擎中进行了更新,以提供更快、更可靠的工具调用。

IDE 与工具集成

Ollama 扩展了对流行编程工具的支持,允许用户拉取云端模型并将其直接集成到开发环境中:

VS Code

要在 VS Code 中使用 GLM-4.6 或 Qwen3-Coder-480B,用户必须首先拉取云端模型(ollama pull glm-4.6:cloudollama pull qwen3-coder:480b-cloud)。集成通过 Copilot 聊天侧边栏进行管理,只需在“管理模型”(Manage models)菜单中选择 Ollama 作为提供商即可。

Zed

Zed(现已支持 Windows)支持 Ollama 集成。在拉取云端模型后,用户可以在代理面板(agent panel)中将 LLM 提供商配置为 Ollama,并使用主机 URL http://localhost:11434 进行连接。

Droid

Droid 集成需要安装 Droid CLI 并向 ~/.factory/config.json 文件添加特定配置。此配置为 GLM-4.6 和 Qwen3-Coder-480B 定义了 model_display_namebase_url (http://localhost:11434/v1) 以及 max_tokens (16,384)。

云端 API 访问

云端模型,包括 glm-4.6qwen3-coder:480b,可以直接通过 ollama.com 云端 API 进行访问。这需要用户在设置中创建一个 API 密钥,并设置 OLLAMA_API_KEY 环境变量。请求将使用 Bearer 令牌进行授权,并发送至 https://ollama.com/api/chat 端点。

支持的集成生态系统

Ollama 的官方文档现在包含了针对以下工具的专用集成指南:

  • Codex
  • Cline
  • VS Code
  • Zed
  • Droid
  • Roo code

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch