Ollama 编程模型与集成更新
Ollama 已发布 GLM-4.6 和 Qwen3-Coder-480B 模型的云端访问权限,同时更新了 Qwen3-Coder-30B 模型以改进工具调用能力。这些更新通过 Ollama 的云服务和本地部署选项扩展了高性能编程模型的可用性。
新的编程模型与可用性
Ollama 现在提供多种具有不同部署选项的高容量编程模型:
- GLM-4.6: 可通过 Ollama 的云服务使用命令
ollama run glm-4.6:cloud进行访问。 - Qwen3-Coder-480B: 可通过云服务使用
ollama run qwen3-coder:480b-cloud进行访问。对于显存(VRAM)超过 300GB 的用户,该模型也可作为qwen3-coder:480b进行本地部署。 - Qwen3-Coder-30B: 该模型可通过
ollama run qwen3-coder:30b在本地使用,并在 Ollama 的新引擎中进行了更新,以提供更快、更可靠的工具调用。
IDE 与工具集成
Ollama 扩展了对流行编程工具的支持,允许用户拉取云端模型并将其直接集成到开发环境中:
VS Code
要在 VS Code 中使用 GLM-4.6 或 Qwen3-Coder-480B,用户必须首先拉取云端模型(ollama pull glm-4.6:cloud 和 ollama pull qwen3-coder:480b-cloud)。集成通过 Copilot 聊天侧边栏进行管理,只需在“管理模型”(Manage models)菜单中选择 Ollama 作为提供商即可。
Zed
Zed(现已支持 Windows)支持 Ollama 集成。在拉取云端模型后,用户可以在代理面板(agent panel)中将 LLM 提供商配置为 Ollama,并使用主机 URL http://localhost:11434 进行连接。
Droid
Droid 集成需要安装 Droid CLI 并向 ~/.factory/config.json 文件添加特定配置。此配置为 GLM-4.6 和 Qwen3-Coder-480B 定义了 model_display_name、base_url (http://localhost:11434/v1) 以及 max_tokens (16,384)。
云端 API 访问
云端模型,包括 glm-4.6 和 qwen3-coder:480b,可以直接通过 ollama.com 云端 API 进行访问。这需要用户在设置中创建一个 API 密钥,并设置 OLLAMA_API_KEY 环境变量。请求将使用 Bearer 令牌进行授权,并发送至 https://ollama.com/api/chat 端点。
支持的集成生态系统
Ollama 的官方文档现在包含了针对以下工具的专用集成指南:
- Codex
- Cline
- VS Code
- Zed
- Droid
- Roo code
Sources
- OriginalNew coding models & integrations
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch