Ollama 코딩 모델 및 통합 업데이트
Ollama는 GLM-4.6 및 Qwen3-Coder-480B 모델에 대한 클라우드 액세스를 출시했으며, 도구 호출(tool calling) 성능을 개선하기 위해 Qwen3-Coder-30B 모델을 업데이트했습니다. 이러한 업데이트는 Ollama의 클라우드 서비스와 로컬 배포 옵션을 통해 고성능 코딩 모델의 가용성을 확장합니다.
새로운 코딩 모델 및 가용성
Ollama는 이제 다양한 배포 옵션을 가진 여러 고용량 코딩 모델에 대한 액세스를 제공합니다:
- GLM-4.6:
ollama run glm-4.6:cloud명령어를 사용하여 Ollama의 클라우드 서비스를 통해 사용할 수 있습니다. - Qwen3-Coder-480B: 클라우드 서비스를 통해
ollama run qwen3-coder:480b-cloud를 사용하여 사용할 수 있습니다. 300GB 이상의 VRAM을 보유한 사용자의 경우, 이 모델은qwen3-coder:480b로 로컬 배포도 가능합니다. - Qwen3-Coder-30B: 이 모델은
ollama run qwen3-coder:30b를 통해 로컬에서 사용할 수 있으며, Ollama의 새로운 엔진에서 더 빠르고 신뢰할 수 있는 도구 호출을 제공하도록 업데이트되었습니다.
IDE 및 도구 통합
Ollama는 인기 있는 코딩 도구에 대한 지원을 확장하여, 사용자가 클라우드 모델을 가져오고(pull) 개발 환경에 직접 통합할 수 있도록 합니다:
VS Code
VS Code에서 GLM-4.6 또는 Qwen3-Coder-480B를 사용하려면, 먼저 클라우드 모델을 가져와야 합니다 (ollama pull glm-4.6:cloud 및 ollama pull qwen3-coder:480b-cloud). 통합은 Manage models 메뉴에서 Ollama를 제공자로 선택하여 Copilot 채팅 사이드바를 통해 관리됩니다.
Zed
Zed(현재 Windows용으로 사용 가능)는 Ollama 통합을 지원합니다. 클라우드 모델을 가져온 후, 사용자는 에이전트 패널을 통해 호스트 URL http://localhost:11434를 사용하여 LLM 제공자를 Ollama로 구성하고 연결할 수 있습니다.
Droid
Droid 통합을 위해서는 Droid CLI를 설치하고 ~/.factory/config.json 파일에 특정 구성을 추가해야 합니다. 이 구성은 GLM-4.6 및 Qwen3-Coder-480B 모두에 대해 model_display_name, base_url (http://localhost:11434/v1), 및 max_tokens (16,384)를 정의합니다.
클라우드 API 액세스
glm-4.6 및 qwen3-coder:480b를 포함한 클라우드 모델은 ollama.com 클라우드 API를 통해 직접 액세스할 수 있습니다. 이를 위해서는 사용자 설정에서 API 키를 생성하고 OLLAMA_API_KEY 환경 변수를 설정해야 합니다. 요청은 Bearer 토큰을 사용하여 인증을 위한 https://ollama.com/api/chat 엔드포인트로 전송됩니다.
지원되는 통합 생태계
Ollama의 공식 문서에는 이제 다음 도구들에 대한 전용 통합 가이드가 포함되어 있습니다:
- Codex
- Cline
- VS Code
- Zed
- Droid
- Roo code
Sources
- OriginalNew coding models & integrations
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch