nicedreamzapp/claude-code-local
Run Claude Code 100% on-device with local AI on Apple Silicon. MLX-native Anthropic-API server. 6 fighters incl. Muse-Glimmer 30B (now multimodal — reads images, abliterated), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Private, offline, airgap-ready. Built for NDA / legal / healthcare workflows.
해결하는 문제
Claude Code Local는 Apple Silicon에서 로컬 AI 모델을 사용하여 Claude Code 터미널 인터페이스를 완전히 로컬에서 실행할 수 있게 해줍니다. 클라우드 API에 의존하지 않으며, 사용 제한을 제거하고, 코드를 로컬 머신에 보관함으로써 100%의 프라이버시를 보장하며, 클라우드 호출과 관련된 네트워크 지연도 제거합니다.
작동 방식
이 프로젝트는 Anthropic API를 네이티브로 지원하는 MLX 기반 서버를 제공합니다. 기존 설정(예: Claude Code → 프록시 → Ollama → 모델)과 달리, 이 서버는 프록시 계층을 제거하여 Claude Code가 로컬 모델과 직접 통신할 수 있게 합니다. 이 아키텍처는 작업 완료 시간을 크게 단축시킵니다(벤치마크에서 133초에서 17.6초로).
대상 사용자
API 키, 구독, 인터넷 연결 없이 Claude Code를 사용하고 싶은 Apple Silicon 맥 사용자(16GB MacBook Air부터 고사양 M-시리즈 Max 칩까지)로, 특히 기밀 코드베이스를 다루는 개발자에게 적합합니다.
주요 특징
- 네이티브 Anthropic API 지원: 번역 프록시를 제거해 7.5배 빠른 성능을 제공합니다.
- 다양한 모델 라인업: Llama 3.3 70B, Gemma 4 31B, Qwen 3.8 27B, DeepSeek V4 Flash 등 다양한 모델을 지원합니다.
- 고용량 컨텍스트 옵션: DeepSeek V4 Flash는 최대 100만 토큰의 컨텍스트를 제공하며, 지속적인 디스크 KV 캐시를 사용합니다.
- 아블레이션 모델: 거부 지시를 억제한 커스텀 MLX 빌드로, 무해하지만 약간의 경계선을 넘는 거부를 줄입니다.
- 하드웨어 최적화: MLX와 전용 엔진(
ds4)을 활용해 Apple Silicon에 특화된 최적화가 되어 있습니다.
관련
- 프로젝트
- Dispatch
- 프로젝트
- 프로젝트
- 프로젝트