nicedreamzapp/claude-code-local

Run Claude Code 100% on-device with local AI on Apple Silicon. MLX-native Anthropic-API server. 6 fighters incl. Muse-Glimmer 30B (now multimodal — reads images, abliterated), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Private, offline, airgap-ready. Built for NDA / legal / healthcare workflows.

解决的问题

Claude Code Local 允许用户在 Apple Silicon 设备上使用本地 AI 模型,完全在设备上运行 Claude Code 终端界面。这消除了对云 API 的依赖,去除了使用限制,确保 100% 隐私(代码保留在本地设备),并消除了与云调用相关的网络延迟。

如何工作

该项目提供了一个原生支持 Anthropic API 的 MLX 服务器。与传统的设置(例如:Claude Code → 代理 → Ollama → 模型)不同,该服务器去除了代理层,使 Claude Code 可以直接与本地模型通信。这种架构显著缩短了任务完成时间(基准测试中从 133 秒减少到 17.6 秒)。

适用人群

希望在不使用 API 密钥、订阅或互联网连接的情况下使用 Claude Code 的 Apple Silicon Mac 用户(从 16GB MacBook Air 到高端 M 系列 Max 芯片),特别是处理机密代码库的开发者。

主要亮点

  • 原生 Anthropic API 支持:消除翻译代理,实现 7.5 倍更快的性能。
  • 丰富的模型阵容:支持多种模型,包括 Llama 3.3 70B、Gemma 4 31B、Qwen 3.8 27B 和 DeepSeek V4 Flash。
  • 高上下文选项:DeepSeek V4 Flash 提供高达 100 万 token 的上下文,并支持持久化磁盘 KV 缓存。
  • 消融模型:提供经过抑制拒绝指令的自定义 MLX 构建版本,减少无害但略带边缘的拒绝行为。
  • 硬件优化:专为 Apple Silicon 优化,使用 MLX 和专用引擎(如 ds4)针对 DeepSeek 进行调优。

相关

  • 项目
  • Dispatch
  • 项目
  • 项目
  • 项目