nicedreamzapp/claude-code-local

Run Claude Code 100% on-device with local AI on Apple Silicon. MLX-native Anthropic-API server. 6 fighters incl. Muse-Glimmer 30B (now multimodal — reads images, abliterated), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Private, offline, airgap-ready. Built for NDA / legal / healthcare workflows.

解決的問題

Claude Code Local 允許使用者在 Apple Silicon 裝置上使用本地 AI 模型,完全在裝置內執行 Claude Code 終端介面。這消除了對雲端 API 的依賴,去除使用限制,確保 100% 隱私(程式碼保留在本地裝置),並消除與雲端呼叫相關的網路延遲。

如何運作

此專案提供一個原生支援 Anthropic API 的 MLX 伺服器。與傳統設定(例如:Claude Code → 代理 → Ollama → 模型)不同,該伺服器移除了代理層,使 Claude Code 可直接與本地模型通訊。此架構顯著縮短任務完成時間(基準測試中從 133 秒減少至 17.6 秒)。

適用對象

希望在不使用 API 金鑰、訂閱或網路連線的情況下使用 Claude Code 的 Apple Silicon Mac 使用者(從 16GB MacBook Air 到高階 M 系列 Max 芯片),特別是處理機密程式碼庫的開發者。

主要亮點

  • 原生 Anthropic API 支援:消除翻譯代理,實現 7.5 倍更快的效能。
  • 豐富的模型陣容:支援多種模型,包括 Llama 3.3 70B、Gemma 4 31B、Qwen 3.8 27B 和 DeepSeek V4 Flash。
  • 高上下文選項:DeepSeek V4 Flash 提供高達 100 萬 token 的上下文,並支援持久化磁碟 KV 快取。
  • 消融模型:提供經過抑制拒絕指令的自訂 MLX 建構版本,減少無害但略帶邊緣的拒絕行為。
  • 硬體優化:專為 Apple Silicon 優化,使用 MLX 和專用引擎(如 ds4)針對 DeepSeek 進行調校。

相關

  • 專案
  • Dispatch
  • 專案
  • 專案
  • 專案