AtomicBot-ai/Atomic-Chat

Local AI app and inference engine for agents. Run open-weight LLMs locally — private, 100% offline on your computer. Join our Discord: https://discord.com/invite/8wGSsvmg4V

解決的問題

Atomic Chat 提供一個私密的本地環境,讓使用者能在自己的裝置上執行開源權重的大規模語言模型(LLM),無需每次互動都依賴雲端服務提供商。它同時也作為一個本地推理引擎,讓其他 AI 代理與工具可透過 API 使用。

運作方式

此應用整合了三種不同的推理引擎——llama.cpp 的自訂 TurboQuant 分支、官方 llama.cpp,以及適用於 Apple Silicon 的 MLX-VLM,用以執行來自 HuggingFace 的模型。它在 http://localhost:1337/v1 提供一個 OpenAI 相容伺服器,任何支援 OpenAI SDK 的工具皆可將本地模型作為後端使用。同時也支援雲端模型提供者,供希望混合使用本地與雲端 AI 的使用者選擇。

適用對象

專為希望完全保護 AI 對話隱私的使用者、需要本地推理後端的 AI 代理開發者,以及希望在特定硬體(macOS、Windows、Linux、iOS 和 Android)上優化 LLM 性能的愛好者所設計。

主要亮點

  • 高效率解碼:支援多標記預測(MTP)、DFlash 塊擴散與 Flash Attention,顯著提升吞吐量。
  • 記憶體優化:採用 TurboQuant KV 快取,有效降低 CPU 與 GPU 上的記憶體佔用。
  • 代理整合:一鍵啟動多種代理(如 Claude Code、Cline、OpenHands),並支援 Model Context Protocol (MCP)。
  • 彈性部署:提供 macOS、Windows 與 Linux 的桌面應用,以及 iOS 與 Android 的行動應用。
  • 開發者友善:提供即插即用的 OpenAI 相容 API,方便與現有 AI 工具整合。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案