AtomicBot-ai/Atomic-Chat
Local AI app and inference engine for agents. Run open-weight LLMs locally — private, 100% offline on your computer. Join our Discord: https://discord.com/invite/8wGSsvmg4V
解决的问题
Atomic Chat 提供一个私密的本地环境,让用户在自己的设备上运行开源权重的大规模语言模型(LLM),无需每次交互都依赖云服务提供商。它还充当一个本地推理引擎,其他 AI 代理和工具可通过 API 使用。
工作原理
该应用集成了三种不同的推理引擎——llama.cpp 的自定义 TurboQuant 分支、官方 llama.cpp,以及适用于 Apple Silicon 的 MLX-VLM,用于执行来自 HuggingFace 的模型。它在 http://localhost:1337/v1 提供一个 OpenAI 兼容服务器,任何支持 OpenAI SDK 的工具都可以将本地模型作为后端使用。同时,也支持云模型提供商,供希望混合使用本地和云 AI 的用户选择。
适用人群
专为希望完全保护 AI 对话隐私的用户、需要本地推理后端的 AI 代理开发者,以及希望在特定硬件(macOS、Windows、Linux、iOS 和 Android)上优化 LLM 性能的爱好者设计。
主要亮点
- 高性能解码:支持多标记预测(MTP)、DFlash 块扩散和 Flash Attention,显著提升吞吐量。
- 内存优化:采用 TurboQuant KV 缓存,有效降低 CPU 和 GPU 上的内存占用。
- 代理集成:一键启动多种代理(如 Claude Code、Cline、OpenHands),并支持 Model Context Protocol (MCP)。
- 灵活部署:提供 macOS、Windows 和 Linux 的桌面应用,以及 iOS 和 Android 的移动应用。
- 开发者友好:提供即插即用的 OpenAI 兼容 API,便于与现有 AI 工具集成。
相关
- 项目
- 项目
- 项目
- 项目
- 项目