Trans-N-ai/swama
High-performance MLX-based LLM inference engine for macOS with native Swift implementation
解決的問題
Swama 是一款專為 macOS 設計的高效能機器學習執行階段,允許使用者在 Apple Silicon 上本機執行大型語言模型 (LLM)、視覺語言模型 (VLM) 和音訊模型 (ASR/TTS)。它透過提供原生且最佳化的推論環境,消除了對雲端 AI 的需求。
運作方式
Swama 建構於 Apple 的 MLX 框架並以純 Swift 撰寫,提供三個主要介面:用於輕鬆存取的 macOS 選單列應用程式、用於模型管理和推論的命令列介面 (CLI),以及相容於 OpenAI 的 API 伺服器。它直接與 HuggingFace Hub 整合,使用簡化的別名(例如 qwen3 而非完整的儲存庫 URL)來自動下載、快取和管理模型。
適用對象
專為使用 Apple Silicon (M1/M2/M3/M4) 的 macOS 使用者設計,無論是為了隱私、速度還是開發目的,都希望能在本機執行強大的 AI 模型;同時也適用於需要相容於 OpenAI 之本機端點供其應用程式使用的開發人員。
亮點
- 多模態能力:支援文字生成、圖像轉文字 (VLM)、語音轉文字 (ASR) 和文字轉語音 (TTS)。
- 相容於 OpenAI 的 API:提供用於聊天補全、嵌入和音訊處理的標準端點,包括對工具呼叫的支援。
- 智慧型模型管理:透過易用的別名,實現模型的自動下載與快取。
- 原生 macOS 整合:包含專用的選單列應用程式和針對 Apple Silicon 最佳化的 CLI 工具。
相關
- 專案
- 專案
- 專案
- 專案
- 專案