Trans-N-ai/swama

High-performance MLX-based LLM inference engine for macOS with native Swift implementation

What it solves

Swama は、macOS ユーザー向けに高パフォーマンスなローカル機械学習ランタイムを提供し、クラウドベースの AI サービスへの依存を必要としなくさせます。Apple Silicon ハードウェア上で、大規模言語モデル (LLMs)、視覚言語モデル (VLMs)、およびオーディオモデル (ASR/TTS) を直接デプロイし、使用することを簡化します。

How it works

Apple の MLX フレームワークに基づいて構築され、純粋な Swift で書かれた Swama は、Apple Silicon の推論を最適化しています。主に 3 つのインターフェースを提供します:簡単にアクセスできるネイティブ macOS メニューバーアプリ、モデル管理と推論のためのコマンドラインインターフェース (CLI)、および他のアプリケーションがローカルモデルと統合できる OpenAI 互換の API サーバーです。

Who it's for

プライバシー、パフォーマンス、オフラインアクセスを重視し、Apple Silicon (M1/M2/M3/M4) を搭載した macOS ユーザー、および OpenAI 互換のローカルバックエンドが必要な開発者。

Highlights

  • Multimodal Capabilities: テキスト、画像 (VLM)、およびオーディオ (speech-to-text および text-to-speech) の入出力をサポートします。
  • OpenAI Compatible API: チャット補完、embeddings、およびオーディオ文字起こし用の標準的なエンドポイントを実装しています。
  • Smart Model Management: HuggingFace からの自動ダウンロード機能と、、ユーザーに優しいエイリアスシステム (例: qwen3, llama3.2) を提供し、モデルの選択を簡化します。
  • Native macOS Integration: シームレスなシステムレベルの体験を提供するため、専用の macOS メニューバーアプリが含まれています。