Trans-N-ai/swama
High-performance MLX-based LLM inference engine for macOS with native Swift implementation
解決する課題
Swama は macOS 向けに設計された高性能な機械学習ランタイムであり、ユーザーは Apple Silicon 上で大規模言語モデル (LLM)、視覚言語モデル (VLM)、およびオーディオモデル (ASR/TTS) をローカルで実行できます。ネイティブで最適化された推論環境を提供することで、クラウドベースの AI の必要性を排除します。
仕組み
Apple の MLX フレームワーク上に構築され、純粋な Swift で記述された Swama は、3つの主要なインターフェースを提供します。簡単にアクセスするための macOS メニューバーアプリケーション、モデル管理と推論のためのコマンドラインインターフェース (CLI)、そして OpenAI 互換の API サーバーです。HuggingFace Hub と直接統合し、簡略化されたエイリアス(完全なリポジトリ URL の代わりに qwen3 など)を使用して、モデルの自動ダウンロード、キャッシュ、管理を行います。
対象者
プライバシー、速度、または開発目的で、強力な AI モデルをローカルで実行したいと考えている Apple Silicon (M1/M2/M3/M4) 搭載の macOS ユーザー、および独自のアプリケーション用に OpenAI 互換のローカルエンドポイントを必要とする開発者向けに設計されています。
ハイライト
- マルチモーダル機能:テキスト生成、画像からテキスト (VLM)、音声認識 (ASR)、およびテキスト読み上げ (TTS) をサポート。
- OpenAI 互換 API:チャット補完、埋め込み、オーディオ処理のための標準エンドポイントを提供し、ツール呼び出しのサポートも含みます。
- スマートなモデル管理:わかりやすいエイリアスを介してモデルの自動ダウンロードとキャッシュを実現。
- ネイティブ macOS 統合:専用のメニューバーアプリと Apple Silicon に最適化された CLI ツールを含みます。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト