moonshine-ai/moonshine
Very low latency speech to text, intent recognition, and text to speech, for building voice agents and interfaces
What it solves
Moonshine Voice 提供了一個工具包,讓開發者可以構建完全在裝置端運行的即時語音代理和應用程式。它消除了對雲端 API、帳號或 API 金鑰的需要,確保了即時串流語音互動的隱私與低延遲。
How it works
該工具包使用從頭開始訓練的語音轉文字模型,範圍從優於 Whisper Large V3 的高精度模型到僅 1MB 的超小型模型。它專為即時串流設計,透過在使用者說話時同步處理音訊,將延遲降至最低。
Who it’s for
開發者,用於在各種平台構建語音功能應用程式,包括 Python, JavaScript/WASM, iOS, Android, macOS, Linux, Windows, 和 Raspberry Pi。
Highlights
- 裝置端執行以確保速度與隱私。
- 低延遲串流優化。
- 可擴展的模型尺寸,從高性能到 1MB 超小型模型。
- 廣泛的跨平台支援,涵蓋行動裝置、桌面端和嵌入式系統。",
相關
- 專案
- 專案
- 專案
- 專案
- 專案