AnubhavChaturvedi-GitHub/jarvis-ai-assistant
Voice-controlled AI desktop assistant in Python. Speech recognition, text to speech, real-time web search, image generation, computer vision and WhatsApp automation, inspired by Iron Man's JARVIS.
解決的問題
J.A.R.V.I.S 是一款語音控制的桌面助手,旨在透過自然的語音介面實現電腦任務的自動化並提供資訊。它允許使用者透過語音指令控制系統並存取 AI 能力,從而消除了手動打字和點擊的需求。
工作原理
該系統構建為一系列可替換的子系統,用於處理不同的模態。中央入口點 (jarvis.py) 將使用者意圖路由到特定模組:
- 語音處理:使用自定義的語音轉文字引擎 (
NetHyTechSTT) 和用於語音回覆的文字轉語音模組。 - 推理:
Brain(co_brain.py) 管理對話記憶和語言模型推理。 - 能力:專用模組處理即時網路搜尋、圖像生成、基於攝影機的圖像理解 (Vision) 以及桌面自動化(開啟應用程式和執行系統任務)。
- 整合:使用 Selenium 和 PyWhatKit 進行瀏覽器和 WhatsApp 自動化。
適用對象
想要為桌面配備免手操作、鋼鐵人風格 AI 助手的使用者,以及正在尋找可擴充新功能的模組化 Python 助手框架的開發者。
亮點
- 模組化架構:子系統是分離的,允許使用者僅使用他們需要的部分。
- 多模態能力:結合了語音、文字、圖像生成和電腦視覺。
- 離線友好:包含一個不需要付費 API 的自定義語音轉文字引擎。
- 系統自動化:可以免手操作控制桌面、開啟應用程式並發送 WhatsApp 訊息。
相關
- 專案
- 專案
- 專案
- 專案
- 專案