deepgram/deepgram-python-sdk
Official Python SDK for Deepgram.
解決的問題
此 SDK 為 Python 開發者提供了一種標準化的方式,將 Deepgram 的 AI 模型(語音轉文字、文字轉語音、語言理解)整合至應用程式中,無需撰寫原始 API 請求。
工作原理
此 SDK 作為 Deepgram API 的封裝,提供同步與非同步客戶端。支援多種互動模式:
- 即時串流: 使用 WebSockets 實現即時語音辨識與互動式語音代理。
- 檔案處理: 處理預先錄製音訊檔案的上傳與轉錄。
- 音訊生成: 將文字轉換為自然流暢的語音。
- 文字分析: 處理文字以偵測情感、主題與意圖。
- 自訂傳輸: 允許開發者以自訂實作取代預設的 WebSocket 傳輸,包含專用於 AWS SageMaker 端點的傳輸。
適用對象
開發語音應用、對話式 AI 代理、自動轉錄服務或文字分析工具的開發者。
主要特色
- 全面的模態支援: 支援語音轉文字(Listen)、文字轉語音(Speak)與文字智能(Read)。
- 對話式 AI: 內建支援建立結合聆聽、思考(透過 GPT-4o-mini 等 LLM)與說話的互動式語音代理。
- 非同步支援: 完全支援
async/await,實現非阻塞 I/O 操作。 - 彈性驗證機制: 支援伺服器端使用的 API 金鑰,以及客戶端安全使用的一次性存取權杖。
- 可擴展的網路: 支援自訂 HTTP 客戶端與傳輸工廠,適用於替代協定或雲端部署。
相關
- 專案
- 專案
- 專案
- 專案
- 專案