nicobailon/pi-web-access
Web search and content extraction extension for Pi coding agent
解決的問題
Pi Web Access 為 Pi 代理提供了一個全面的網路互動層,使其能夠執行網路搜尋、從各種來源提取內容,並理解影片內容。它解決了為 AI 代理提供可靠、多提供者搜尋與內容取得系統的問題,具備智慧回退機制,並針對 GitHub 倉庫、YouTube 影片與 PDF 等複雜格式進行專門處理。
工作原理
此專案實作了一組工具(web_search、fetch_content、get_search_content 和 source_check),Pi 代理可使用這些工具與網路互動。它支援大量搜尋提供者(例如 OpenAI、Brave、Exa、Tavily、Gemini、Mistral)與內容提取方法。
關鍵機制包括:
- 智慧回退:使用一連串順序執行的提供者,即使某個提供者失敗,也能確保搜尋與取得請求成功。
- 專用提取:不採用簡單的爬取,而是將 GitHub 倉庫本地克隆,以取得完整的檔案存取權限,並使用 Gemini 實現基於視覺與字幕的影片理解。
- PDF 處理:透過分層系統(Datalab、Gemini 或本地
unpdf)將 PDF 轉換為 Markdown,以維持文件結構。 - 快取:取得的內容儲存在本地快取中,使代理能檢索特定段落,而無需將整個頁面重新載入至上下文視窗中。
適用對象
本工具適用於希望擴展 Pi 代理能力的使用者,包括即時網路存取、透過 GitHub 克隆進行深度技術研究,以及對影片與 PDF 文件進行多模態分析。
主要亮點
- 廣泛的提供者支援:整合數十個搜尋 API,並支援透過 Exa MCP 實現零設定搜尋。
- 影片理解:使用 Gemini 與 ffmpeg 從 YouTube 與本地影片中提取字幕、視覺描述與特定畫面。
- get_search_content:允許代理使用偏移量與模糊文字搜尋,高效導航大型頁面。
- GitHub 整合:將倉庫本地克隆,實現真正的檔案探索,而非 HTML 爬取。
- 來源驗證:專用的
source_check工具,使用機器可讀引用與 SHA-256 哈希驗證主張。
相關
- 專案
- 專案
- 專案
- 專案
- 專案