nicobailon/pi-web-access

Web search and content extraction extension for Pi coding agent

解決的問題

Pi Web Access 為 Pi 代理提供了一個全面的網路互動層,使其能夠執行網路搜尋、從各種來源提取內容,並理解影片內容。它解決了為 AI 代理提供可靠、多提供者搜尋與內容取得系統的問題,具備智慧回退機制,並針對 GitHub 倉庫、YouTube 影片與 PDF 等複雜格式進行專門處理。

工作原理

此專案實作了一組工具(web_searchfetch_contentget_search_contentsource_check),Pi 代理可使用這些工具與網路互動。它支援大量搜尋提供者(例如 OpenAI、Brave、Exa、Tavily、Gemini、Mistral)與內容提取方法。

關鍵機制包括:

  • 智慧回退:使用一連串順序執行的提供者,即使某個提供者失敗,也能確保搜尋與取得請求成功。
  • 專用提取:不採用簡單的爬取,而是將 GitHub 倉庫本地克隆,以取得完整的檔案存取權限,並使用 Gemini 實現基於視覺與字幕的影片理解。
  • PDF 處理:透過分層系統(Datalab、Gemini 或本地 unpdf)將 PDF 轉換為 Markdown,以維持文件結構。
  • 快取:取得的內容儲存在本地快取中,使代理能檢索特定段落,而無需將整個頁面重新載入至上下文視窗中。

適用對象

本工具適用於希望擴展 Pi 代理能力的使用者,包括即時網路存取、透過 GitHub 克隆進行深度技術研究,以及對影片與 PDF 文件進行多模態分析。

主要亮點

  • 廣泛的提供者支援:整合數十個搜尋 API,並支援透過 Exa MCP 實現零設定搜尋。
  • 影片理解:使用 Gemini 與 ffmpeg 從 YouTube 與本地影片中提取字幕、視覺描述與特定畫面。
  • get_search_content:允許代理使用偏移量與模糊文字搜尋,高效導航大型頁面。
  • GitHub 整合:將倉庫本地克隆,實現真正的檔案探索,而非 HTML 爬取。
  • 來源驗證:專用的 source_check 工具,使用機器可讀引用與 SHA-256 哈希驗證主張。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案