yeahhe365/Gemini-Nexus

Gemini Nexus 是一款面向浏览器场景的 AI 助手扩展,集成 Gemini Web、Gemini API 与 OpenAI 兼容接口,支持网页上下文、图像处理、工具调用和 MCP 浏览器控制。

解決的問題

瀏覽器缺乏與各種 AI 模型互動的原生、統一介面。Gemini Nexus 透過為多個 LLM 提供商提供單一介面,並使 AI 能夠在瀏覽器環境中執行實際任務,從而彌補這一空白。

工作原理

該擴充功能作為一個複雜的介面層,連接到各種後端,包括 Google Gemini(透過 Web 逆向工程或官方 API)、OpenAI、Anthropic、DeepSeek 等。它使用 Chrome DevTools Protocol 讓 AI 能夠執行點擊、打字和頁面導航等代理操作。它還支援 Model Context Protocol (MCP),透過 SSE、HTTP 或 WebSockets 連接到外部工具。

適用對象

  • 進階使用者:希望在單一瀏覽器介面中切換不同 LLM 提供商(如 Claude、GPT 或 Gemini)的使用者。
  • 開發者:希望嘗試代理式瀏覽器自動化與 MCP 工具整合的開發者。
  • 研究人員:探索瀏覽器原生 AI 工作流能力的科研人員。

亮點

  • 多提供商支援:包括 Gemini Web、OpenAI、Anthropic、DeepSeek 與 OpenRouter。
  • 代理式瀏覽器控制:使用 Chrome DevTools Protocol 進行導航與互動。
  • MCP 整合:透過 SSE、HTTP 或 WebSockets 連接外部工具。
  • 智慧 UI 功能:包括側邊欄、懸浮選擇工具列以及圖像/螢幕截圖輸入。
  • 上下文管理:透過針對 API 提供商的摘要壓縮與訊息重新編輯進行管理。