yeahhe365/Gemini-Nexus
Gemini Nexus 是一款面向浏览器场景的 AI 助手扩展,集成 Gemini Web、Gemini API 与 OpenAI 兼容接口,支持网页上下文、图像处理、工具调用和 MCP 浏览器控制。
解決的問題
Gemini Nexus 是一款 Chrome 擴充功能,將多個 AI 提供商整合至單一瀏覽器介面。它消除了切換不同 AI 網頁標籤或在不同平台管理多個 API 金鑰的需要,提供統一的側邊欄和浮動工具列,實現 AI 協助的瀏覽體驗。
如何運作
此擴充功能作為瀏覽器的原生 AI 層,支援多種連接方式:
- 提供者整合:連接到 Gemini Web(透過逆向工程的 RPC 端點)、官方 Gemini API、OpenAI 相容 API(包含 DeepSeek、OpenRouter 和 Qwen)、Anthropic,以及 Zhipu。
- 瀏覽器控制:使用 Chrome DevTools Protocol,讓 AI 能執行代理任務,例如點擊、輸入、導航頁面,以及擷取頁面內容的快照。
- 外部工具整合:透過 SSE、WebSocket 或 HTTP 支援 Model Context Protocol (MCP),讓 AI 可透過本地代理存取外部 MCP 伺服器的工具。
- UI 整合:注入浮動工具列以進行文字選取操作(翻譯、摘要),以及側邊欄以進行完整的對話。
適用對象
- 希望在瀏覽時透過單一介面存取多個 LLM 的使用者。
- 希望使用 AI 代理自動化瀏覽器任務的開發者或進階使用者。
- 希望將外部 MCP 工具直接整合至瀏覽器工作流程的人。
特色亮點
- 多提供者支援:無縫切換 Gemini Web、官方 API 與各種第三方提供者。
- 代理式瀏覽器控制:可執行真實的瀏覽器操作,例如填寫表單與管理標籤頁。
- MCP 整合:連接外部 MCP 伺服器,擴展 AI 的能力。
- 進階輸入支援:支援 OCR、螢幕截圖翻譯,以及畫面/視窗擷取,以處理基於影像的提示。
- 上下文管理:包含摘要壓縮與最近對話回合修剪,以處理長時間對話。
這是一個真正能理解並操作瀏覽器的 AI,不僅能回答問題,還能執行任務。 — @jamesknelson
相關
- 專案
- 專案
- 專案
- 專案
- 專案