yeahhe365/Gemini-Nexus
Gemini Nexus 是一款面向浏览器场景的 AI 助手扩展,集成 Gemini Web、Gemini API 与 OpenAI 兼容接口,支持网页上下文、图像处理、工具调用和 MCP 浏览器控制。
解决的问题
浏览器缺乏与各种 AI 模型交互的原生、统一接口。Gemini Nexus 通过为多个 LLM 提供商提供单一接口,并使 AI 能够在浏览器环境中执行实际任务,从而弥补这一空白。
工作原理
该扩展程序作为一个复杂的接口层,连接到各种后端,包括 Google Gemini(通过 Web 逆向工程或官方 API)、OpenAI、Anthropic、DeepSeek 等。它使用 Chrome DevTools Protocol 让 AI 能够执行点击、打字和页面导航等代理操作。它还支持 Model Context Protocol (MCP),通过 SSE、HTTP 或 WebSockets 连接到外部工具。
适用人群
- 高级用户:希望在单个浏览器界面中切换不同 LLM 提供商(如 Claude、GPT 或 Gemini)的用户。
- 开发者:希望尝试代理式浏览器自动化和 MCP 工具集成的开发者。
- 研究人员:探索浏览器原生 AI 工作流能力的科研人员。
亮点
- 多提供商支持:包括 Gemini Web、OpenAI、Anthropic、DeepSeek 和 OpenRouter。
- 代理式浏览器控制:使用 Chrome DevTools Protocol 进行导航和交互。
- MCP 集成:通过 SSE、HTTP 或 WebSockets 连接外部工具。
- 智能 UI 功能:包括侧边栏、悬浮选择工具栏以及图像/截图输入。
- 上下文管理:通过针对 API 提供商的摘要压缩和消息重新编辑进行管理。