yeahhe365/Gemini-Nexus
Gemini Nexus 是一款面向浏览器场景的 AI 助手扩展,集成 Gemini Web、Gemini API 与 OpenAI 兼容接口,支持网页上下文、图像处理、工具调用和 MCP 浏览器控制。
它解决了什么问题
Gemini Nexus 是一个 Chrome 扩展,将多个 AI 提供商整合到单一浏览器界面中。它通过提供统一的侧边栏和浮动工具栏,消除了在不同 AI 网页标签间切换或在不同平台管理多个 API 密钥的需求,实现 AI 辅助浏览。
它如何工作
该扩展作为浏览器的原生 AI 层,支持多种连接方式:
- 提供者集成:连接 Gemini Web(通过逆向工程的 RPC 端点)、官方 Gemini API、OpenAI 兼容 API(包括 DeepSeek、OpenRouter 和 Qwen)、Anthropic 以及 Zhipu。
- 浏览器控制:使用 Chrome DevTools Protocol,使 AI 能够执行代理任务,如点击、输入、页面导航以及对页面内容进行快照。
- 外部工具支持:通过 SSE、WebSocket 或 HTTP 支持 Model Context Protocol (MCP),允许 AI 通过本地代理访问外部 MCP 服务器的工具。
- UI 集成:注入一个用于文本选择操作(翻译、摘要)的浮动工具栏和一个用于完整对话的侧边栏。
适合谁
- 希望在浏览时通过单一界面访问多个大语言模型的用户。
- 希望使用 AI 代理自动化浏览器任务的开发者或高级用户。
- 希望将外部 MCP 工具直接集成到浏览器工作流中的用户。
特色亮点
- 多提供者支持:无缝切换 Gemini Web、官方 API 及各种第三方提供者。
- 代理式浏览器控制:能够执行真实的浏览器操作,如填写表单和管理标签页。
- MCP 集成:连接外部 MCP 服务器以扩展 AI 的能力。
- 高级输入支持:支持 OCR、截图翻译和屏幕/窗口捕获,用于基于图像的提示。
- 上下文管理:包含摘要压缩和最近一轮截断功能,以处理长对话。
一个强大的浏览器原生 AI 层,集成了多个 LLM 提供者,支持代理式浏览器控制和外部 MCP 工具——@gemini_nexus
相关
- 项目
- 项目
- 项目
- 项目
- 项目