yeahhe365/Gemini-Nexus
Gemini Nexus 是一款面向浏览器场景的 AI 助手扩展,集成 Gemini Web、Gemini API 与 OpenAI 兼容接口,支持网页上下文、图像处理、工具调用和 MCP 浏览器控制。
解決する課題
ブラウザには、さまざまなAIモデルと対話するためのネイティブで統一されたインターフェースが不足しています。Gemini Nexusは、複数のLLMプロバイダーに対して単一のインターフェースを提供し、AIがブラウザ環境内で実際のタスクを実行できるようにすることで、このギャップを埋めます。
仕組み
この拡張機能は、Google Gemini(ウェブのリバースエンジニアリングまたは公式API経由)、OpenAI、Anthropic、DeepSeekなど、さまざまなバックエンドに接続する高度なインターフェース層として機能します。Chrome DevTools Protocolを使用して、AIがクリック、タイピング、ページ遷移などのエージェント的なアクションを実行できるようにします。また、Model Context Protocol (MCP) をサポートしており、SSE、HTTP、またはWebSocketsを介して外部ツールに接続できます。
対象ユーザー
- パワーユーザー: 単一のブラウザインターフェース内で、異なるLLMプロバイダー(Claude、GPT、Geminiなど)を切り替えたい方。
- 開発者: エージェント的なブラウザ自動化とMCPツール統合の実験を検討している方。
- 研究者: ブラウザネイティブなAIワークフローの可能性を探求している方。
ハイライト
- マルチプロバイダー対応: Gemini Web、OpenAI、Anthropic、DeepSeek、OpenRouterを含む。
- エージェント的なブラウザ制御: ナビゲーションとインタラクションにChrome DevTools Protocolを使用。
- MCP統合: SSE、HTTP、またはWebSocketsを介して外部ツールに接続。
- スマートなUI機能: サイドパネル、フローティング選択ツールバー、画像/スクリーンショット入力を含む。
- コンテキスト管理: APIプロバイダー向けの要約圧縮とメッセージ再編集による管理。