yeahhe365/Gemini-Nexus

Gemini Nexus 是一款面向浏览器场景的 AI 助手扩展,集成 Gemini Web、Gemini API 与 OpenAI 兼容接口,支持网页上下文、图像处理、工具调用和 MCP 浏览器控制。

解決する課題

ブラウザには、さまざまなAIモデルと対話するためのネイティブで統一されたインターフェースが不足しています。Gemini Nexusは、複数のLLMプロバイダーに対して単一のインターフェースを提供し、AIがブラウザ環境内で実際のタスクを実行できるようにすることで、このギャップを埋めます。

仕組み

この拡張機能は、Google Gemini(ウェブのリバースエンジニアリングまたは公式API経由)、OpenAI、Anthropic、DeepSeekなど、さまざまなバックエンドに接続する高度なインターフェース層として機能します。Chrome DevTools Protocolを使用して、AIがクリック、タイピング、ページ遷移などのエージェント的なアクションを実行できるようにします。また、Model Context Protocol (MCP) をサポートしており、SSE、HTTP、またはWebSocketsを介して外部ツールに接続できます。

対象ユーザー

  • パワーユーザー: 単一のブラウザインターフェース内で、異なるLLMプロバイダー(Claude、GPT、Geminiなど)を切り替えたい方。
  • 開発者: エージェント的なブラウザ自動化とMCPツール統合の実験を検討している方。
  • 研究者: ブラウザネイティブなAIワークフローの可能性を探求している方。

ハイライト

  • マルチプロバイダー対応: Gemini Web、OpenAI、Anthropic、DeepSeek、OpenRouterを含む。
  • エージェント的なブラウザ制御: ナビゲーションとインタラクションにChrome DevTools Protocolを使用。
  • MCP統合: SSE、HTTP、またはWebSocketsを介して外部ツールに接続。
  • スマートなUI機能: サイドパネル、フローティング選択ツールバー、画像/スクリーンショット入力を含む。
  • コンテキスト管理: APIプロバイダー向けの要約圧縮とメッセージ再編集による管理。