blazickjp/arxiv-mcp-server

A local MCP server for agent literature work. Original-LaTeX section reads, BibTeX from arXiv metadata, and topic watches. Papers stay on disk. Search is optional.

何を解決するか

arxiv-mcp-server は、ローカルで動作する Model Context Protocol (MCP) サーバーであり、AIエージェントが arXiv 上で専門的な文献調査を実行できるようにします。単なる検索ラッパーを越えて、エージェントが論文をローカルにダウンロード・保存・読込し、引用グラフをたどり、特定の研究トピックの新着論文を監視できる構造化された「文献ループ」を提供します。

動作方法

サーバーはローカルで実行されます(stdio または HTTP を通じて)し、arXiv API と Semantic Scholar API に接続します。論文とそのメタデータをローカルストレージディレクトリで管理します。

主なワークフロー:

  • 取得:論文の検索と要約の取得。
  • ローカル処理:論文のダウンロードと、Markdown への変換、または著者による提出された LaTeX ソースファイルをセクション単位で読み込む。
  • 分析:AIのコンテキストウィンドウを溢れさせないために、論文のページ単位のアウトラインを生成。
  • 監視:特定の条件に一致する新論文が公開された際にエージェントに通知するローカル「トピックウォッチ」を設定。
  • 引用:BibTeXメタデータのエクスポートと引用グラフの取得。

対象ユーザー

LLM駆動のツール(Claude Desktop、Cursor、Kiroなど)に、単一の検索クエリに頼らず、学術論文との深く根ざした統合を実現したい研究者、開発者、AIエージェントユーザー。

特徴

  • セクション単位の読み取り:コンテキストウィンドウの制限を管理するために、特定の LaTeX セクションや Markdown チャンクを読み取る能力。
  • ローカルストレージ:論文はディスク上に保持され、永続的なローカルライブラリが可能。
  • 引用統合:組み込みの BibTeXエクスポートと Semantic Scholar を通じた引用グラフ取得。
  • トピックウォッチ:研究関心をローカルで永続化し、時間とともに新しい論文を追跡。
  • 意味的検索:ダウンロード済み論文間でローカル埋め込みベースの類似性検索を行う「プロ」モード(オプション)。
  • 広範なクライアント対応:Claude Code、OpenAI Codex、Hermes Agent、VS Code/Kiro 用の事前構成済み設定が利用可能。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト