blazickjp/arxiv-mcp-server
A local MCP server for agent literature work. Original-LaTeX section reads, BibTeX from arXiv metadata, and topic watches. Papers stay on disk. Search is optional.
何を解決するか
arxiv-mcp-server は、ローカルで動作する Model Context Protocol (MCP) サーバーであり、AIエージェントが arXiv 上で専門的な文献調査を実行できるようにします。単なる検索ラッパーを越えて、エージェントが論文をローカルにダウンロード・保存・読込し、引用グラフをたどり、特定の研究トピックの新着論文を監視できる構造化された「文献ループ」を提供します。
動作方法
サーバーはローカルで実行されます(stdio または HTTP を通じて)し、arXiv API と Semantic Scholar API に接続します。論文とそのメタデータをローカルストレージディレクトリで管理します。
主なワークフロー:
- 取得:論文の検索と要約の取得。
- ローカル処理:論文のダウンロードと、Markdown への変換、または著者による提出された LaTeX ソースファイルをセクション単位で読み込む。
- 分析:AIのコンテキストウィンドウを溢れさせないために、論文のページ単位のアウトラインを生成。
- 監視:特定の条件に一致する新論文が公開された際にエージェントに通知するローカル「トピックウォッチ」を設定。
- 引用:BibTeXメタデータのエクスポートと引用グラフの取得。
対象ユーザー
LLM駆動のツール(Claude Desktop、Cursor、Kiroなど)に、単一の検索クエリに頼らず、学術論文との深く根ざした統合を実現したい研究者、開発者、AIエージェントユーザー。
特徴
- セクション単位の読み取り:コンテキストウィンドウの制限を管理するために、特定の LaTeX セクションや Markdown チャンクを読み取る能力。
- ローカルストレージ:論文はディスク上に保持され、永続的なローカルライブラリが可能。
- 引用統合:組み込みの BibTeXエクスポートと Semantic Scholar を通じた引用グラフ取得。
- トピックウォッチ:研究関心をローカルで永続化し、時間とともに新しい論文を追跡。
- 意味的検索:ダウンロード済み論文間でローカル埋め込みベースの類似性検索を行う「プロ」モード(オプション)。
- 広範なクライアント対応:Claude Code、OpenAI Codex、Hermes Agent、VS Code/Kiro 用の事前構成済み設定が利用可能。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト