blazickjp/arxiv-mcp-server

A Model Context Protocol server for searching and analyzing arXiv papers

解決的問題

研究人員和 AI 使用者經常難以彌合 LLM 介面與 arXiv 上龐大科學文獻庫之間的鴻溝。本專案為 AI 代理和用戶端提供了一種標準化的方式,無需手動下載或複製貼上,即可搜尋、檢索並深入分析學術論文。

工作原理

本專案實現了 Model Context Protocol (MCP),允許 Claude Desktop 或 OpenAI Codex 等 AI 用戶端透過一系列專用工具與 arXiv 進行互動。它可以搜尋 arXiv API、下載論文(轉換為 Markdown 或使用 PDF 備選方案),並按章節檢索原始 LaTeX 原始碼。它還整合了 Semantic Scholar API 以追蹤引用圖譜,並包含一個選用的本地語義搜尋功能,用於分析已下載的論文。

適用對象

  • AI 研究人員:希望實現文獻綜述或研究發現自動化的研究人員。
  • 開發人員:正在構建需要對科學數據進行落地存取之 AI 代理的開發人員。
  • 學生與學者:使用基於 LLM 的 IDE 或桌面應用程式來綜合複雜主題的學生與學者。

亮點

  • 多模態檢索:支援透過查詢進行搜尋、將全文下載為 Markdown 以及檢索特定的 LaTeX 章節。
  • 引用智能:透過 Semantic Scholar 獲取參考文獻與引用論文。
  • 進階工作流:包含用於深度論文分析、文獻綜合和研究問題構建的內建提示詞工作流。
  • 本地優先儲存:論文與語義索引儲存在使用者的本地機器上,以確保隱私與速度。