blazickjp/arxiv-mcp-server

A Model Context Protocol server for searching and analyzing arXiv papers

解决的问题

研究人员和 AI 用户经常难以弥合 LLM 界面与 arXiv 上庞大科学文献库之间的鸿沟。本项目为 AI 智能体和客户端提供了一种标准化的方式,无需手动下载或复制粘贴,即可搜索、检索并深入分析学术论文。

工作原理

本项目实现了 Model Context Protocol (MCP),允许 Claude Desktop 或 OpenAI Codex 等 AI 客户端通过一系列专用工具与 arXiv 进行交互。它可以搜索 arXiv API,下载论文(转换为 Markdown 或使用 PDF 备选方案),并按章节检索原始 LaTeX 源代码。它还集成了 Semantic Scholar API 以跟踪引用图谱,并包含一个可选的本地语义搜索功能,用于分析已下载的论文。

适用对象

  • AI 研究人员:希望实现文献综述或研究发现自动化的研究人员。
  • 开发人员:正在构建需要对科学数据进行落地访问的 AI 智能体的开发人员。
  • 学生和学者:使用基于 LLM 的 IDE 或桌面应用来综合复杂主题的学生和学者。

亮点

  • 多模态检索:支持通过查询进行搜索、将全文下载为 Markdown 以及检索特定的 LaTeX 章节。
  • 引用智能:通过 Semantic Scholar 获取参考文献和引用论文。
  • 高级工作流:包含用于深度论文分析、文献综合和研究问题构建的内置提示词工作流。
  • 本地优先存储:论文和语义索引存储在用户的本地机器上,以确保隐私和速度。