blazickjp/arxiv-mcp-server
A Model Context Protocol server for searching and analyzing arXiv papers
解决的问题
研究人员和 AI 用户经常难以弥合 LLM 界面与 arXiv 上庞大科学文献库之间的鸿沟。本项目为 AI 智能体和客户端提供了一种标准化的方式,无需手动下载或复制粘贴,即可搜索、检索并深入分析学术论文。
工作原理
本项目实现了 Model Context Protocol (MCP),允许 Claude Desktop 或 OpenAI Codex 等 AI 客户端通过一系列专用工具与 arXiv 进行交互。它可以搜索 arXiv API,下载论文(转换为 Markdown 或使用 PDF 备选方案),并按章节检索原始 LaTeX 源代码。它还集成了 Semantic Scholar API 以跟踪引用图谱,并包含一个可选的本地语义搜索功能,用于分析已下载的论文。
适用对象
- AI 研究人员:希望实现文献综述或研究发现自动化的研究人员。
- 开发人员:正在构建需要对科学数据进行落地访问的 AI 智能体的开发人员。
- 学生和学者:使用基于 LLM 的 IDE 或桌面应用来综合复杂主题的学生和学者。
亮点
- 多模态检索:支持通过查询进行搜索、将全文下载为 Markdown 以及检索特定的 LaTeX 章节。
- 引用智能:通过 Semantic Scholar 获取参考文献和引用论文。
- 高级工作流:包含用于深度论文分析、文献综合和研究问题构建的内置提示词工作流。
- 本地优先存储:论文和语义索引存储在用户的本地机器上,以确保隐私和速度。