blazickjp/arxiv-mcp-server

A local MCP server for agent literature work. Original-LaTeX section reads, BibTeX from arXiv metadata, and topic watches. Papers stay on disk. Search is optional.

解决的问题

arxiv-mcp-server 是一个本地 Model Context Protocol (MCP) 服务器,使 AI 代理能够对 arXiv 上的文献进行专业级研究。它超越了简单的搜索封装,提供了一个结构化的「文献循环」,允许代理本地下载、存储和阅读论文,遍历引用图谱,并监控特定研究主题的新论文发布。

工作原理

服务器在本地运行(通过 stdio 或 HTTP),连接 arXiv API 和 Semantic Scholar API。它管理一个本地存储目录,用于保存论文及其元数据。

核心工作流包括:

  • 检索:搜索论文并获取摘要。
  • 本地处理:下载论文,并将其转换为 Markdown,或逐节阅读作者提交的原始 LaTeX 源文件。
  • 分析:生成分页的论文大纲,避免 AI 上下文窗口溢出。
  • 监控:设置本地「主题监控」,当有符合特定条件的新论文发布时,向代理发出警报。
  • 引用:导出 BibTeX 元数据并获取引用图谱。

适用人群

希望其 LLM 驱动工具(如 Claude Desktop、Cursor 或 Kiro)能够与学术论文实现深度、扎实的集成,而无需依赖单次搜索查询的研究人员、开发者和 AI 代理用户。

特色亮点

  • 分节阅读:可读取特定 LaTeX 节或 Markdown 块,以管理上下文窗口限制。
  • 本地存储:论文保存在磁盘上,支持持久化的本地文献库。
  • 引用集成:内置 BibTeX 导出功能,通过 Semantic Scholar 获取引用图谱。
  • 主题监控:本地持久化研究兴趣,长期追踪新论文。
  • 语义搜索:可选「专业」模式,对已下载论文进行本地嵌入式相似性搜索。
  • 广泛客户端支持:提供 Claude Code、OpenAI Codex、Hermes Agent 和 VS Code/Kiro 的预配置方案。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目