jkawamoto/mcp-youtube-transcript

MCP server retrieving transcripts of YouTube videos

解决的问题

该项目为 AI 代理和 LLM 提供了一种程序化获取 YouTube 视频字幕和元数据的方法,使它们能够在不观看视频的情况下“阅读”视频内容。

工作原理

该项目以 Model Context Protocol (MCP) 服务器的形式实现。这意味着它充当 LLM(如 Claude 或 LM Studio)与 YouTube Transcript API 之间的桥梁。它提供了一组工具,LLM 可以调用这些工具来获取字幕(带或不带时间戳)、检查可用语言以及获取视频元数据。

适用人群

希望其 AI 能够处理和分析 YouTube 视频内容的 AI 代理开发者和用户(例如 Goose、Claude Desktop 或 LM Studio)。

主要亮点

  • 分页支持:自动将超过 50,000 个字符的字幕拆分(可通过 --response-limit 调整),避免超出 LLM 的 token 限制。
  • 带时间戳的字幕:可获取带有精确时间戳的字幕,便于精准引用。
  • 语言选择:支持指定所需的字幕语言。
  • 代理支持:内置对住宅代理(如 Webshare)和标准 HTTP/HTTPS 代理的支持,可绕过 IP 封禁。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目