废话检测器:用于自动事实核查的代理技能

自动声明验证与评分

废话检测器提供了一个框架,使 AI 代理能够系统性地对在线内容进行事实核查。该工具从来源(如 YouTube 视频、推文或 PDF)中提取单个声明,并将每条声明与独立的网络来源进行核对,以生成报告卡。每条声明会被赋予一个判定(已确认、可信、误导、错误或无法验证),整体内容会得到 0 到 10 的废话评分

为防止幻觉,系统明确禁止代理仅凭内部模型记忆确认或驳斥声明;所有判定必须有外部来源支持。

系统架构:摄取 vs. 分析

项目严格区分内容摄取和推理,确保分析逻辑对来源格式保持中立。

内容摄取

fetch-content 技能负责将各种 URL 转换为干净的文本和元数据的确定性工作,无需 API 密钥。支持的来源包括:

  • YouTube 和 TikTok: 使用 yt-dlp 提取转录和字幕。
  • 文章和 PDF: 对网页使用可读性提取,对 PDF 使用原生解析。
  • 社交媒体: 通过免费端点获取推文。
  • 后备转录: 对没有字幕的视频,提供使用 mlx-whisper(针对 Apple Silicon 优化)的本地转录原型,将音频转换为文本。

内容分析

文本标准化后,代理使用分析技能对内容进行评估:

  • 废话检测器: 逐条声明进行验证并扫描夸大信号。
  • 摘要: 生成结构化的 TL;DR,包含带时间戳的关键点和“值得花时间吗?”评估。
  • 解释: 以 ELI5 风格深入讲解来源中提到的复杂概念,并提供术语词汇表。

部署与集成

废话检测器以“Agent Skills”形式分发——可移植的 Markdown 与自包含 Python 脚本组合。这些技能兼容多种支持网页搜索的 AI 代理平台,包括:

  • Claude Code CLI 与桌面版(代码标签): 通过 /plugin 市场或 skills.sh 安装程序提供完整支持。
  • OpenAI Codex、OpenCode、Cursor 和 Gemini CLI: 通过 skills.sh 安装程序支持。
  • Claude.ai(聊天)和 ChatGPT: 由于沙箱对网络访问的限制,仅通过粘贴驱动的变通方案或仅分析技能提供有限支持。

真实案例示例

该工具已在高流量、病毒式传播的内容上演示,以凸显制作价值与事实准确性之间的差距:

  • AI 赚钱视频(116 万观看): 获得 5/10 的废话评分。分析发现,虽然部分趋势属实,但有若干声明具有误导性或基于平台自身的宣传。
  • 天文 TikTok(55.2 万观看): 获得 9/10 的废话评分。报告指出,使用真实的天文学词汇构建了一个捏造的宇宙学。

社区观点与批评

虽然自动事实核查的概念受到广泛赞誉,Hacker News 社区仍提出了若干技术和哲学层面的担忧:

“你们使用什么作为‘真实依据’?……当两个来源持相反观点时如何调和?”

批评者质疑用于验证的“真实依据”以及代理如何处理来自不同来源的冲突信息。其他用户对“氛围编码”检测的有效性持怀疑态度,认为真正的事实核查需要比当前 LLM 能提供的更深层的逻辑推理。一些用户还建议,将该工具做成浏览器扩展或直接集成到短视频平台中,以在用户消费信息前发出警示,可能会产生更大影响。

Sources