废话检测器:用于自动事实核查的代理技能
自动声明验证与评分
废话检测器提供了一个框架,使 AI 代理能够系统性地对在线内容进行事实核查。该工具从来源(如 YouTube 视频、推文或 PDF)中提取单个声明,并将每条声明与独立的网络来源进行核对,以生成报告卡。每条声明会被赋予一个判定(已确认、可信、误导、错误或无法验证),整体内容会得到 0 到 10 的废话评分。
为防止幻觉,系统明确禁止代理仅凭内部模型记忆确认或驳斥声明;所有判定必须有外部来源支持。
系统架构:摄取 vs. 分析
项目严格区分内容摄取和推理,确保分析逻辑对来源格式保持中立。
内容摄取
fetch-content 技能负责将各种 URL 转换为干净的文本和元数据的确定性工作,无需 API 密钥。支持的来源包括:
- YouTube 和 TikTok: 使用
yt-dlp提取转录和字幕。 - 文章和 PDF: 对网页使用可读性提取,对 PDF 使用原生解析。
- 社交媒体: 通过免费端点获取推文。
- 后备转录: 对没有字幕的视频,提供使用
mlx-whisper(针对 Apple Silicon 优化)的本地转录原型,将音频转换为文本。
内容分析
文本标准化后,代理使用分析技能对内容进行评估:
- 废话检测器: 逐条声明进行验证并扫描夸大信号。
- 摘要: 生成结构化的 TL;DR,包含带时间戳的关键点和“值得花时间吗?”评估。
- 解释: 以 ELI5 风格深入讲解来源中提到的复杂概念,并提供术语词汇表。
部署与集成
废话检测器以“Agent Skills”形式分发——可移植的 Markdown 与自包含 Python 脚本组合。这些技能兼容多种支持网页搜索的 AI 代理平台,包括:
- Claude Code CLI 与桌面版(代码标签): 通过
/plugin市场或skills.sh安装程序提供完整支持。 - OpenAI Codex、OpenCode、Cursor 和 Gemini CLI: 通过
skills.sh安装程序支持。 - Claude.ai(聊天)和 ChatGPT: 由于沙箱对网络访问的限制,仅通过粘贴驱动的变通方案或仅分析技能提供有限支持。
真实案例示例
该工具已在高流量、病毒式传播的内容上演示,以凸显制作价值与事实准确性之间的差距:
- AI 赚钱视频(116 万观看): 获得 5/10 的废话评分。分析发现,虽然部分趋势属实,但有若干声明具有误导性或基于平台自身的宣传。
- 天文 TikTok(55.2 万观看): 获得 9/10 的废话评分。报告指出,使用真实的天文学词汇构建了一个捏造的宇宙学。
社区观点与批评
虽然自动事实核查的概念受到广泛赞誉,Hacker News 社区仍提出了若干技术和哲学层面的担忧:
“你们使用什么作为‘真实依据’?……当两个来源持相反观点时如何调和?”
批评者质疑用于验证的“真实依据”以及代理如何处理来自不同来源的冲突信息。其他用户对“氛围编码”检测的有效性持怀疑态度,认为真正的事实核查需要比当前 LLM 能提供的更深层的逻辑推理。一些用户还建议,将该工具做成浏览器扩展或直接集成到短视频平台中,以在用户消费信息前发出警示,可能会产生更大影响。