定义现代 Web:深入探讨 The Website Specification
在 Web 被无数框架——从 Next.js 和 Astro 到过时的 WordPress 安装——所割裂的时代,对“好”网站的定义变得越来越复杂。它不再仅仅关乎有效的 HTML;它还关乎无障碍访问、安全标头、搜索可见性,以及现在,让 AI agent 解析内容的高效能力。
最近,一个名为 The Website Specification 的项目作为一个雄心勃勃的尝试出现,旨在将这些要求规范化。它并不是在发明新规则,而是作为 WHATWG、W3C、IETF 和 WCAG 现有标准的精心策划的聚合器。其目标是提供一个与平台无关的检查清单,以确保无论使用什么技术栈构建,网站在技术上都是健全的。
优质网站的十大支柱
该规范将现代网站的技术要求组织成十个不同的类别,为开发者审计当前项目提供了一份路线图:
- Foundations: 基础的 HTML、head 标签和文档基础。
- SEO: 通过
robots.txt、sitemaps 和结构化数据管理搜索可见性。 - Accessibility: 确保符合 WCAG,使 Web 对所有能力的人群都保持可用。
- Security: 实现关键的标头、传输协议和安全策略。
- Well-Known URIs: 利用
/.well-known/下的标准路径(例如security.txt)进行自动化发现。 - Agent Readiness: 为 AI agent 和爬虫进行优化,使网站对下一代 Web 消费者而言是可读的。
- Performance: 专注于 Core Web Vitals、缓存策略和网络行为。
- Privacy: 通过同意信号和隐私政策尊重访问者的选择。
- Resilience: 通过自定义错误页面和离线能力规划优雅降级。
- Internationalisation: 处理本地化、语言方向和翻译内容。
弥合人类与 Agent 之间的鸿沟
该规范中最具前瞻性——也最具争议性——的方面之一是其对“Agent Readiness”的关注。该项目不仅列出了要求;它还实现了它们。整个规范作为一个开放的 Model Context Protocol (MCP) 服务器可用,允许 AI agent 直接查询该规范。它还提供了 llms.txt 并支持 Accept: text/markdown 标头,以确保 LLM 可以消费这些文档而不会受到传统 UI 的干扰。
这种方法承认了 Web 消费方式的一个根本转变。我们正在从一个人类浏览页面的世界,转向一个 agent 作为中介的世界。通过为 agent 提供一种理解网站能力的结构化方式,该规范试图为 Web 做好未来准备。
社区批评:标准 vs. "Slop"
与任何试图标准化 Web 的尝试一样,开发者的社区反应是两极分化的。虽然许多人称赞其为初学者的优秀资源和有用的审计工具,但其他人则持怀疑态度。
"Slop" 辩论
某些批评者认为该项目是“AI slop”的一个例子,暗示使用 LLM 生成内容会导致检查清单显得臃肿或流于形式。人们担心,在开发者的任务中增加一个 128 项的检查清单可能会挫伤人们直接发布网站的积极性。
Agent 特定规范的效用
关于 llms.txt 的价值以及特定的 agent 许可,存在着显著的辩论。一些开发者认为 Web 的美妙之处在于其通用性——即 agent 应该能够解析标准 HTML 而无需特殊提示。
"Agent Readiness 可能会像 'Web 4.0 Blockchain Integration' 一样随着时间的推移而过时... 要求网站提供特殊的许可会破坏整个初衷。"
实际差距
技术用户也指出了规范可以扩展的领域。例如,对于登录表单有很强的需求,特别是关于为密码管理器使用标准输入字段名称、禁用电子邮件字段的自动大写,以及遵循 NIST SP 800-53 指南以摆脱基于 SMS 的 2FA。
结论:一种务实的质量方法
尽管存在批评,The Website Specification 的价值在于其作为一个中心化目录的角色。通过将每一项建议都链接回事实来源(如 IETF RFC 或 MDN),它避免了成为仅仅是意见的集合。
对于现代开发者,该规范提醒人们,一个“完成”的网站不仅仅是一个运行良好的 UI。它是安全、无障碍访问和可发现性的复杂交集。无论你将这 128 项检查清单视为全面的金标准,还是过度设计的负担,该项目都突出了在现代 Web 开发的阴影中经常积累的必要技术债。