


























这个站点把 WHATWG(HTML 标准组织)、WCAG(网页无障碍标准)、IETF headers、schema.org(结构化数据词汇表)、MDN 和 Google Search Central 的建议整理成一份“现代网站规范”,还单独加了一个 “Agent Readiness” 章节。评论区围绕这份清单是否该被当成标准、是否掺了太多 AI 生成文案,以及它到底该优先服务人类还是 AI agent 展开。很多回复借机回顾了从 table layout、Flash、IE6 到 React/SPA 的前端演化,也提到 reader mode、.well-known、security.txt、login form 和 SSO/Passkey 这些更具体的实践。讨论的底层问题其实是:网站究竟是文档、应用,还是给搜索引擎和 agent 读取的机器接口。
评论一派认为给网站加 agent-friendly 版本、markdown 镜像或 llms.txt 是短期务实方案,尤其对文档站和开发者服务站点有用,能省 token,也能绕开 JS-heavy 页面和 bot protection。也有人指出现代 agent 已经会通过 content negotiation、markdown routes 或 reader mode 提取正文,所以更合理的方向是改善 semantic HTML 和结构化标记,让人和机器都读同一份内容。反对者则认为“agent-ready”只是给自动化开后门,网站运营者迟早会像对搜索引擎那样反制它,或干脆用 API/CLI 替代网页。还有人担心特殊规则会被坏人利用来让人类和 agent 看到不同内容。
[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7] [来源8] [来源9] [来源10] [来源11] [来源12] [来源13] [来源14] [来源15] [来源16] [来源17] [来源18] [来源19] [来源20] [来源21]
很多回复在吐槽现代前端把简单页面做成了深层组件树:一个下拉框要多次 fetch,滚动会被拦截弹层打断,页面看起来更像被框架拼出来的“响应式 PDF”。怀旧者希望回到纯 HTML 和基本 CSS 的年代,至少浏览器默认样式、文本可读性和 table-based layout 还算直接,文本浏览器和脚本也更容易解析。反方提醒,那个时代同样充满 IE6、box model 不一致、DHTML、Flash、polyfill 和各种 hack,所谓“黄金时代”并不真优雅。尽管如此,大家对今天语义丢失、深层 div 过多、Back/Forward 失效这类体验劣化几乎是一致抱怨的。
[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7] [来源8] [来源9] [来源10] [来源11] [来源12] [来源13] [来源14] [来源15] [来源16] [来源17] [来源18] [来源19] [来源20] [来源21] [来源22]
登录表单这段讨论集中在一些看似琐碎、其实很影响体验的细节:password manager 能识别的字段名、正确的 email input、自动聚焦、以及不要让用户为了输入密码多点一步。有人解释,先问 email 再决定下一步,往往是为了兼容 SSO、Passkey、租户路由和 blocked account 检查,不一定只是“设计得差”。也有人担心这种流程会泄露用户名是否存在,给 credential stuffing 之类攻击更多线索。讨论最后把 NIST SP 800-53、企业隔离和多租户登录这些更重的约束也带了进来。
[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7] [来源8] [来源9] [来源10] [来源11] [来源12] [来源13] [来源14] [来源15] [来源16]
一部分人把这份规范当成现成的 checklist,觉得它很适合补齐站点上的基础标签、结构化数据和可访问性细节,甚至能直接拿去让 agent 或本地模型帮忙审计旧站。另一部分人则认为把最佳实践写成一长串“required / recommended / optional”很容易滑向 cargo cult,因为每条规则都依赖上下文,照单全收反而会误导开发者。对页面本身的批评也很重:文案像 LLM 生成、卡片和金句过多、内容冗长,而且站点自己还被指出没做缓存等自家要求。整体争论的核心是,这到底是实用参考,还是披着 spec 外衣的 opinionated blog。
[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7] [来源8] [来源9] [来源10] [来源11] [来源12] [来源13] [来源14] [来源15] [来源16] [来源17] [来源18] [来源19] [来源20] [来源21] [来源22] [来源23] [来源24] [来源25]
关于 `.well-known` 的小分支则更偏工程细节:大家提到 `security.txt`、`change-password` 这类标准化发现入口,说明互联网早就有一套给机器查找站点功能的路径。有人补充这些文件有时会放在 root,有时放在 `.well-known/`,兼容性和部署习惯会影响最终形态。`security.txt` 还被拿来和 Let’s Encrypt 之类自动化基础设施联系起来,说明这类“冷门规范”并不是纯装饰。这个话题也顺带强调:很多网站问题不是没有标准,而是标准太分散、没人按。
[来源1] [来源2] [来源3] [来源4] [来源5] [来源6] [来源7]
llms.txt: 给 LLM/agent 使用的站点摘要或索引文件提案,用来指向更适合机器读取的内容。
.well-known URI: HTTP 里的标准化发现路径,常用于暴露站点可机器识别的元数据或能力端点。
reader mode: 浏览器自动抽取正文、去掉导航和广告的阅读模式。
MCP(Model Context Protocol): 让 AI agent 连接工具和数据源的协议。
SSO(Single Sign-On): 一次登录访问多个系统的认证方案。
Passkey: 基于公私钥的无密码登录方式。
security.txt: 站点公开安全联系与漏洞披露信息的标准文件。
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。