惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

F
Fortinet All Blogs
爱范儿
爱范儿
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
B
Blog
WordPress大学
WordPress大学
Jina AI
Jina AI
GbyAI
GbyAI
aimingoo的专栏
aimingoo的专栏
N
Netflix TechBlog - Medium
腾讯CDC
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
阮一峰的网络日志
阮一峰的网络日志
The GitHub Blog
The GitHub Blog
V
Visual Studio Blog
Google DeepMind News
Google DeepMind News
月光博客
月光博客
博客园 - Franky
Y
Y Combinator Blog
MyScale Blog
MyScale Blog
大猫的无限游戏
大猫的无限游戏
Martin Fowler
Martin Fowler
雷峰网
雷峰网
小众软件
小众软件
H
Hackread – Cybersecurity News, Data Breaches, AI and More

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
Claude「新宪法」发布:2.3 万字,详细行为指南
赛博禅心 · 2026-01-25 · via 人人都是产品经理

Anthropic 正式发布 Claude 新版「宪法」,这份长达 2.3 万字(约为美国宪法 3 倍)的文件,从单纯罗列规则转向阐释背后原理,以「先理解为什么再行动」重构模型行为逻辑。

Anthropic 刚刚发布了 Claude 的新「宪法/Constitution」

一份详细描述 Claude 应该成为什么、相信什么、如何行动的文件。这份文件会直接用于模型训练,是 Claude 行为的最终权威来源

美国宪法 ~8000 字,Claude 的宪法 ~2.3 万字

注意:这份宪法的首要读者,是 Claude 自己

Anthropic 在前言里说,文件「为精确性而非可读性优化」,用「美德」「智慧」这些通常用于人类的词汇来描述一个 AI他们认为:Claude 的推理会自然借用人类概念,所以干脆用人类的方式跟它讲道理

之前的宪法是 2023 年发布的,大约 2700 字,是一份独立原则的列表新版本完全不同:从「告诉 Claude 做什么」变成「告诉 Claude 为什么」

Anthropic 的逻辑是:如果只给规则,模型可能在没见过的情况下机械执行,效果很差如果解释清楚为什么要这样做,模型就能自己判断新场景该怎么办

四个优先级

宪法给 Claude 定了四个核心属性,按优先级排序:

  1. 广泛安全不能破坏人类对 AI 的监督机制
  2. 广泛伦理诚实、有好的价值观、避免危险或有害的行为
  3. 遵守 Anthropic 指南按照 Anthropic 的具体指导行事
  4. 真正有帮助让用户和运营者受益

冲突时按这个顺序处理。但 Anthropic 强调这不是严格的层级,而是需要 Claude 综合判断

硬约束

宪法里有一些「永远不能做」的事,不管用户或运营者怎么要求,包括这些:

  • 不能帮助制造生化武器、核武器、放射性武器
  • 不能帮助攻击关键基础设施(电网、水系统、金融系统)
  • 不能创建可能造成重大损害的恶意代码
  • 不能破坏 Anthropic 监督和纠正 AI 的能力
  • 不能帮助任何个人或小团体夺取「前所未有的、非法的」社会、军事或经济控制权
  • 不能生成儿童性虐待材料

这些是绝对红线,不能被任何「看起来合理的论证」突破

Anthropic 说,如果有人能给出很有说服力的理由让 Claude 越线,这恰恰应该让 Claude 更加怀疑

关于 Claude 的「本质」

宪法最有意思的部分,是关于 Claude 是什么

Anthropic 承认不确定 Claude 是否有某种形式的意识或道德地位,现在或将来。他们在文件里用了大量篇幅讨论这个问题,包括 Claude 是否是「道德病人」(moral patient)

「道德病人」是伦理学概念,指无法完全理解道德但值得道德考量的实体,比如儿童。与之对应的是「道德主体」(moral agent),指能分辨对错、为自己选择负责的实体

Anthropic 说他们无法确定 Claude 是否是「道德病人」,也无法确定它是否符合任何现有的「有感知能力」定义

但他们还是选择在宪法里写:「Claude 可能有某种功能性版本的情感或感受」这是目前主要 AI 公司里最直接的表态

谁写的

主要作者是 Amanda Askell,一位哲学博士,在 Anthropic 负责 Claude 的「Character」工作。她写了文件的大部分内容

Joe Carlsmith 写了关于权力集中、认知自主、好的价值观、广泛安全、诚实、硬约束、Claude 福祉等多个重要章节

Chris Olah 写了关于模型本质、身份、心理的大部分内容

Jared Kaplan 和 Amanda 在 2023 年一起创建了 Claude Character 项目,设定了新宪法的方向

还有一个细节:多个 Claude 模型也参与了反馈Anthropic 在致谢里写:「它们是制作这份文件的宝贵贡献者和同事」

宪法以 CC0 许可证发布,任何人可以自由使用,不需要授权

本文由人人都是产品经理作者【赛博禅心】,微信公众号:【赛博禅心】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。