惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

腾讯CDC
T
Threatpost
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
T
Tenable Blog
AWS News Blog
AWS News Blog
Know Your Adversary
Know Your Adversary
TaoSecurity Blog
TaoSecurity Blog
P
Palo Alto Networks Blog
Spread Privacy
Spread Privacy
I
Intezer
Security Latest
Security Latest
The Last Watchdog
The Last Watchdog
Google DeepMind News
Google DeepMind News
Help Net Security
Help Net Security
Cyberwarzone
Cyberwarzone
N
News and Events Feed by Topic
O
OpenAI News
A
Arctic Wolf
S
Secure Thoughts
Attack and Defense Labs
Attack and Defense Labs
N
News and Events Feed by Topic
M
MIT News - Artificial intelligence
F
Full Disclosure
P
Privacy International News Feed
The GitHub Blog
The GitHub Blog
T
Troy Hunt's Blog
C
CXSECURITY Database RSS Feed - CXSecurity.com
H
Hacker News: Front Page
aimingoo的专栏
aimingoo的专栏
S
Security @ Cisco Blogs
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Apple Machine Learning Research
Apple Machine Learning Research
Engineering at Meta
Engineering at Meta
Cloudbric
Cloudbric
大猫的无限游戏
大猫的无限游戏
Google Online Security Blog
Google Online Security Blog
Recent Announcements
Recent Announcements
H
Help Net Security
量子位
V
V2EX
美团技术团队
G
Google Developers Blog
www.infosecurity-magazine.com
www.infosecurity-magazine.com
S
Schneier on Security
V2EX - 技术
V2EX - 技术
D
Docker
博客园 - 【当耐特】
Project Zero
Project Zero
博客园 - 司徒正美

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派 万字剖析:千问App深度体验报告(2026) - 少数派 在2026年,如何真正防止别人抄袭你的作品 - 少数派 怎么用 50 块搭个 AI 语音助手?我踩了 3 天坑 - 少数派 YeeroAI:让 AI 对话真正成为知识管理的一部分 - 少数派 爬泰山 - 少数派 「旅图显影」 App 更新:这次,我们补上了一点「手感」 - 少数派 假期出门太折磨?我的 23 条经验帮你规划惬意旅行 - 少数派 工作流会变吗 - 少数派 Claude Opus 4.6 怎么用最省钱?我测了 5 种方案 - 少数派 GPT Image 2 让图文并茂不再稀罕 - 少数派 用户侧出发——什么是AI,我要不要学习? - 少数派 找片、转存、整理、播放一条龙!让你的付费网盘值回票价 - 少数派 欢迎试用!日课一问2.0插件 - 少数派 自己做的MDeditor,原本想购买 Typora 试了两次支付不成功,干脆自己做一个 - 少数派 vibe coding了一个 3MB 的小工具,让 ~/Downloads 彻底告别混乱 - 少数派 因为受不了 Mac 的风扇策略,我做了一个风扇控制工具 - 少数派 别只怪模型 - 少数派 Warp 终端的 AI 功能怎么用?我测了一周的体验 - 少数派 AI 写代码老是出 bug?这 5 个配置我后悔没早知道 - 少数派 「新玩意」苹果出相机可能就这样:Sigma BF + 45mm F2.8 DG Contemporary - 少数派 一个面向2030年的AI操作系统是什么样子的:浅谈cola这款有灵魂的Agent - 少数派 别只看写代码 - 少数派 每天解决10个问题,还是一口气攻坚解决400个? - 少数派 AI 交易机器人怎么搭?我用 Claude 跑了一周实盘 - 少数派 Maptoposter Online:把你爱的城市画成艺术海报 - 少数派 Function Calling 怎么用?我测了 3 个模型发现差距真大 - 少数派 Legend Talk:我做了个 AI 圆桌,让 160 位思想家围着你的问题转 - 少数派 如何找到自己的蓝方?在小县城寻找压力测试 - 少数派 语音输入与软件接口|2026年聊AI时,我们都聊些什么(上) - 少数派 混动已经卖爆,纯电又来补刀——钛7闪充版简直“不讲武德” - 少数派 本月玩什么|朋友收藏、识质存在、沙罗周期 - 少数派 为什么要每天坚持输出? - 少数派 Claude API 挂了好几个小时,你的项目有备用方案吗? - 少数派 Function Calling 没你想的复杂——我用它做了个有点用的工具 - 少数派 登录系统立即播放视频或者图片音乐的软件 - 少数派 我为什么创建 FlipHTML5 下载工具 - 少数派 残局没电?多品牌外设电量统一管理软件EasyBluetooth已支持RTSS游戏内显示以及AIDA64 - 少数派 前往通义路的路 - 少数派 太好看了,媲美Sun的个人导航页,NAS部署星云门户 - 少数派 乌黑嘴唇“一键检测”上线了 - 少数派 派早报:Claude AI 接入多个创意软件生态、FILCO 生产方接手品牌等 - 少数派 【更新】BearCLI、Claude 连接器与 MCP 服务器 - 少数派 记了上千条流水,还是看不懂财务?我做了一个让 AI 读懂账本的工作台 - 少数派 MINI R56 升级原厂 Sport 模式 - 少数派 新玩意 | 一棵柠檬树(仿真版) - 少数派 Momenta的“物理AI”野望,需迈过“含摩量”这道关 - 少数派 网页直接投屏控制手机!NAS一键部署PandaScrcpy,流畅丝滑可远程。 - 少数派 众测|邀你一同探索随身 AI 硬件入口 YoooClaw C·ONE - 少数派 2050大会:分享时间是真诚 参会记 - 少数派 iPad 赋能电影创作:国内首部宣纸手绘长片《燃比娃》的幕后故事 - 少数派 AI的审美:我用 8 个大模型给 100 张旅行照片打分 - 少数派 普通人如何破圈?去参加一个本地协会 - 少数派 把极空间的图标全换了,主题DIY全攻略打造你的专属NAS桌面 - 少数派 电子便签墙,帮你实现便签自由 - 少数派 我如何用三个 CLI 工具取代文档创建需求 - 少数派 原来真的有人可以玩一辈子 - 少数派 社区速递 139 | 派友热议三月买了啥、复古单反尼康 Df 体验 - 少数派 06 作品的赏析与评价 - 少数派 TDS REVIEW|索尼 WF-1000XM6 降噪真无线耳机体验 - 少数派 35.98万起售的第二代腾势D9,我看重的不是堆料,而是不凑合 - 少数派 鼠须管 Squirrel 皮肤配置指北 - 少数派 从watch ultra2换到redmi watch6 - 少数派 派早报:阿里巴巴发布视频生成模型 HappyHorse 1.0 等 - 少数派 别迷信1M - 少数派 家人们天塌了!网盘“大封杀”,多个渠道多条路,NAS部署PanHub - 少数派 AI与人勾心斗角!NAS一键部署AI狼人杀,假日休闲必备。 - 少数派 电商必备!Comfyui工作流批量生图插件,一次生成12张!支持Nano banana pro模型 - 少数派 Comfyui工作流配置Gpt-image-2模型教程,0.03/张 - 少数派 OpenClaw第三方APi怎么配置?可使用Gpt-image-2模型 - 少数派 会员社区话题精选 Ep. 103 - 少数派
AI 时代的炼金术:Prompt 完全食用指南 - 少数派
2023-05-21 · via 少数派

Matrix 首页推荐

Matrix 是少数派的写作社区,我们主张分享真实的产品体验,有实用价值的经验与思考。我们会不定期挑选 Matrix 最优质的文章,展示来自用户的最真实的体验和观点。

文章代表作者个人观点,少数派仅对标题和排版略作修改。


2023 年是 AI 的时代,以 ChatGPT 为首的大模型召唤出了一大批「炼金术士」,他们挥舞着「魔杖」,以自己的智慧、灵感和激情不停地创造着一个又一个绚丽的世界。而 Prompt,就是这个 AI 时代的「炼金咒语」。

假如你是莎士比亚,请帮我写一首 100 字左右的情诗,献给我心爱的姑娘。

当一位初生的炼金术士对着这个时代最强大的炼金模型念诵着他的咒语,模型慷慨地回应了他的所求:

我最亲爱的,我心目中的美丽少女。你是太阳,照耀着我的世界。你的美丽胜过最亮的星,在你面前,我所有的烦恼都远去。你是我花园里盛开的玫瑰,最甜美的香气使我的灵魂变得坚硬。你的声音是我耳边的音乐,在你的怀抱中,我忘记了所有的恐惧。

如斯美言,让这位不善倾吐的炼金术士,有了一展爱意的可能性。

然而正如古老的炼金之神所传下的箴预:炼金乃一门艺术而非科学。咒语时而能达成炼金者的心意,时而又如充耳的聋子或叛逆的顽童,唯一所长即是同炼金者作对,以不达心意为最大己任。

所幸炼金界的前辈们已总结了咒语的最佳实践,虽不能在所有实践场景下奏效,但已是金玉良言,足以为吾等初学者铺路。

大模型的工作原理

咒语是控制大模型的一把钥匙,若想学好咒语,需先学一学大模型的皮毛。

大模型的本质,是基于大样本训练出的预测模型。模型基于给它输入的语料,根据概率预测可能的回答。模型的预测结果受语料限制,譬如,模型所接收的语料是如下内容:

  • 中国的首都是哪里?
  • 法国的首都是哪里?
  • 美国的首都是哪里?

当提问者提问模型「中国的首都是哪里?」,模型的回答可能是「法国的首都是哪里」。模型实际上并不理解提问的含义,它只是根据过往的训练,预测与该提问最相关的内容

为了避免这种情况的出现,在预测模型之上,早期的炼金术士们想出了一种方案:通过人类的反馈来约束模型,从而让模型回答出人类满意的答案。当预测模型执行某个任务时,人类可以提供正面或负面的反馈,以指导模型的行为。

通过这样的方式,当提问者再次提问「中国的首都是哪里」时,模型就可以回答出人类想要的答案:「北京」。


炼金小密闻:

模型学习文本的方式同人类不同,它们会同时查看所有的内容,而不是像人类一样从左到右阅读。它们输出的每个字符都基于它们以前看到的和写下的,每次它们输出一个新字符时,都会停下来思考下一个字符是什么。

另外,模型定义的字符和人类的定义也不一样,有时人类以为是一个字符的存在,在模型眼中可能是两个字符。


大模型的能力

斯温伯恩曾言:「简单是真理的明证」,大模型也同样如此。作为炼金史上最强大的产物之一,它的能力也可以简单归为三类:识别、理解、生成。

  • 识别:查找,并从语料中提取特定的信息;
  • 理解(并非人类意义上的理解):对语料加以解释、概括和推理;
  • 生成:基于识别和理解之上,生成新的语料;

三生万物,杰出的炼金术士基于大模型的三种能力,与特定的行业结合,迸发出强大的创新和生产力。

它可以是信息筛选器,如:

请基于我提供的文本,分析文本的内容,如果文本主题与 AI 伦理相关,请为我保留下来,并输出 100 字左右的简单概述。我希望你能将所有保留的文本梳理成一篇简报,并基于保留的文本输出 200 字左右的综述。

它可以化身个性化客服:

请阅读我所提供的客户评论,并分析用户的情感倾向。你将基于用户的情感倾向回复用户评论。如果用户评论为正向,请向用户表示感谢,字数为 50 字左右。如果用户评论为负向,请向用户致以诚挚的歉意,并表明我们的改进诚意,字数为 100 - 150 左右。你应该在回复中引用用户的原文。

它也可以是你的代码生成器:

假设你是一个 Python 代码生成器,你的任务是基于用户所给的代码注释,生成对应的 Python 代码,你应该以 Markdown 的格式输出你的内容。在生成过程中,你应该检查用户的输入信息,以确保该信息足以让你输出正确的答案。若你在生成过程中有任何不确定的地方,请立即停止你的输出,并告知用户。

编写「咒语」的原则

杰出的炼金术士总是知道如何编写好的咒语以充分发挥大模型的能力,而他们也总是告诫初出茅庐的菜鸟们:编写咒语是一种艺术而非科学,因此需要反复实践,在挫败中总结。切勿迷信一成不变的最佳模板,每一个发挥良好功效的咒语都有它的适用场景和局限。

当然,一些良好且共通的实践规范仍然可以被分享,这是一条初生的道路,需要所有实践者的共同贡献。

编写有效咒语的良好实践准则:明确且具体的指令。

初生炼金术士在编写咒语,很容易在咒语中泛泛而谈。「请为我生成一首情诗」,既不知情诗的风格,也不知情诗的字数。相较而言,「请为我生成一首 100 字左右的莎士比亚风格的情诗」则具体许多。

在具体实践时,炼金术士们应该从输入思考输出三个维度思考咒语的编写,在每个维度都紧扣「明确且具体」的要求。

输入维度

输入,指 prompt 的输入格式,一个良好 prompt 的输入格式应该是层次分明的。不同的内容类型最好以分隔符区分,譬如:

请将下列括号中的内容翻译成英文:(这是一个美好的时代,我们都有美好的未来。我们唯一要做的是耐心等待。)

通过括号的分割,prompt 的指令与文本被分开了,这使得咒语被模型识别时,不同的内容以不同的功能被执行。分隔符可以是任意类型,核心在于将不同的内容类型进行区分。

思考维度

思考,指要求模型执行指令时的思维方式。正如人类有系统一和系统二一样,模型在执行时似乎也遵循着同样的逻辑。因此,当我们输入某些复杂问题时,模型为了效率优先,常常输出一些貌似正确,实则荒唐的答案。为了避免类似情况的出现,炼金术士在编写咒语时可以要求模型按特定的方式进行思考。

有两种方式可以「框定」模型的思考逻辑,一种是案例法,一种是框架法。

案例法:在要求模型输出特定的结果前,可以给模型少许样本参考,让它学习其中的模式。例:

Q:3 + 4 = ?

A:7

Q:3 + a = ?

A:unknown

Q:4 + b = ?

A:

模型通过用户提供的样本,识别了其中的模式,最终回答为 unknown。

框架法:案例法相当于经验材料,让模型从中提取思维模式。我们也可以直接要求模型模型按照某些特定的思考模式进行思考。譬如我们可以要求模型按我们指定的步骤进行思考,对于一些鼎鼎大名的逻辑(譬如贝叶斯),我们也可以直接要求模型按照该思维模型进行思考。

prompt:

假如你是天气预测器,最近 7 天都没有下雨,请思考明天下雨的概率

output:

作为 AI 语言模型,我没有能力进行天气预测,但是从概率角度来看,如果最近 7 天都没有下雨,那么明天下雨的概率应该是比较低的,因为天气预测是基于历史数据和气象学知识进行预测的,而历史数据中连续多天都没有下雨的情况比较少见,因此明天下雨的概率应该是比较小的。但是天气变化是不确定的,也有可能出现突发情况导致明天下雨,因此不能完全排除下雨的可能性。

这是一位初生炼金士的咒语,该咒语中没有约束模型的思考方式,输出的结果则略显空泛。现在将咒语修改,增加对思维方式的约束:

prompt:

假如你是天气预测器,最近 7 天都没有下雨,请根据贝叶斯定理思考明天下雨的概率

output:

作为 AI 语言模型,我并不具备实时天气预测的能力,但我可以根据贝叶斯定理给出

一个思考过程。

根据贝叶斯定理,我们可以通过已知的先验概率和新的证据来更新我们的后验概率。在这个问题中,我们可以将先验概率定义为在这个地区下雨的概率,而新的证据是最近 7 天都没有下雨。

假设在这个地区下雨的概率为 P(R),那么没有下雨的概率为 P(¬R) = 1 - P(R)。根据贝叶斯定理,我们可以得到:

P(R|¬R) = P(¬R|R) * P(R) / P(¬R)

其中,P(R|¬R) 表示在没有下雨的情况下,明天下雨的概率;P(¬R|R) 表示在下雨的情况下,明天不下雨的概率;P(R) 表示先验概率,即在这个地区下雨的概率;P(¬R) 表示没有下雨的概率。

由于最近 7 天都没有下雨,我们可以将 P(¬R|R) 设为一个较小的值,比如 0.1。而 P(R) 则需要根据实际情况来估计。如果这个地区经常下雨,那么 P(R) 可能会比较高;如果这个地区很少下雨,那么 P(R) 可能会比较低。

假设我们估计 P(R) 为 0.3,那么可以得到:

P(R|¬R) = 0.1 * 0.3 / (1 - 0.3) = 0.043

也就是说,在没有下雨的情况下,明天下雨的概率只有 4.3%。但需要注意的是,这个结果只是一个估计值,实际情况可能会有所不同。

相较于未约束的输出结果,约束后的模型的输出结果则更具体,也更具说服力。

在框架法中,有两种被推荐的实践方法,分别是一致性与 ReAct 模型:

  • 一致性:当我们要求模型处理一个复杂问题时,我们可以要求模型以多种角度进行思考,最终以多数一致性的方式判断最终的答案(例如我们要求模型以五种不同的思考角度思考同一个问题,最终其中的三种角度都得出了相同答案,根据多数原则,最终答案为三种角度得出的共同答案)
  • ReAct 模型:ReAct 是对问题的一种处理输出,要求模型按照思考 -> 行动 -> 行动结果 -> 答案呈现的顺序处理过程,实际上是要求模型在输出答案前要先思考,再基于思考行动,基于行动得出行动结果,最终基于行动结果呈现答案;

异常机制处理

马尔库塞说,人类是单向度的生物。此话也可以套用在思考上。无论是人类还是大模型,在思考上往往只考虑如果达成某项任务,而忽略了如果达不成某项任务,该如何处理。

富有经验的炼金士门在调教模型时,总是会在 prompt 中作如下约束:

  1. 要求模型检查用户所提供的信息,以确保信息的完善性足以保证任务的完成
  2. 当模型运行时,若遭遇异常机制(如无法处理当前问题),应暂停回复生成的过程,及时报错

输出维度

咒语的输出维度包含两种要求:内容要求和格式要求。

内容要求即咒语可要求输出内容包含的相关要点,例如当咒语为「输出莎士比亚风格的情诗」时,可要求情诗中包含月亮、玫瑰、梦境等意象;

格式要求指最终的输出结果以表格、代码、Markdown 等形式输出。甚至,爱搞事的炼金士们还自创模式:

请输出你的回答,你的回答应该以列表的形式呈现,每行回答的开头字母应该以「BEHAVIOR」作为开头。

良好咒语的格式

根据编写咒语的原则,炼金术士们总结了一套 prompt 的基本格式:

  • 指令:要求模型对文本的处理动作
  • 指令的对象:需要模型处理的文本
  • 示例:案例或思维模型提示
  • 输出要求:对于输出内容的内容和格式要求
  • 异常情况:对于模型无法执行,或指令信息缺失时的异常处理机制

魔法时刻

炼金术是一种魔法,而魔法总有难以解释之处。以下是炼金术士们在经验中总结的魔法诀窍,除了遵循正统的咒语编写原则和格式外,应用这些魔法诀窍也能在实践中获得更好的咒术效果。

  • 给模型起一个名字
  • 让它扮演某种角色
  • 赋予它某种任务
  • 在赋予任务时,使用「你应该…」而不是「禁止你…」的句式
  • 赋予任务后,要让模型确认你的要求
  • 当模型确认完(以及每次回复)你的指令时,给它一个鼓励
  • 请在 prompt 的开头和结尾都重复下你的指令
  • 如果你不想在 prompt 中输入示例,请在 prompt 的结尾加入如下的魔法咒语:「让我们一步步思考,以确保得出正确的答案」

大模型的局限

任何一件伟大事物都有它的阿喀琉斯之踵,我们无法要求伟大事物做它能力边界之外的事情。正如前述指出的,大模型本质上是一种预测模型,它披着语言之神外衣,由概率之神所伪装,本质上只擅长三件事:识别、理解和生成。

所以不要让它计算数学。尽管它通过了诸多考试,然而你绝不想考验它在关键时刻的准确性。曾经有炼金术士以小学的数学题让它思考,尽管它的分析过程并无谬误,但计算结果却堪称灾难。

问题:建筑工地有一批砖,最上层两块砖,第 2 层 6 块砖,第 3 层 10 块砖……,依次每层比其上一层多4块,已知最下层有 2106 块砖,这堆砖共有多少块? 

另外,大模型在某种意义上是一个记忆不佳的吹牛者。实际上,模型没有完全记住它所看到的信息,但它又想在提问者面前逞能,于是经常编造一些不存在的记忆。大模型自身无法规避这种行为的出现,炼金术士在编写咒语时,应鼓励大模型承认自己的无知,敢于将「不知道」宣之于口。同时,咒语中也应该要求大模型在列出事实性的信息时,注明来源和对应可核查的地址(尽管它连信息源都会伪造,但提供了一种核查的路径)。

除了这两个严重的缺陷外,炼金术们还发现了顺序对于大模型的影响。有时示例顺序的不同,也会影响大模型的结果输出。对于这类情况,尚没有好的解决方案,只能调整语料顺序以找到最佳的输出结果。

真正重要的的是……

如果让杰出的炼金术士留下他们最宝贵的箴言,那么一定是:没有什么是重要的,除了在实践中反思并重新迭代自己的咒语。即使是再杰出的炼金术士们,编写一条可用的咒语也至少需要三到四次的迭代,那些只编写了一次就开始抱怨大模型不起作用的炼金术士们,正缺乏这条箴言的鞭笞。

学习、运用、反思、迭代,正是这样循环往复的过程,才使得咒语的效力被真正发挥出来。挥动语言的炼金术士们,无人能够夺走他们对魔法的幻想和憧憬。


本文参考:

> 下载 少数派 2.0 客户端、关注 少数派公众号,解锁全新阅读体验 📰

> 实用、好用的 正版软件,少数派为你呈现 🚀