惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Jina AI
Jina AI
云风的 BLOG
云风的 BLOG
人人都是产品经理
人人都是产品经理
T
The Blog of Author Tim Ferriss
阮一峰的网络日志
阮一峰的网络日志
罗磊的独立博客
J
Java Code Geeks
博客园 - 聂微东
B
Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
WordPress大学
WordPress大学
腾讯CDC
L
LangChain Blog
Apple Machine Learning Research
Apple Machine Learning Research
Microsoft Azure Blog
Microsoft Azure Blog
D
DataBreaches.Net
The GitHub Blog
The GitHub Blog
美团技术团队
博客园 - Franky
Google DeepMind News
Google DeepMind News
V
V2EX
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
月光博客
月光博客
The Cloudflare Blog

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
用户意图识别与关键词提取 Prompt 设计方法论(上)
产品不正经 · 2025-12-18 · via 人人都是产品经理

Prompt 设计远非简单的语言拼凑,而是一项需要工程化思维的精密工作。本文揭秘了一套实战验证的 Prompt 设计方法论,涵盖关键词提取的8大防幻原则、思维链(CoT)的工程化应用,以及如何通过多模型交叉验证来提升泛化能力。从版本管理到结构化输出,这些经过千次测试总结的实战技巧,将帮助你打造出像代码一样严谨的智能对话系统。

最近在负责用户意图分析和关键词提取模块的 Prompt 设计工作。在这个过程中,我总结了一套较为完整的 Prompt 设计方法论,并整理了实际操作中容易遇到的“坑”与解法。

本系列复盘计划分为两篇:

  • 第一篇(本文):Prompt 的设计架构、关键词提取策略与思维链实践
  • 第二篇:如何科学评估 Prompt 的效果与定义准确率

在正式进入具体方法之前,我想分享一个核心认知:Prompt 设计需要具备“工程化的严谨性”

它既不是简单的自然语言拼凑,也没有复杂到不可掌握。一个优秀的 System Prompt 往往长达几千字,需要像打磨代码一样去迭代。在实践中,我发现一个非常有效的技巧是多模型交叉验证:利用 GPT 系列、Gemini 以及国内表现优秀的千问(Qwen)等不同模型进行测试。通过模型间的“性格”差异,可以更快发现 Prompt 的逻辑漏洞,提升结果的泛化能力。

以下是我在实战中总结的八个关键步骤。

一、Prompt 的版本管理:像代码一样维护

Prompt 不是一次性工作,它像产品功能一样,需要持续迭代。每一次微小的修改(甚至是一个标点符号)都可能引起输出效果的波动。因此,建立严格的版本管理是基础:

  1. 快照记录: 保存每一个版本的完整 Prompt 内容。
  2. A/B 测试: 详细对比不同版本的输出效果,特别是针对“边界案例(Edge Cases)”的表现。
  3. 变更日志: 记录修改原因(例如:修复了把“润色”误判为“闲聊”的问题)和优化点。

这不仅是为了追踪变化,更是为后续(第二篇将提到的)准确率量化评估提供数据基础。

二、明确意图类别与任务边界

在动笔写 Prompt 之前,必须先“观测数据”。意图分类不是拍脑门决定的,而是一个基于真实用户数据不断收敛的过程。

目前,我们将通用对话的意图主要归纳为以下几类,你需要为每一类提供清晰的定义:

  • 核心类: 信息获取、内容创作、任务执行
  • 交互类: 闲聊/情感陪伴、角色扮演
  • 辅助类: 决策辅助、测试/边界探索
  • 异常类: 错误/负面反馈、意图不明

实战经验:

很多时候,“内容创作”和“意图不明”容易混淆。如果用户发送了一段非常长的文本,大概率属于“内容创作”(如需要总结、改写),此时需结合上下文谨慎判断,避免草率归为“意图不明”。

三、模式匹配与触发规则

为了让 AI 在几毫秒内做出准确判断,我们需要定义高优先级的“提问模式”和“关键词锚点”。这相当于给 AI 的逻辑判断加了“快捷键”。

1. 高优先级提问模式

  • 方法/策略类: “如何提升……”、“……的策略是什么”
  • 事实/标准类: “某产品的注册流程”、“法案第 42 条”
  • 隐式创作类: “这个标题感觉不合适”(暗示修改)、“季度工作报告”(暗示生成)

2. 关键词触发规则(Mapping)

  • 含“润色、改写、总结、起标题” $\rightarrow$内容创作
  • 含“公司名、产品编号、定义” $\rightarrow$信息获取
  • 含“代码、表格、Excel、转换” $\rightarrow$任务执行

四、核心攻坚:关键词提取的“防幻觉”工程规范

在意图识别之外,关键词提取(Slot Filling) 往往是后续检索和执行的关键。但在实战中,AI 很容易犯两个错误:一是“无中生有”(生成原文中不存在的同义词),二是“抓不住重点”(提取了一堆形容词)。

针对这些痛点,我制定了 “关键词提取 8 原则”,能显著提升提取的精准度:

1)去噪原则: 严格过滤无意义的口语词汇(如“帮我”、“一下”、“请问”)。

2)词性硬约束: 仅提取名词、专有名词、名词短语。动词、形容词和虚词通常对检索帮助较小,直接剔除。

3)“原文萃取”原则(关键): 所有关键词必须是用户提问原文中一字不差的词语。严禁 AI 进行同义改写或总结。

  • Bad Case: 原文“奔驰”,提取“汽车”。
  • Fix: 必须提取“奔驰”。这一条能有效防止 AI 幻觉,保证后续搜索匹配的精准度。

4)长度控制: 单个关键词长度一般不超过 10 个字(书名号内的专有名词除外),避免提取整句。

5)优先级排序(Ranking):

并非所有名词都重要,需要教 AI 区分权重,建议输出顺序为:

  • 第一优先级:产出物/载体(如:表格、报告、思维导图、代码)——这是任务的核心目标。
  • 第二优先级:核心人物/问题(如:马斯克、系统崩溃)。
  • 第三优先级:核心实体/主题(如:Model 3、Python)。
  • 第四优先级:补充性信息(如:时间范围、地点)。

6)自我检查(Self-Correction): 在 Prompt 中加入自检步骤:“检查提取的词是否在原文中出现?词性是否符合要求?如果不符合,请剔除。”

7)格式限制: 明确数量上限(如最多 5 个)并强制输出为 List 或 JSON 格式,便于代码解析。

8)正确示例(Few-Shot): 提供正反例对比,让 AI 学习标准。

五、执行步骤:引入思维链(CoT)

为了保证逻辑的可解释性和稳定性,不要让 AI 直接输出结果,而是要求它按照特定的思维链进行推理:

1)初步判断: 扫描文本,匹配上述的“提问模式”或“关键词规则”。

2)二次深度判断(关键步骤):

  • 对于初判为“意图不明”的,重新审视是否存在隐式创作需求(如只有一段文字,可能是要求润色)。
  • 检查是否命中了典型的“反直觉”案例。

3)关键词自检:按照“8 原则”提取并核对关键词。

4)最终决策:结合上述分析,输出最终的意图代码和结构化数据。

六、案例示范与错误修正

在 Prompt 中植入“错误修正(Error Correction)”案例,效果往往优于单纯的正确案例。通过展示 AI 容易犯错的场景,能帮助模型快速校准参数。

七、结构化输入与分隔符

在工程实践中,如何确保 AI 清晰地知道哪部分是指令,哪部分是用户输入,哪部分是历史示例,至关重要。

使用分隔符(Delimiters): 强烈建议使用清晰、不常用的符号(如 ### 或 — 或 “””)将 Prompt 的不同部分隔开。这能有效防止 AI 将历史输入内容误判为指令或规则。

示例结构:

[系统角色设定]###[意图规则和分类定义]###[案例示范(Few-Shot)]###[用户输入]: <用户实际提问>

强制结构化输出: 明确要求输出 JSON 格式(如 {“intent”: “…”, “keywords”: […]}),而不是自然语言描述。

八、 角色设定与禁止事项

一个好的 Prompt 应该先给 AI “穿上盔甲”,明确它的身份、职责以及不能做的事情

1)明确角色(Persona): 在 Prompt 开头声明 AI 的身份(例如:“你是一个专业的意图分析引擎,专注于提供准确、简洁的意图分类和关键词提取。”)。角色设定有助于收敛 AI 的输出风格和范围。

2)设定禁止事项(Guardrails): 明确告知 AI 绝对不能做的事情,这能避免低级错误和不必要的长篇回复。

禁止项示例:

  • “禁止输出任何解释性、道歉性或引导性的话语,仅输出 JSON。”
  • “禁止自行创作或改写关键词。” “禁止闲聊或参与角色扮演。”

总结

Prompt 写作是一场持久战。从确立版本管理意识,到精细化打磨关键词提取的“8 原则”,再到引入思维链(CoT)进行逻辑加固,每一步都是为了让 AI 从“听懂”进化到“精准执行”。

明确意图类别、死磕关键词提取规则、建立错误修正库、结构化输出、角色设定与禁止项,是提升对话系统体验的核心要点。

在下一篇文章中,我将详细拆解如何定义“准确率”,以及如何建立一套科学的评估测试集,用数据量化 Prompt 的优化效果。敬请期待。

本文由 @产品不正经 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自Unsplash,基于CC0协议