惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

M
MIT News - Artificial intelligence
雷峰网
雷峰网
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Last Week in AI
Last Week in AI
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
阮一峰的网络日志
阮一峰的网络日志
月光博客
月光博客
博客园 - Franky
腾讯CDC
T
Tailwind CSS Blog
Recent Announcements
Recent Announcements
V
V2EX
N
Netflix TechBlog - Medium
量子位
Jina AI
Jina AI
Y
Y Combinator Blog
The GitHub Blog
The GitHub Blog
G
Google Developers Blog
爱范儿
爱范儿
博客园 - 叶小钗
D
Docker
MongoDB | Blog
MongoDB | Blog
D
DataBreaches.Net
T
The Blog of Author Tim Ferriss

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
你以为在“提示词工程”,实际上可能在构建“上下文垃圾场”
张佳的AI实战笔记 · 2025-09-02 · via 人人都是产品经理

使用 AI 最大的问题,它能向下兼容。

以为自己在玩高级的东西,实际上行为很抽象……

而 AI 通过“向下兼容”或者“高级谎言”的方式,没让我们出丑。

下面四个实际上在构建“上下文垃圾场”的用法,分享给大家。

无则加勉,有则改之。

联网搜索模式

当前的 AI 工具都提供了联网搜索模式,初衷是帮助模型获取实时信息,弥补模型内部知识不足的问题。

是个很好的功能,但是在国内,不用更好。

这里面有两个坑:

  1. 搜索结果质量非常糟糕,尤其是中文互联网内容。过去十年中文互联网除了生产垃圾和“黄色新闻”(指那些毫无营养的社会边角新闻),几乎没有太多有价值的内容出现。还愿意在搜索引擎可见渠道发布的内容,基本都是营销或品牌宣传通稿,几乎没有有观点的信息。
  2. 搜索并不智能。你的某个需求可能被模型拆解成错误的检索词,叠加原本质量就不怎么高的信源,非常致命。海外的产品也好不哪里去,Grok会把你的中文提炼出关键词后翻译成英文再搜索,但是它那个翻译非常垃圾……

对于模型已知的常识性问题,大模型大部分时候能够辨别信息的质量,去伪留真。

但是对于模型不知道的知识,检索的结果就是它能参考的唯一上下文。

再叠加大模型胡说八道的幻觉水平,这些“上下文”,只能放大错误。

且不说,今天中文互联网里的很多网站,本来就没啥信息量,还只显示 10%的内容……

检索错误 + 失真 + 残缺,堆在一起,就是上下文垃圾场。

深度思考模式

DeepSeek R1 的深度思考模式,给全世界带来了使用 AI 的新体验。

对于大部分任务来说,思考过程可以让模型有更多的上下文,用于生产最终的答案。

但也同时带来了一些灾难,尤其对幻觉严重、文化水平高、又很听话的那些 AI 来说。

思考模式,是通过微调强行为大模型增加的输出约束。

对于一些不需要思考、确定性强的任务,这个被“强加”的思考过程,就只能带来灾难了。

以“完成一个简单的单价计算”任务为例。

让 Kimi 使用长推理模式计算“生成 1 秒视频消耗 8 积分,1 元钱可以买 100 积分,1 秒视频的成本是多少?”,它在思考过程中多次出现“不可能这么简单”“是不是有隐藏条件”这种毫无意义的“延伸思考”。

这些思考,只会把 AI 带向错误的方向。

思考并不永远是好事,有时候只是在构建“上下文垃圾场”。

以为自己能训练AI

我在短视频里见过太多“我把 XX 所有的文章都喂给 AI 后,它真的写出了神级文案”这样的内容。

现实中也有好多人,为了让模型了解自己,守着一个对话窗口不放,所有任务、所有资料都塞在一起,还逢人就炫耀“我训练的 AI 太懂我了!”

其实,以上这些行为,比前面两种“构建上下文垃圾场”的举动还要糟糕。

主流的大模型确实都有超过 128K(~20 万汉字)的上下文记忆能力了,但这不意味着它能记住你所有的信息。

大模型的核心技术是一个叫做“注意力机制”的算法,它会在完成任务时聚焦在某些关键信息上。

这种给它塞入大量种类、目的分散的内容,与这个底层算法是相悖的。

除了让你的 AI 像无头苍蝇一样乱嗡嗡以外,不提供任何价值。

想想:你上一轮让 AI 以简单明了的语气帮你回复邮件的指令,会怎么影响即将要完成的周报任务,这可是一个“要尽可能编造废话以增加篇幅”的工作。

密密麻麻的约束

给大模型提出尽可能详细的要求来约束它的输出是对的,但不是所有要求都是对的。

我之前拆字节开源的 DeerFlow 项目,它的规划提示词里给出了非常多“MUST”约束,包括“必须全面覆盖”“必须足够深度”“必须足够数量”“必须可靠信源”。

但是,标准是什么呢?多少叫全面覆盖?多深叫足够深?自家产品抖X是可靠信源么?

这些没有标准,但又“必须”遵守的要求,除了让 AI 做无用功、生产幻觉以外,毫无意义。

一顿操作猛如虎,仔细一看,“上下文垃圾”。

Attention!

提示词工程,不是“给 AI 喂更多”,而是要确保“给 AI 喂对的”。

明确目标、信息充分、减少噪音。

用好 AI 的基本素养,需要持续修行。

我上周录了 15 堂小课,总结了过去三年我使用 AI 的心得。

核心围绕一件事:如何正确向 AI 提供信息、下达任务。

15 堂课包括 5 节认知内容和 10 节技巧内容

每节课都由一个场景误区、原因解释和快速改变的小技巧/自查清单组成。

其中,后面的 10 节技巧课,一半都是不需要你动脑子、直接让 AI 来实施的。

所以我给这套课起名「四两拨千斤」

另外,9月7日前报名,可以获赠一年的《AI 大事件》周刊。