惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

G
Google Developers Blog
T
Troy Hunt's Blog
博客园 - 【当耐特】
N
Netflix TechBlog - Medium
V
V2EX
I
InfoQ
量子位
Hugging Face - Blog
Hugging Face - Blog
The Register - Security
The Register - Security
J
Java Code Geeks
V
Visual Studio Blog
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
S
Security @ Cisco Blogs
爱范儿
爱范儿
Hacker News: Ask HN
Hacker News: Ask HN
Recent Commits to openclaw:main
Recent Commits to openclaw:main
B
Blog
Apple Machine Learning Research
Apple Machine Learning Research
V2EX - 技术
V2EX - 技术
罗磊的独立博客
S
Security Affairs
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
IT之家
IT之家
O
OpenAI News
W
WeLiveSecurity
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
GbyAI
GbyAI
The Hacker News
The Hacker News
Attack and Defense Labs
Attack and Defense Labs
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Microsoft Azure Blog
Microsoft Azure Blog
F
Fortinet All Blogs
Schneier on Security
Schneier on Security
雷峰网
雷峰网
Scott Helme
Scott Helme
B
Blog RSS Feed
有赞技术团队
有赞技术团队
Recent Announcements
Recent Announcements
L
LangChain Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Y
Y Combinator Blog
Help Net Security
Help Net Security
NISL@THU
NISL@THU
A
About on SuperTechFans
L
LINUX DO - 最新话题
博客园 - 司徒正美
博客园 - 聂微东
博客园 - 三生石上(FineUI控件)
Spread Privacy
Spread Privacy
P
Proofpoint News Feed

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理, 企事业单位数字化的业务供需本质 – 人人都是产品经理, 医疗智能体·第1讲——医疗信息化重构:从“辅助软件”到“自主智能体”的范式转移 – 人人都是产品经理, 粉丝量就是空气!!! – 人人都是产品经理, 用户说“薯片碎了”,机器回“要买吗?”:意图识别的翻车与破局 – 人人都是产品经理, RAG召回准确率从75到90 我做对了这三件事 – 人人都是产品经理, AI大事件:Anthropic改收费、OpenAI发安全版、手术机器人纳入医保、阿里发布”秒悟” – 人人都是产品经理, Chrome 推出 Skills 新功能,Agent 重塑上网方式 – 人人都是产品经理, GitHub前创始人拿了a16z的1700万美元,做Agent时代的Git – 人人都是产品经理 拷贝或克隆其他 Flutter OH 项目到本地后无法运行 – 人人都是产品经理, 优惠券设计:优惠券创建 – 人人都是产品经理, 不用死磕文档!AI 助手 1 小时搞定飞书 CLI 安装 + 配置 + 知识库 – 人人都是产品经理, 用小龙虾做竞品分析报告:从2天到20分钟,我是怎么做到的 – 人人都是产品经理 用小龙虾做市场分析报告:搞懂这3个公式,市场规模不再靠猜 – 人人都是产品经理, 你早就在做 Harness 工程,只是不知道它叫这个名字 – 人人都是产品经理, Think Long就够?你可能想多了! – 人人都是产品经理, 货代SRM实战:供应商准入怎么做,才能让资源池不是通讯录而是可交付网络? – 人人都是产品经理, 如何做好用户调研?详解基本技巧 – 人人都是产品经理, 木鸟、途家、美团对打,平台春天行动开“卷” – 人人都是产品经理, 入职才发现公司不靠谱?小红书从业者求职避坑指南 – 人人都是产品经理, 美国 AI 三巨头联手封堵,中国 AI 突围之路在何方 – 人人都是产品经理, 小红书,放在需求对面的镜子 – 人人都是产品经理, AI 会带来大规模失业吗? – 人人都是产品经理, 从出单到补货前,我第一次犹豫:该不该放大? – 人人都是产品经理, Flutter 三方库鸿蒙化适配:5 种高效检查方式,快速判断是否需要适配 – 人人都是产品经理, 从做产品进阶拿结果:医美机构产品经理转岗科室运营经理 – 人人都是产品经理, 阿里HappyHorse,一场关于“Token经济”的阳谋 – 人人都是产品经理, To B AI:客户留存落地的观察与思考 – 人人都是产品经理, AI产品的“生命线”——数据采集、标注、清洗的产品化设计 – 人人都是产品经理, 谈谈AI Agent(二):当“孩子”能自己“体验世界”时,你该学什么? – 人人都是产品经理, UI/UX设计师的3层能力进阶,前两层让你活下来,第三层…才是真正的分水岭 – 人人都是产品经理, 2分钟 → 30秒,效率提升75%:B端产品经理如何用「规则枷锁」驯服AI幻觉? – 人人都是产品经理, 还没来得及学OpenClaw,来了个更猛的:Hermes Agent – 人人都是产品经理, AI日报:宇树机器人跑出10m/s刷新世界纪录 – 人人都是产品经理, 一文说透基金互金如何用情绪价值引导用户决策做转化 – 人人都是产品经理, 当浏览器开始替你”看”网页:AI 浏览器正在亲手拆掉它脚下的那张网 – 人人都是产品经理, 0代码,一天时间我Vibe Coding了个网站 – 人人都是产品经理, Hermes 和 OpenClaw 之争,Agent 的能力应该“装上去”还是“长出来”? – 人人都是产品经理 视频生成的“桌子”,字节Seedance 2掀完,阿里快乐马掀 – 人人都是产品经理, 从听不懂到完全信任:我的 Codex 深度产品体验 – 人人都是产品经理, 当虚拟偶像有了北京户口,与真人偶像还有什么区别? – 人人都是产品经理, 会说,远远比会做更重要 —— 对 SBTI 爆火现象的五层观察 – 人人都是产品经理, AI产品经理必看:当“搭环境”比“选模型”更重要,你的认知还在2024年吗? – 人人都是产品经理, 2026年AI产品商业化核心逻辑:从功能demo到规模化营收的3个必破卡点 – 人人都是产品经理, 京东围绕供应链,卷起裤腿下场的那些事儿 – 人人都是产品经理, SBTI一夜刷屏:它赢在了“太会说人话” – 人人都是产品经理, 折扣零售的真相:不是便宜,而是价值感! – 人人都是产品经理, 和甲方吵了一架,最后加钱做了——我学到的ToB产品经理生存法则 – 人人都是产品经理, 和几位小红书操盘手聊了8小时,干货全在这 – 人人都是产品经理, 智谱GLM-5.1登场,开源模型首超Opus4.6!!! – 人人都是产品经理 Anthropic收入凭什么反超OpenAI,终于有人把这事说清楚了 – 人人都是产品经理, 史上最有故事感的技术报告——Claude最强模型Mythos 7个极其精彩的细节 – 人人都是产品经理, 模型不是壁垒,Harness 也不是 – 人人都是产品经理, 抖音本地生活业务思考21 – 人人都是产品经理, Superpowers:145k Star的AI编码框架,到底是什么来头? Superpowers:145k Star的AI编码框架,到底是什么来头? – 人人都是产品经理, OpenAI 的路走错了,Anthropic Harness 解法启示:模型需要实践专科生 – 人人都是产品经理, 画原型图的前一步:设计站点地图 – 人人都是产品经理, 给 DeepSeek 的最后一封催更信 – 人人都是产品经理, 手把手教你用 Claude Code 搭建 AI 营销团队:5 个 Agent、12 项技能,独立完成研究、写作、设计全流程 – 人人都是产品经理, 你以为大模型在学语言?不,它在重新发明语言学 – 人人都是产品经理 所谓Skill,不过是AI时代的工业垃圾 – 人人都是产品经理, 聊一聊内容传播的几个方法 – 人人都是产品经理, 当平台开始吃掉生态:从 OpenClaw 被封杀,读懂 Anthropic 的这盘棋 – 人人都是产品经理, 你装了 10 个 AI 插件,Obsidian 还是一个文件夹 – 人人都是产品经理 关于AI智能体架构演进的系统性思考:从单体试水到多体协同的重构 – 人人都是产品经理, 当“人”变成Skill,我们又该何去何从? – 人人都是产品经理 Mythos 事件:前沿 AI 治理的意外实验 – 人人都是产品经理, 货代CRM:信用与风险管理怎么做,才能把坏账风险拦在放货之前? – 人人都是产品经理, 从HR收集自拍照到员工自助录入——我见证了园区人脸识别从”不可用”到”真好用”的全过程 – 人人都是产品经理 千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭? – 人人都是产品经理,
AI编程如何挑选合适的大模型?4个阶段+6个建议
饼干哥哥 · 2025-05-04 · via 人人都是产品经理

AI编程时,不同开发阶段对模型要求不同。本文梳理了从构思到发布的四阶段选型要点,并提供六条实用建议,助你高效选型。

你是不是也遇到了这样的烦恼?想用AI帮你写代码、开发个App或者网站,结果发现市面上有这么多AI模型(什么GPT、Claude、Gemini、DeepSeek……),看得眼花缭乱,不知道该选哪个。 随便试了一个,感觉好像有时候挺好用,有时候又“笨笨的”,答非所问,甚至还会“忘记”你之前跟它说过什么。

比方说我自己,之前一直在用Claude3.7,结果最近几个项目发现它又不行了,一些跑了几次都失败的操作,让gemini 2.5,一次就成功了。

从竞争上看,不同公司的大模型不会撞在一起,而是从不同的角度去优化,也就是说每个大模型都有自己擅长的地方。于是就有了今天的主题:AI编程的时候,如何挑选合适的大模型?

你是否也遇到这些烦恼

想象一下,你想开发一个简单的“菜谱查询”APP。

1. 初期构思: 你让AI(比如选了个以代码生成见长的模型)帮你策划APP的核心功能、目标用户、设计风格。结果它给的建议很空泛,甚至有点跑题,因为它可能不太擅长“头脑风暴”和理解商业需求。

2. 写代码: 换了个据说很“聪明”但价格昂贵的模型,让它写具体的代码。它确实写出来了,但速度有点慢,而且对于一些简单的重复性代码,感觉有点“大材小用”,钱包在“滴血”。

3. 回顾检查: 最后你想让AI帮你看看整个项目的代码有没有逻辑问题,或者帮你写使用说明。结果AI看到一半就“断片”了,因为它能“记住”的内容长度(也就是“上下文窗口”)有限,无法一次性理解你整个项目的代码。

是不是感觉哪个模型都不完美?没错!关键在于,没有一个AI模型能在所有开发环节都做到最好。 最好的策略是,在开发的不同阶段,或者针对不同的任务,选择最适合的AI模型。 这就像装修房子,砌墙、刷漆、接电线,你需要用不同的工具,而不是只用一把锤子。

解决方案:如何在不同开发阶段选择AI模型?

让我们以开发一个APP(比如刚才的“菜谱查询”APP)为例,看看在不同阶段该如何选择和使用AI模型:

第一阶段:想法构思与设计(明确“做什么”)

你的目标: 确定APP的核心功能(比如菜谱搜索、分类、收藏、用户评论)、设计风格、目标用户是谁、需要哪些页面等。

需要AI做什么: 需要AI有强大的逻辑推理能力 和广泛的知识 ,能帮你进行头脑风暴,理解你的想法,并给出结构化的建议。

模型推荐:

  • Google Gemini 2.5 Pro: 拥有强大的推理能力和巨大的“记忆力”(上下文窗口),能理解复杂的想法和需求。
  • Anthropic Claude 3.7 Opus (如果可用且预算充足): 通常被认为具有顶尖的推理和理解能力。
  • OpenAI o1 (GPT-4.5): 同样以强大的推理能力著称。
  • DeepSeek R1 (671B): 在规划和推理方面表现出色,性价比高。

成本考量: 这个阶段是打地基,一个好的规划能避免后期大量的修改。 在这里投入选择更强大的模型通常是值得的,可以为你节省后续更多的时间和成本。

第二阶段:动手编码与实现(把想法变代码)

你的目标: 将设计好的功能,一行行地用代码实现出来,构建APP的界面和逻辑。

需要AI做什么: 需要AI擅长理解和生成代码 ,能给出代码建议、解释代码含义、修复简单的错误。

模型推荐:

  • Anthropic Claude 3.7 Sonnet: 被许多开发者认为在代码生成质量和遵循指令方面非常出色,尤其是在与开发工具(如Cline)配合时。
  • OpenAI GPT-4o: 一个强大的全能型选手,代码能力也很强。
  • DeepSeek V3: 代码实现能力接近Sonnet,性价比非常高,适合日常编码工作。
  • Google Gemini 2.5 Pro: 凭借其强大的综合能力和巨大的上下文窗口,在处理复杂的代码库时也很有优势。

成本考量: 对于日常简单的代码补全、或者不太复杂的模块,可以考虑使用性价比更高 的模型,比如 Claude 3.7 Haiku 或 DeepSeek V3 。 把更贵、更强的模型(如Claude 3.7 Sonnet或GPT-4o)留给那些复杂、核心的功能开发。

第三阶段:测试与修复Bug(让APP跑起来不出错)

你的目标: 找出APP里可能存在的各种问题(Bug),比如点击按钮没反应、数据显示错误等,并修复它们。

需要AI做什么: 需要AI能理解代码逻辑,找出可能的边缘情况 (Edge Cases),并帮助编写测试代码或给出修复建议。

模型推荐:

  • Anthropic Claude 3.7 (Sonnet 或 Haiku): Sonnet擅长理解复杂逻辑,Haiku可能足以应对简单的测试用例生成,速度快且成本低。
  • OpenAI GPT-4o (或其 Mini 版本): 同样具备良好的代码理解和生成能力,可以胜任测试任务。

成本考量: 测试代码通常模式比较固定,很多时候中等性能的模型(Mid-tier)就足够了。 对于核心功能的复杂测试场景,再考虑使用更强大的模型。

第四阶段:代码审查与发布准备(最后检查与完善)

你的目标: 在APP上线前,整体回顾一下所有的代码,确保代码风格统一、没有明显的逻辑漏洞,并可能需要编写一些用户文档或说明。

需要AI做什么: 需要AI能处理大量的代码 ,理解整个项目的结构。这时,模型的“记忆力”(上下文窗口大小 )就非常重要了。如果AI能一次性“看完”你所有的代码,那效率会高很多。 有些模型还能理解图片(多模态能力),可以帮你检查UI截图或设计图。

模型推荐:

  • Google Gemini 2.5 Pro: 拥有目前领先的超大上下文窗口(高达200万token),非常适合处理大型代码库的审查和理解。
  • Anthropic Claude 3.7 Sonnet: 也拥有较大的上下文窗口(200K token),适合多数项目的审查。
  • OpenAI GPT-4o: 上下文窗口也相对较大,且具备多模态能力。

成本考量: 虽然拥有大上下文窗口的模型通常更贵,但它们能一次性处理更多信息,避免反复输入和解释,从而节省你的时间 ,尤其在项目后期审查阶段,这种时间节省往往物有所值。

给小白开发者的实用建议:

  1. 理解“上下文窗口” (Context Window): 这就像AI的“短期记忆”(类似电脑内存RAM)。 它决定了AI一次能处理多少信息(你的代码、你的提问、它的回答)。 如果你的项目很大,或者对话很长,超出了这个限制,AI就可能会“忘记”前面的内容。 注意模型提供的上下文窗口大小(单位是Token,可以粗略理解为单词或字符块),比如Gemini 2.5 Pro高达200万,而Claude 3.7 Sonnet是20万。
  2. 从“够用就好”开始: 不一定非要用最贵最强的模型。 可以先试试性价比高的中端模型 (如Claude 3.7 Haiku, DeepSeek V3, Gemini Flash系列),如果发现能力不够,再升级到更强的模型。
  3. 分工合作(如果工具支持): 有些AI编程工具(比如提到的Cline)允许你为“规划”和“执行”设置不同的模型。 你可以用一个擅长思考的模型(如Gemini 2.5 Pro, DeepSeek R1)来做规划,再用一个写代码快又好的模型(如Claude 3.7 Sonnet, DeepSeek V3)来具体写代码。
  4. 多尝试,找到你的“最佳拍档”: 模型排行榜和别人的推荐可以参考,但最终哪个模型最适合你,还需要亲自上手试试 。 可以在不那么重要的任务或者个人小项目上多做实验。
  5. 关注实际效果而非纯粹跑分: 模型的基准测试得分(Benchmark)只是一个参考,它在实际使用中的表现(比如和你使用的工具配合得好不好)更重要。
  6. 暂时别考虑本地模型: 虽然在自己电脑上运行模型听起来很省钱,但目前本地模型的性能和可靠性(尤其是在执行复杂任务和使用工具方面)远不如云端模型,可能会让你更头疼。

本文由人人都是产品经理作者【饼干哥哥】,微信公众号:【饼干哥哥AGI】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图由作者提供