惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Stack Overflow Blog
Stack Overflow Blog
Vercel News
Vercel News
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
J
Java Code Geeks
M
MIT News - Artificial intelligence
Microsoft Azure Blog
Microsoft Azure Blog
B
Blog RSS Feed
MongoDB | Blog
MongoDB | Blog
G
Google Developers Blog
Engineering at Meta
Engineering at Meta
量子位
S
SegmentFault 最新的问题
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
A
About on SuperTechFans
P
Proofpoint News Feed
Last Week in AI
Last Week in AI
Recent Announcements
Recent Announcements
腾讯CDC
I
InfoQ
F
Fortinet All Blogs
Hugging Face - Blog
Hugging Face - Blog
Blog — PlanetScale
Blog — PlanetScale
H
Help Net Security
爱范儿
爱范儿

LINUX DO - 最新话题

谷歌云盘下载700g数据集,求方法 OpenAI推出了100美元的Pro订阅后,plus的Codex 5小时限额大幅缩水 之前买的super grok居然还没掉 关于CPA认证文件周限 佬们,默认CDK的要求是什么等级啊? 最新版本的微信群聊机器人方案 有没有人知道如何free号没有封,那么是否可以循环使用,因为我看主要是周限 L站改版了?吓我一跳,我以为我浏览器崩了 淘宝这种宽带可信吗,500兆移动宽带月费8元到2099年 docker内部应用访问宿主机mysql和redis时被拒绝connection refuse Erp全栈想转行做Ai有什么推荐的吗 boost有bug 佬们,有没有靠谱点的 Plus 购买渠道 大妈,狗妈用的 lg 服务有源头开源项目吗? 有人有能过验证码打码的嘛 上次帖里好像发过通过大模型来打码的 gpt plus 封号似乎也太快了点,一天就给封号了 按流量/token收费的国产官方AI推荐 我算是知道了为什么Oracle总是ABC了 佬友们帮我分析一下 ChatGPT Team账号只有一个人使用和4个席位邀请满了使用的总额度是一样的吗? gpt-free 10个带rt CPA反代claude是默认1m吗? 我终于敢说我做出来windows上tmux的替代了,目标windows/全平台最强的终端Ai编程工具 claude pro升级max,除了原来的$20,好像还能再领一次$100 关于AI agent的知识框架 独乐乐不如众乐乐,分享一下我的的AI对话程序 佬们自建网站支付问题是怎么解决的 怎么能让gpt模仿claude风格输出 codex free已经死了,下一个会是plus或者team吗 请问chatgpt pro里的fast模式,速度快了,降智吗
想请教下大家各模型的实际使用体验?
kernelbit686 (hello world) · 2026-05-29 · via LINUX DO - 最新话题

1

大家平时vibe coding都用什么模型呢?来分享下使用体验吧?参考应用市场那样从以下维度给模型的各维度评分?(满分5分)可以不必一次评价完所有维度,挑选自己有印象维度的即可。
评价维度(可补充,楼主会加入):
任务完成度(模型是否习惯在未完成任务时宣称已经完成或者非必要提前停止?)
代码质量
命令服从性
幻觉程度
主观使用体验
上下文窗口可用性
前端美观度(指模型产出的前端,并非模型的客户端前端评价)

sertreet (sertreet) 3

:thinking:个人感觉还是claude最强,我网页版用的比较多

kernelbit686 (hello world) 4

确实,网页版能调用一些闭源的skill、mcp、工具,能力上确实会强上不少,不过,请问opus4.6
4.7、4.8在你实际使用时差距大吗?算反向升级吗?

moli721 (陌灬离) 5

claude废话比GPT少多了,用着舒服多了

fengtang (wycsbgm) 6

D老师+chatgpt基本够用了,我做的难度没那么大,D老师主要比较没道德,不需要什么破限这类。

gpt 5.4 / 5.5
opus 4.6 / 4.7 / 4.8 (有就用)
gemini 3.5 flash
gemini 3.1 pro

跟上个月一样没啥变化

kernelbit686 (hello world) 8

楼主说下自己的使用体验:
minimax很便宜,楼主图量大买了minimax年卡,但是minimax总是提前终止未完成的任务,这点官方docs还是blog提到过,代码质量不太行,上下文也小。
目前转到deepseek-v4-pro也不太行,比minimax强是肯定的,但总是“宣称完成”一个功能就直接停止任务,而不是真正完成了一个功能再停止,我每次让deepseek-v4-pro复查或者让GPT-5.5复查都会发现这类问题。
关于deepseek-v4-pro的上下文,引用楼主朋友的说法:“如果噪声太大,deepseek v4 pro 1m上下文的效果也不咋样,最后200k就开始说胡话,我觉得完全可以给它的buffer留到400k,写代码当agent大概只有768k可用吧”。

sertreet (sertreet) 9

:rofl:没这么富有,我就白嫖他默认的4.6,多问几句就不让我问了,过段时间才能刷新,我觉得挺好的,逼迫我仔细思考,怎么进行下一步,而不是那种浮躁的,一心就想让ai一下把活干完,天天对着ai许愿。当然也跟我的工作性质相关,偏技术研发创造新东西,而不是已有的项目开发实现。