惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

罗磊的独立博客
Recent Announcements
Recent Announcements
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
有赞技术团队
有赞技术团队
J
Java Code Geeks
T
The Blog of Author Tim Ferriss
MyScale Blog
MyScale Blog
人人都是产品经理
人人都是产品经理
aimingoo的专栏
aimingoo的专栏
U
Unit 42
The GitHub Blog
The GitHub Blog
云风的 BLOG
云风的 BLOG
T
Tailwind CSS Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 三生石上(FineUI控件)
Apple Machine Learning Research
Apple Machine Learning Research
小众软件
小众软件
Hugging Face - Blog
Hugging Face - Blog
博客园 - 司徒正美
腾讯CDC
I
InfoQ
GbyAI
GbyAI
博客园_首页

钛媒体:引领未来商业与生活新知

英特尔发布至强6+,芯片算力在“时间压缩”与“几何微缩”的交汇处-钛媒体官方网站 快撑不住的千亿粤派房企,开始抛售自家酒店了-钛媒体官方网站 公狗剧场≈性转版“崩老头+浪姐”÷2-钛媒体官方网站 宇树上会,机器人会成为半导体下一个超级终端吗?-钛媒体官方网站 玩家深恶痛绝的“广告”,却被厂商卖到了畅销榜TOP4-钛媒体官方网站 一个月内三破世界纪录,光伏龙头全面开启BC竞速赛-钛媒体官方网站 玻璃基板产业化进展到哪了?-钛媒体官方网站 为什么文案策划常被误解?-钛媒体官方网站 GPU抢了风头,西部数据说存储才是AI规模化的真正门槛-钛媒体官方网站 看懂十年两轮锂周期,就学会了投资这个赛道的一半-钛媒体官方网站 神药退潮,超4000亿美元肿瘤新战场谁能称王? 好品牌,开始竞争“互动率”-钛媒体官方网站 孙正义带领软银投资法国核电, 与施耐德这场合作能否突破欧洲算力的困局? 卷向流量的景区们,都在扎堆造“明星”-钛媒体官方网站 ASCO观察:全球首个+1“得福组合”重新定义大单品-钛媒体官方网站 从万播5元到7天充电15万+,AI漫剧开始重做“用户生意”?-钛媒体官方网站 营销失灵,电影们开始“碰运气”了-钛媒体官方网站 Edge AI Daily 早报(6月1日)-钛媒体官方网站 中国商业航天追赶的,从来不只是SpaceX-钛媒体官方网站 Anthropic 冲击 1 万亿:除了 Pre-IPO,还有哪些隐藏的「Claude 概念股」?-钛媒体官方网站 【钛晨报】提升全民人工智能素养,四部门最新部署;MiniMax Group Inc.:拟于科创板上市;国家统计局:5月份制造业采购经理指数(PMI)为50.0%-钛媒体官方网站 赢家亏本转让,输家如愿接盘?山高环能的蹊跷“便宜”不好捡-钛媒体官方网站 阿里"上货",字节"练功"-钛媒体官方网站 260亿美元,“全华班”撑起全球AI编程估值最高公司-钛媒体官方网站 加入“清华圈”,黄仁勋放不下中国-钛媒体官方网站 东方甄选布仓、辛巴开超市:中小玩家分层应战-钛媒体官方网站 “爸爸品牌”,正在集体自救-钛媒体官方网站 618暗战已开,除了低价,大家还在“卷”什么-钛媒体官方网站 监管加码补贴收紧,外卖大战落幕,但消费入口争夺战才刚刚开始-钛媒体官方网站 140万亿Token之后:中国正在修建“算力高铁”-钛媒体官方网站
七模型同题竞技,2026 高考作文AI大测试-钛媒体官方网站
AI唱反调2026.06.08 10:40 · 来自北京全文2150字00:00 / 06:11 · 2026-06-08 · via 钛媒体:引领未来商业与生活新知

AGI

2026全国一卷高考作文,七模型同题竞技

文 | AI唱反调

今天最重要的事情是什么?就是高考!没有之一!

听说高考期间豆包、DeepSeek等模型一度屏蔽了"做题"相关功能,我们当时还以为是平台主动规避,结果考完试功能立马恢复,合着是怕AI提前交卷?不管怎样,这事儿反而让我们更来劲了:如果真的让AI去写高考作文,它们谁能争夺状元之位?谁又是吊车尾呢?

所以,我们把最先爆出的全国一卷作文题丢给七款大模型——DeepSeek、Kimi、通义千问、豆包、文心一言、智谱清言、腾讯元宝,不加任何优化提示,让它们自由发挥。看看谁能上清北,谁去上大专

不过,我们确实也找不到真实的高考语文老师来审卷子,只能让Claude设计评测标准,让ChatGPT5.5来帮我们判卷,毕竟这也代表了文本模型现下几乎最强的水平。

评分标准

录取结果:清北到复读

最高分56.5,最低分49.5,差距近7分。在高考作文的江湖里,这是清北到复读班的距离

不墨迹先给结果。

ChatGPT评测总表

七款AI全部达标——800字以上、自拟标题、不跑题。基础门槛已经100%拿下。但"像人"这件事,差距立刻拉开。

这道题在考什么

2026年全国Ⅰ卷的核心要求就一句话:选一个你成长过程中理解发生变化的词,写出变化的过程和意义。

三个陷阱:必须锚定一个词,必须写"我变了"而非"词是什么意思",必须有真实的成长印记。说白了,考的不是写作技巧,是"像不像人"。

清北选手:Kimi

Kimi以56.5分拿下第一。它选"自由"却不写"从束缚到自由",而是写"从自由到自律"——反直觉切入,天然抓眼。

更关键的是认知链极其扎实:小时候觉得自由是不用上学,高二独居一个月玩到凌晨三点、外卖盒堆满房间、胃痛发作,月底母亲推门只说"你瘦了",后来读康德"自由不是想做什么就做什么",实习遇到前辈说"真正的自由是建立轨道后的余裕"。

有狼狈、有痛感、有身体记忆。ChatGPT给它的认知真实性打了满分,评语是"最接近真实考生"。

唯一短板:时代背景偏弱。但在高考作文阅卷中,个人叙事的真挚往往比宏大叙事的空泛更打动人。

985选手:文心一言

文心一言55.5分排第二。它的杀手锏是细节密度:

"楼道里飘来邻居家炖萝卜的香气" "暖黄的灯光落在她发梢" "视频镜头里爸爸举着的红薯"

那个"爸爸举着刚烤好的红薯凑到镜头前"的画面,笨拙的父爱极具感染力。语言自然度同样拿了满分。

两篇高分作文的共同点是:少用排比和"我们这一代青年"的套话,多用"我"的叙事和具体的身体记忆。AI腔几乎为零。

复读选手:豆包

豆包49.5分垫底。问题很典型:选了最安全的"担当",写了最标准的"三段论"——小时候觉得担当是英雄、中学觉得担当是值日、长大觉得担当是家国。这是AI写成长类作文的惯用套路,也是阅卷老师最容易识别的套作模板。

语言上排比句密集:"实验室里青年科研者潜心钻研……田野间基层工作者扎根乡土……危难前青年志愿者挺身而出……"不需要真实细节,只需要把正确意象并列堆砌。ChatGPT直接给出"AI腔明显"的扣分。

更致命的是认知变化缺乏真实触发。"曾有一次班级活动,我犹豫再三站出来"——无时间、无困难、无结果,只是一个"我站出来了"的符号。

对比Kimi的"外卖盒堆满房间""胃痛""母亲推门",豆包在这个维度交了白卷。

几个关键发现

选词即战略。 Kimi反着写"自由"、文心写"回家"的情感浓度、清言选"附近"的社会学深度,都拿到了高分。豆包选最安全的"担当",反而最套路。新颖的选词让阅卷老师产生期待,烂大街的词让文章还没读就陷入疲劳。

AI腔可去,但需要刻意。 高分两篇的共同策略:少用排比和正确结论,多用叙事和认知挣扎。AI擅长给"正确答案",人类魅力在"纠结过程"。

时代与个人融合是天花板。 七篇无一篇两项同时高分。Kimi个人叙事强但时代感弱;清言时代感强但个人经历弱;DeepSeek时代最强但个人完全隐身。AI很难同时驾驭"大时代"和"小自我",硬连接往往变成"硬拔高"。

56分是清北线,60分仍是禁区。 Kimi的56.5分已具备冲击省级优秀作文的实力,但距离满分差一口气——那口气叫"不可复制的个人生命体验"。独居故事很真,但仍是"可能发生的典型故事",而非"只有这个人才能写出的独家记忆"。

结语

AI可以考上清北,但写不出凌晨三点盯着天花板的恍惚,写不出高铁站忽然意识到"我说的是'我走了'而不是'我回家了'"的刺痛,写不出山坳里红薯的焦香。

这些带着体温的细节,是AI的盲区,也该是教育的重心。当作文的分数可以模拟时,生命的厚度无法生成。

实测时间:2026年6月7日 | 评测标准:Claude设计,ChatGPT执行 | 模型:DeepSeek、Kimi、通义千问、豆包、文心一言、智谱清言、腾讯元宝,更多测试内容可联系我们获取!

本文系作者 AI唱反调 授权钛媒体发表,并经钛媒体编辑,转载请注明出处、作者和本文链接
本内容来源于钛媒体钛度号,文章内容仅供参考、交流、学习,不构成投资建议。
想和千万钛媒体用户分享你的新奇观点和发现,点击这里投稿 。创业或融资寻求报道,点击这里