惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

WordPress大学
WordPress大学
M
MIT News - Artificial intelligence
MyScale Blog
MyScale Blog
博客园_首页
G
Google Developers Blog
博客园 - 【当耐特】
美团技术团队
博客园 - 聂微东
Stack Overflow Blog
Stack Overflow Blog
Vercel News
Vercel News
小众软件
小众软件
博客园 - 司徒正美
雷峰网
雷峰网
T
Tailwind CSS Blog
V
V2EX
博客园 - 三生石上(FineUI控件)
F
Fortinet All Blogs
罗磊的独立博客
量子位
P
Proofpoint News Feed
Microsoft Azure Blog
Microsoft Azure Blog
月光博客
月光博客
A
About on SuperTechFans
Hugging Face - Blog
Hugging Face - Blog

少数派

派早报:Google 发布 Fitbit Air 等 - 少数派 「新人报到」確認需求,再開始 - 少数派 从 SOLO 独立开发者社区,我看到了越来越多开发者开始做自己的产品 - 少数派 我怎么管理那些"不常做,但总会忘"的生活事项 - 少数派 人形机器人量产元年,数据才是具身智能的“生死线” - 少数派 BuhoLaunchpad 高度还原 Mac 启动台:开发历程与思考 - 少数派 五年陪伴依然不舍,DIY 换壳后让罗技 MX Master 3 继续服役 - 少数派 新玩意 240|少数派的编辑们最近买了啥? - 少数派 一日一技|为什么你应该关闭 iOS 的键盘声音 - 少数派 我做了个插件和 Skills,一键提取任何网站的设计规范 Design.md - 少数派 住在三四线城市的你,该开始录播客了 - 少数派 甘南秘境,大白高国 - 少数派 AI的审美:谁让把我变成川内倫子 - 少数派 返工怎能不烦恼,打工人片单总有一部是你的「嘴替」 - 少数派 为了让「上厕所」更健康,我做了一个小工具 - 少数派 AI + Skill,能够让生成的文章去除 AI 味吗? - 少数派 新玩意|韶音OpenDots ONE 耳夹式耳机 - 少数派 《美满》| 在每一个春天的晚上相爱(362) - 少数派 新玩意|优篮子 PS01 MagSnap 磁吸支架 - 少数派 自我整合手记 | 我开始早睡了:用稳定规则,为自由托底 - 少数派 用龙虾(OpenClaw)两个多月,我最深的12个体会 - 少数派 听歌时间到,12 张你可能错过的 2025 华语乐坛好专辑 - 少数派 承诺能追吗 - 少数派 macOS 26启动台没了? 我做了个不一样的App启动器 - Keboard - 少数派 《四海为家的人》| INTJ对话INTJ(361) - 少数派 你发过的那些黑历史,是时候一次清干净了 - 少数派 新玩意:安安静静玩,越玩越专注:计客密码机 - 少数派 iPad 用户首次体验 Android 平板:vivo Pad6 Pro - 少数派 数据逻辑强 - 少数派 极北行+ | 一路向北,探访日本至北之地 | 001 - 少数派
Deepseek V3.1官宣之后的新变化 - 少数派
2025-08-21 · via 少数派

大家好,我是阑梦清川

DeepseekV3.1官宣了,新版本的DK有什么变化呢,我最近也是刷了很多的文章,给大家梳理一下,让你快速的理解新变化;

其实混合推理说的就是这个支持思考模式和非思考的模式:如下所示,一个需要进行内部的推理,一个可以直接告诉大家结果;

之前的时候,都是要么使用思考模式干到底,要么使用非思考模式干到底,所以这个效果并不是非常的明显;

现在的这个混合推理,可以在两个模式之间进行切换,根据不同的场景和条件选择不同的模式,节省资源,性价比高,而且效果显著;

image-20250821170930709

2.无缝对接cc框架

官方直接支持了Anthropic公司提供的API的格式。也就是说,你可以直接把这个对接到类似于claude code这类框架里面去,对于cc开发者而言其实还是非常方便的;

3.分词器和对话模版的修改

分词器就是针对于我们的输入进行拆分,不同的Tokenizer(分词器)会决定我们的输入被如何拆分,以及消耗token的数量;

分词器的大改意味着 模型底层的“读写语言方式”有了很大升级,可能会带来 更低的 token 消耗更准确的文本处理

对话模版:在和模型对话时,输入的内容并不是原封不动送进去,而是会套一个“模板”来标记角色和格式。

例如我们看到的对话是下面的这个样子的:

User: 你好
Assistant: 你好,有什么可以帮你?

实际上大模型内部的这个样子的:

[
{"role": "system", "content": "你是一个友好的助手"},
{"role": "user", "content": "你好"},
{"role": "assistant", "content": "你好,有什么可以帮你?"}
]

因此,我们可以发现这个对话模版的修改就可以统一标准,进行不同格式的兼容,多角色之间对话也可以确保这个准确性,以及这个内容的结构化的输出;

4.API的升级

deepseek-chat对应上面提到的非思考模式,

deepseek-reasoner对应思考模式;

上下文的数量都支持128K,提升问答的效果;

函数调用支strict模式,这样可以保证我们的模型调用的参数严格符合这个预定义的格式和结构,例如下面的这个例子;

没有升级之前,可能是这个样子的:

{
"city": "北京",
"date": "明天"   // <-- 本来要求标准日期格式,AI却写成了自然语言
}

这个生成的日期格式可能并不是我们想要的或者是我们要求的;

升级之后,可能是下面的这个样子的:

{
  "name": "get_weather",
  "parameters": {
  "type": "object",
  "properties": {
   "city": {"type": "string"},
   "date": {"type": "string", "format": "date"} 
  },
  "required": ["city", "date"]
  }
}

这个就是要求的格式,大模型必须严格的按照这个格式进行输出,不像之前那样随意,这个相当于就是对于我们的参数的格式提出了更加严格的要求,毕竟这个strict就是严格的意思嘛

5.API的涨价

这个就是等量的tokens现在需要的金额是之前的1.5-2倍,但是目前还没有落实到底,所以目前的价格还是不变的;

6.审美能力提升

很多大佬针对于这个V3.1的审美进行测试,觉得效果还不错,大家可以去尝试一下,或许真的会有想不到的结果;

以上就是一些梳理,可以见得,我们的国产大模型,哪个曾经在春节期间热度爆棚的deepseek,还是在悄悄进步的,可能不是那么显著罢了;

我创建了一个免费的AI交流社群,不定期分享一些内容,如果你也感兴趣,欢迎加入

image-20250820225129353

我是阑梦清川,希望得到您的关注