惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

MyScale Blog
MyScale Blog
博客园 - 司徒正美
A
About on SuperTechFans
Vercel News
Vercel News
H
Hackread – Cybersecurity News, Data Breaches, AI and More
爱范儿
爱范儿
I
InfoQ
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
博客园_首页
Google DeepMind News
Google DeepMind News
T
Tailwind CSS Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
F
Fortinet All Blogs
S
SegmentFault 最新的问题
阮一峰的网络日志
阮一峰的网络日志
D
Docker
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
G
Google Developers Blog
Stack Overflow Blog
Stack Overflow Blog
M
MIT News - Artificial intelligence
Jina AI
Jina AI
H
Help Net Security
量子位
IT之家
IT之家

人工智能

暴论:只把 AI 用来提高工作效率,那么你没有在 AI 浪潮中收益 前阵子看到 4 台 MAC 运行万亿参数模型的新闻,当前大致投入在 30 万 RMB 左右,大家预测一下几年后会实现低成本(5W 以下)本地部署万亿参数的模型? 大家有 AI 焦虑吗? ChatGPT 的细节体验是越来越好了,一天一个样! 计划要给行政办公人员做 AI 培训,内容包括指导如何利用 AI 编写小工具应用 Zcode GLM5.2 思考了 5 分钟不出字,只是我一个人问题吗 GLM5.2 有点豆包那味了 ai 对动漫的影响,爱奇艺动漫《都市古医仙》似乎全转 ai 生成了 一个抢 GLM plan 的方法 v2 上面的这种风格的内容总结图是怎么生成的呢? 分享一下我试用过的几款 AI 套餐 AI 写项目就想熵增 中转站,代充值,这种真是避而远之 cursor 的 auto 模式今天突然使用中文思考 怎么系统学习 AI? copilot 用不了了现在用什么 算力远远不够。 现在有哪个国产大模型可以拿来踏踏实实的写代码了吗? 是不是 claude code 没有 hermers 智能啊? 我还以为大模型的训练语料早就覆盖了 zlib 或安娜档案这类的资料库了呢 拍一个 token 自由的短剧咋样,有没有前途 拍一个 token 贬值时代富豪的短剧怎么样? 小米 Mimo MAX 订阅 速蹬 ProofHound - 开源 Prompt 分类任务优化及全生命周期平台 如果问各大 AI,谁被网友们称作畜生 AI 公司公司…… AI 真是太恶心了,本来指望他攻克癌症、可控核聚变等真正造福人类的事情,结果弄个大语言模型淘汰人类脑力工作 为什么进入 aistudio 后 gpu 狂转 [开源免费] 实时数字人 OpenTalking 项目演示 用 ai 把各大平台的创作声明弹窗自动化了,顺带支持 CLI 和 MCP 现在 20260516,各行各业,真的有很多人用 cc/codex 来重构自己的工作流吗?
Qwen3.6 MTP GGUF 发布:本地推理 1.4-2.2 倍加速
Fdyo · 2026-05-19 · via 人工智能

Unsloth 团队为 Qwen3.6 发布了 MTP ( Multi Token Prediction ) GGUF 量化版本,可 Qwen3.6 的本地推理速度提升 1.4-2.2 倍,精度无任何损失。

Qwen3.6 MTP GGUF

除 Qwen3.6 外,Unsloth 这次还回溯发布了 Qwen3.5 系列的 MTP GGUF ,覆盖 0.8B 、2B 、4B 、9B 、27B 、35B-A3B 、122B-A10B 、397B-A17B 全家族。这意味着已经在用 Qwen3.5 系列做本地推理的开发者可以直接迁到 MTP 版本而不换模型。

原文:Qwen3.6 MTP GGUF 发布:本地推理 1.4-2.2 倍加速,精度无损