惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Vercel News
Vercel News
博客园 - 【当耐特】
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
小众软件
小众软件
Hugging Face - Blog
Hugging Face - Blog
aimingoo的专栏
aimingoo的专栏
WordPress大学
WordPress大学
G
Google Developers Blog
博客园 - 叶小钗
大猫的无限游戏
大猫的无限游戏
P
Proofpoint News Feed
J
Java Code Geeks
U
Unit 42
云风的 BLOG
云风的 BLOG
阮一峰的网络日志
阮一峰的网络日志
N
Netflix TechBlog - Medium
宝玉的分享
宝玉的分享
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
D
Docker
V
Visual Studio Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
H
Help Net Security
V
V2EX
T
Tailwind CSS Blog

博客园 - 见路非道

Lumera 深度解读(2026):从一张图片到 Blender 可编辑 3D 场景——image to 3d 与 image to blender 全解析 Qwen3.8-Flash-Next(2026):Qwen Qwen4 预览版架构模型完整指南 Qwen3.8-27B(2026):Qwen 新 27B 视觉语言模型完整指南 DeepSeek Harness Agent Loop 2026:驱动每一轮对话的可替换插件内部解析 DeepSeek Harness 2026:一切皆插件 — 开发者预览版完全指南 awesome design md(2026):Google DESIGN.md 精选集完整指南 DeepSeek V4 Pro 0813 完全指南(2026):价格、基准测试与 Fable 5 对比 2026 完整指南:生命路径计算器(Life Path Calculator)的每个数字到底意味着什么 Qwen 3.8 Max vs GLM 5.2 vs Kimi K3 vs DeepSeek V4 Flash(2026年):国产大模型四强全面对比 Love Meter 2026 完全指南:Lovemeter.xyz 的免费与付费功能,以及 Love Oracle 的神奇之处 Unlimited OCR(百度无限制 OCR)2026 完整指南:单次前向传播解析数十页文档的开源模型 Kimi K3 vs GLM 5.2 (2026年):中国两大开源旗舰大模型终极对比 PDF 转 Markdown 工具如何把复杂 PDF 变成干净的 Markdown:2026 年完整指南 如何使用 Garden Letters:2026 年 AI、音乐与私密分享的花信创作完整指南 Flag Tone:如何匹配旗子条纹颜色(2026完整指南) Mog Omegle 2026 完全指南:如何运行一场 AI PSL 颜值对比 Toon Tone:用更简洁、更易分享的色彩匹配游戏练习色彩记忆 CurateClick 2026年4月每周精选:发现、访问与创意AI Hy-MT1.5-1.8B-2bit:腾讯开源 574MB 能打败 72B 巨人的移动端翻译模型 SBTI 和 SBTI Skill 完全指南:Claude 驱动的超大型人格测试 Happy Horse:重新定义2026年AI视频生成的最强模型 OpenClaw Dreaming 完全指南 2026:AI 代理的后台记忆整合 Qwen3.6-Plus:阿里低调憋大招,百万Token上下文企业级AI旗舰发布 CurateClick 应用推荐(2026年3月22日版) 2026年完全指南:OpenClaw LCM 插件 — 再也不会丢失任何对话 ACE-Step 1.5:2026年开源AI音乐生成完全指南 用 OpenClaw 构建 CBT 疗法 Agent — 2026 年完整指南 Claude Code Telegram 官方插件:完整配置指南 2026 小米 MiMo-V2 系列完全指南 2026:Pro/Omni/TTS 三大模型全面解读 MiroThinker-1.7:改变深度研究的新一代SOTA开源AI研究代理
Qwen3.6-35B-A3B 全面评测:阿里开源模型如何超越前沿级水平
见路非道 · 2026-04-17 · via 博客园 - 见路非道

Qwen3.6-35B-A3B 全面评测:阿里开源模型如何超越前沿级水平

TL;DR

  • Qwen3.6-35B-A3B 是阿里 Qwen 团队2026年4月16日发布的最新开源模型,采用稀疏 MoE 架构,35B 总参数但每 token 仅激活 3B
  • Apache 2.0 许可证,完全开源可商用
  • 在 Terminal-Bench 2.0 得分 51.5(vs Gemma4-31B 的 42.9),SWE-bench Verified 得分 73.4,击败 Claude Sonnet 4.5
  • 支持 262,144 token 上下文,专为代理编程(Agentic Coding)优化
  • 24GB Mac 可通过 GGUF 量化运行

Qwen3.6-35B-A3B 是什么?

Qwen3.6-35B-A3B 是阿里巴巴 Qwen 团队发布的最新开源模型,2026年4月16日正式上线。该模型专为代理编程(agentic coding)和仓库级代码推理设计。

模型名称解读: - 35B — 总参数数量(MoE 稀疏架构) - A3B — 每 token 仅激活 3B 参数,极大降低推理成本

这是典型的稀疏 MoE(Mixture-of-Experts) 架构——每个 token 只会激活少数「专家」模块的神经元,大部分参数处于休眠状态。结果:用 1/10 的推理算力,达到接近顶级dense模型的能力。

Apache 2.0 — 真开源

不同于很多「伪开源」模型,Qwen3.6-35B-A3B 采用 Apache 2.0 许可证: - ✅ 商用免费 - ✅ 无版税 - ✅ 可修改和再分发 - ✅ 包含专利授权


基准测试表现

Qwen3.6-35B-A3B 在多项基准测试中表现出色:

基准测试 Qwen3.6-35B-A3B Gemma4-31B Claude Sonnet 4.5
Terminal-Bench 2.0 51.5 42.9
SWE-bench Pro 49.5 35.7
SWE-bench Verified 73.4
RealWorldQA 85.3 70.3

Terminal-Bench 2.0(代理式终端编程)得分 51.5,比 Gemma4-31B(42.9)高出 20%

SWE-bench Pro(真实 GitHub 仓库的软件工程能力)得分 49.5,比 Gemma4-31B(35.7)高出 38%

RealWorldQA(真实世界多模态理解)得分 85.3,击败 Claude Sonnet 4.5(70.3)21%


代理编程能力

Qwen3.6-35B-A3B 的核心设计目标就是代理编程

  1. 大型仓库导航 — 理解项目结构、依赖、架构
  2. 多文件多语言代码编写与修改
  3. 命令执行 — 运行测试、构建系统、操作终端
  4. 工具调用 — 与 IDE(Continue.dev、Cursor)、API、CICD 系统集成

思维模式保留

Qwen3.6 的核心创新是思维模式保留——在多步骤代理工作流中保持完整推理上下文。这意味着: - 决策一致性更强 - 减少重复推理,节省 token - 在思考/非思考模式间优化 KV 缓存利用率

262,144 token 上下文

262,144 token 的超长上下文让 Qwen3.6 可以: - 单次输入完整处理中大型代码仓库 - 跨数千行代码保持首尾一致的理解 - 对文件间依赖和架构模式进行推理


如何本地运行

Ollama(最简单)

brew install ollama
ollama run qwen3.6:35b-a3b

Unsloth GGUF(Mac 推荐)

通过 4-bit 量化,24GB 内存的 Mac M3 Max 也能流畅运行。完整 F16 模型需要约 72GB,但 4-bit 量化后仅需 ~18-20GB VRAM。

SGLang(生产级)

python -m sglang.launch_server \
    --model-path Qwen/Qwen3.6-35B-A3B \
    --port 8000 --tp-size 8 \
    --context-length 262144

获取渠道

平台 链接
Hugging Face Qwen/Qwen3.6-35B-A3B
Ollama ollama run qwen3.6:35b-a3b
Unsloth GGUF unsloth/Qwen3.6-35B-A3B-GGUF
Qwen Studio https://qwen.ai

总结

Qwen3.6-35B-A3B 代表着开源 AI 的分水岭时刻——首次,开发者可以在本地运行一个: - 3B 激活参数 + 35B 总参数的稀疏 MoE 模型 - Gemma4-31B 代理编程能力 +20% - SOTA 级别编程基准测试表现 - 24GB Mac 可运行的本地部署 - Apache 2.0 完全开源可商用

原文链接: Qwen3.6-35B-A3B Complete Review