惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

J
Java Code Geeks
F
Fortinet All Blogs
云风的 BLOG
云风的 BLOG
MyScale Blog
MyScale Blog
D
DataBreaches.Net
Stack Overflow Blog
Stack Overflow Blog
A
About on SuperTechFans
Google DeepMind News
Google DeepMind News
Microsoft Security Blog
Microsoft Security Blog
腾讯CDC
The GitHub Blog
The GitHub Blog
Jina AI
Jina AI
B
Blog RSS Feed
I
InfoQ
N
Netflix TechBlog - Medium
T
The Blog of Author Tim Ferriss
Microsoft Azure Blog
Microsoft Azure Blog
Recent Announcements
Recent Announcements
GbyAI
GbyAI
H
Help Net Security
L
LangChain Blog
M
MIT News - Artificial intelligence
Y
Y Combinator Blog
aimingoo的专栏
aimingoo的专栏

量子位

AI自主监测宠物健康,陪狗都不用自己来了!涂鸦Hey Tuya打造全屋智能“超级入口” 燃油SUV车主熬出头了!华为乾崑智驾加持,全新奥迪Q5L率先实现智能化 华人再破硅谷天花板!AI黑马新任CTO,中科大80后 0博士组合拿下ICLR时间检验奖!两个GPT天才本科生+二本逆袭LeCun弟子,十年论文终封神 DeepSeek V4报告太详尽了!484天换代之路全公开 优必选发布Thinker cosmos:加码开发者生态,推动人形机器人走向规模化 DeepSeek-V4发布,华为云首发适配 Mobileye 2026财年一季度营收增长27%,自动驾驶商业化进程持续推进 100%主流车企的共同选择:一个AI“通用底座”正在汽车行业成型 真有人做AI小猫啊?!生产力和情绪价值都拉满了 Coordination Engineering关键一环,JiuwenClaw再发布Team Skills技能新范式 DeepSeek V4终于发布!打破最强闭源垄断,明确携手华为芯片 荣耀WIN游戏本等多款新品正式发布,荣耀PC家族全面爆发 刚刚,GPT-5.5发布!内测英伟达工程师:失去它像被截肢 河南师傅,左手扳手,右手飞书,竟然能搞数据分析! 国内首家百亿估值纯推理GPU独角兽诞生!专访曦望联席CEO王湛:谁的推理成本更低谁就是赢家 印奇站上AI+车浪潮之巅:7个月,千里科技和华为「五五开」 飞书项目开放平台焕新升级,全面迈向“AI Friendly” 半壁华人!GPT Image 2团队曝光:无锡才俊带队,13人4个月封神 Nature封面:机器人乒乓球干翻人类职业选手 特斯拉开源硬件,中国公司回应来了:直接把机器人大脑开源了 挖漏洞何必Mythos,国产智能体早跑通了 “不造车的特斯拉”亮出“舱驾一体”全家桶,汽车长出“主动理解力”,奇瑞比亚迪等10+巨头力挺 科大讯飞发布燎原N30m笔记本,重塑全栈国产AIPC新标杆 神秘模型「大象」:仅100B拿下SOTA,Token效率超高! 香港科创标杆奖项!商汤首席科学家林达华荣获中银香港科创奖 国产多模态Agent拿下医学分割SOTA!不用改模型、不加token 这些人读个博一年能挣几十万?2026苹果学者名单公布了 大厂AI抢人大战,从实习生开始 全球首个世界统一模型发布,机器人家庭成员来了!
算苗3D TokenPU正式流片 引领国产AI云端大算力芯片再升级
量子位的朋友们 · 2026-06-17 · via 量子位

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

2026-06-17 18:16:03 来源:量子位

本文由算苗科技提供,量子位获授权转载,版权归原作者所有

中国北京(2026617日) — 专注3D架构AI云端大算力芯片研发设计的算苗科技今日宣布,旗下面向大模型推理的3D TokenPU芯片A4E已于6月15日正式流片,标志着中国在高端AI算力芯片领域,实现依托国产供应链、采用3D混合堆叠架构的大模型专用处理器落地,有望为国内大模型产业提供自主可控、高性能、高性价比的算力支撑。

大模型时代原生设计 专注推理能效比

当前,AI产业正加速由训练向推理迁移。德勤预测,未来超80%的算力需求将集中在推理侧。然而,大模型推理长期受制于“内存墙、算力墙、通信墙”三大核心瓶颈,尤其是数据在存储器与处理器之间的频繁搬运,造成高达80%的能耗和70%的成本压力。

作为大模型时代原生的算力芯片企业,算苗科技首创3D TokenPU架构,跳出通用GPU的设计思路,专攻推理场景极致性能。第一代产品A4E将8层存储晶圆垂直堆叠在计算逻辑晶圆上,通过硅通孔(TSV)与凸点(bump)技术实现微米级互联,将传统芯片间的“毫米级”传输距离压缩两个数量级,带来16TB/s的超大访存带宽,有效缓解数据饥饿问题。

在架构设计方面,算苗科技引入Tile-Native​软硬件协同理念,将Tile作为数据搬运、存储和计算的基本单元,实现“一次搬运、多次复用”的高效模式。硬件原生支持Tile级数据调度与多精度动态切换,软件端则构建适配LLVM、Triton等开源生态的编译工具栈,兼顾开发者友好性与算子优化效率。这种“硬件架构-软件工具-算法特性”的闭环优化,为大模型推理提供了更高性能和更低TCO(总拥有成本)。

“我们不是在别人的赛道上追赶,而是在开辟新的方向。”算苗科技创始人兼CEO汪福全博士表示,“3D TokenPU专为大模型Token处理而生,不必单纯依赖制程缩小,就能实现算力密度、能效比的跨越式提升。”

从设计到制造自主可控 面向量产

算苗科技已构建起覆盖芯片设计、核心IP、制造、封装的国产化供应链体系。A4E芯片基于自研RISC-V架构与自研IP、自研软件体系打造,与国内头部供应链伙伴深度合作,采用成熟国产工艺也可实现卓越推理性能。在工程化量产层面,算苗团队核心成员已在高通量存算一体芯片项目中,完成万片级3D混合堆叠晶圆的量产,是全球少数掌握该技术的团队之一。同时,公司构建了高精尖人才梯队,研发人员占比超80%,核心骨干来自中科院、清华、北大等顶尖院校,兼具深厚的半导体工程化落地与AI前沿算法研究能力。

携手客户 深耕千亿级推理市场

当前全球大模型推理市场已迈入千亿美金规模,中国市场也达到数千亿人民币规模。算苗3D TokenPU的核心客户为头部大模型厂商,目前已联手客户开展近一年的深度研发工作;从芯片定义阶段便锚定真实推理场景需求,针对性完成架构与底层算法深度调优,实现AI算力和大模型算法的极致匹配。

算苗3D TokenPU 大算力芯片的技术路线与产业化潜力,也获得了资本市场的高度认可。公司已先后完成多轮融资,投资方覆盖国资平台、头部市场化基金与一线产业资本,包括国开金融、北京顺禧、源码资本、石溪资本、联想创投、襄禾资本等。

关于算苗科技(SUNMMIO

算苗科技SUNMMIO是大模型时代原生的芯片企业,为3D TokenPU概念首创者,专注3D架构AI云端大算力芯片的研发,团队核心成员拥有全球领先的3D混合堆叠晶圆量产能力。公司依托国产供应链与成熟制程,以3D堆叠+Tile-Native软硬件协同创新,突破AI算力墙、内存墙、通信墙三大瓶颈,打造高带宽、高性能、高性价比解决方案,助力国产算力产业跃迁与全球化发展。欲了解更多信息,请访问:www.sunmmio.com

版权所有,未经授权不得以任何形式转载及使用,违者必究。