惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

T
Tor Project blog
博客园 - 聂微东
Microsoft Azure Blog
Microsoft Azure Blog
博客园 - 【当耐特】
G
Google Developers Blog
J
Java Code Geeks
The Cloudflare Blog
Attack and Defense Labs
Attack and Defense Labs
宝玉的分享
宝玉的分享
Last Week in AI
Last Week in AI
Cisco Talos Blog
Cisco Talos Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
I
Intezer
Jina AI
Jina AI
T
Tenable Blog
P
Palo Alto Networks Blog
Project Zero
Project Zero
D
DataBreaches.Net
Hugging Face - Blog
Hugging Face - Blog
The Hacker News
The Hacker News
F
Full Disclosure
Cloudbric
Cloudbric
量子位
H
Heimdal Security Blog
K
Kaspersky official blog
有赞技术团队
有赞技术团队
罗磊的独立博客
V
Vulnerabilities – Threatpost
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
阮一峰的网络日志
阮一峰的网络日志
Vercel News
Vercel News
Recent Announcements
Recent Announcements
WordPress大学
WordPress大学
GbyAI
GbyAI
S
SegmentFault 最新的问题
M
MIT News - Artificial intelligence
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
I
InfoQ
Recorded Future
Recorded Future
Security Archives - TechRepublic
Security Archives - TechRepublic
AI
AI
Webroot Blog
Webroot Blog
C
CXSECURITY Database RSS Feed - CXSecurity.com
爱范儿
爱范儿
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
T
The Exploit Database - CXSecurity.com
Apple Machine Learning Research
Apple Machine Learning Research
C
Cybersecurity and Infrastructure Security Agency CISA
H
Hacker News: Front Page
Latest news
Latest news

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理, 企事业单位数字化的业务供需本质 – 人人都是产品经理, 医疗智能体·第1讲——医疗信息化重构:从“辅助软件”到“自主智能体”的范式转移 – 人人都是产品经理, 粉丝量就是空气!!! – 人人都是产品经理, 用户说“薯片碎了”,机器回“要买吗?”:意图识别的翻车与破局 – 人人都是产品经理, RAG召回准确率从75到90 我做对了这三件事 – 人人都是产品经理, AI大事件:Anthropic改收费、OpenAI发安全版、手术机器人纳入医保、阿里发布”秒悟” – 人人都是产品经理, Chrome 推出 Skills 新功能,Agent 重塑上网方式 – 人人都是产品经理, GitHub前创始人拿了a16z的1700万美元,做Agent时代的Git – 人人都是产品经理 拷贝或克隆其他 Flutter OH 项目到本地后无法运行 – 人人都是产品经理, 优惠券设计:优惠券创建 – 人人都是产品经理, 不用死磕文档!AI 助手 1 小时搞定飞书 CLI 安装 + 配置 + 知识库 – 人人都是产品经理, 用小龙虾做竞品分析报告:从2天到20分钟,我是怎么做到的 – 人人都是产品经理 用小龙虾做市场分析报告:搞懂这3个公式,市场规模不再靠猜 – 人人都是产品经理, 你早就在做 Harness 工程,只是不知道它叫这个名字 – 人人都是产品经理, Think Long就够?你可能想多了! – 人人都是产品经理, 货代SRM实战:供应商准入怎么做,才能让资源池不是通讯录而是可交付网络? – 人人都是产品经理, 如何做好用户调研?详解基本技巧 – 人人都是产品经理, 木鸟、途家、美团对打,平台春天行动开“卷” – 人人都是产品经理, 入职才发现公司不靠谱?小红书从业者求职避坑指南 – 人人都是产品经理, 美国 AI 三巨头联手封堵,中国 AI 突围之路在何方 – 人人都是产品经理, 小红书,放在需求对面的镜子 – 人人都是产品经理, AI 会带来大规模失业吗? – 人人都是产品经理, 从出单到补货前,我第一次犹豫:该不该放大? – 人人都是产品经理, Flutter 三方库鸿蒙化适配:5 种高效检查方式,快速判断是否需要适配 – 人人都是产品经理, 从做产品进阶拿结果:医美机构产品经理转岗科室运营经理 – 人人都是产品经理, 阿里HappyHorse,一场关于“Token经济”的阳谋 – 人人都是产品经理, To B AI:客户留存落地的观察与思考 – 人人都是产品经理, AI产品的“生命线”——数据采集、标注、清洗的产品化设计 – 人人都是产品经理, 谈谈AI Agent(二):当“孩子”能自己“体验世界”时,你该学什么? – 人人都是产品经理, UI/UX设计师的3层能力进阶,前两层让你活下来,第三层…才是真正的分水岭 – 人人都是产品经理, 2分钟 → 30秒,效率提升75%:B端产品经理如何用「规则枷锁」驯服AI幻觉? – 人人都是产品经理, 还没来得及学OpenClaw,来了个更猛的:Hermes Agent – 人人都是产品经理, AI日报:宇树机器人跑出10m/s刷新世界纪录 – 人人都是产品经理, 一文说透基金互金如何用情绪价值引导用户决策做转化 – 人人都是产品经理, 当浏览器开始替你”看”网页:AI 浏览器正在亲手拆掉它脚下的那张网 – 人人都是产品经理, 0代码,一天时间我Vibe Coding了个网站 – 人人都是产品经理, Hermes 和 OpenClaw 之争,Agent 的能力应该“装上去”还是“长出来”? – 人人都是产品经理 视频生成的“桌子”,字节Seedance 2掀完,阿里快乐马掀 – 人人都是产品经理, 从听不懂到完全信任:我的 Codex 深度产品体验 – 人人都是产品经理, 当虚拟偶像有了北京户口,与真人偶像还有什么区别? – 人人都是产品经理, 会说,远远比会做更重要 —— 对 SBTI 爆火现象的五层观察 – 人人都是产品经理, AI产品经理必看:当“搭环境”比“选模型”更重要,你的认知还在2024年吗? – 人人都是产品经理, 2026年AI产品商业化核心逻辑:从功能demo到规模化营收的3个必破卡点 – 人人都是产品经理, 京东围绕供应链,卷起裤腿下场的那些事儿 – 人人都是产品经理, SBTI一夜刷屏:它赢在了“太会说人话” – 人人都是产品经理, 折扣零售的真相:不是便宜,而是价值感! – 人人都是产品经理, 和甲方吵了一架,最后加钱做了——我学到的ToB产品经理生存法则 – 人人都是产品经理, 和几位小红书操盘手聊了8小时,干货全在这 – 人人都是产品经理, 智谱GLM-5.1登场,开源模型首超Opus4.6!!! – 人人都是产品经理 Anthropic收入凭什么反超OpenAI,终于有人把这事说清楚了 – 人人都是产品经理, 史上最有故事感的技术报告——Claude最强模型Mythos 7个极其精彩的细节 – 人人都是产品经理, 模型不是壁垒,Harness 也不是 – 人人都是产品经理, 抖音本地生活业务思考21 – 人人都是产品经理, Superpowers:145k Star的AI编码框架,到底是什么来头? Superpowers:145k Star的AI编码框架,到底是什么来头? – 人人都是产品经理, OpenAI 的路走错了,Anthropic Harness 解法启示:模型需要实践专科生 – 人人都是产品经理, 画原型图的前一步:设计站点地图 – 人人都是产品经理, 给 DeepSeek 的最后一封催更信 – 人人都是产品经理, 手把手教你用 Claude Code 搭建 AI 营销团队:5 个 Agent、12 项技能,独立完成研究、写作、设计全流程 – 人人都是产品经理, 你以为大模型在学语言?不,它在重新发明语言学 – 人人都是产品经理 所谓Skill,不过是AI时代的工业垃圾 – 人人都是产品经理, 聊一聊内容传播的几个方法 – 人人都是产品经理, 当平台开始吃掉生态:从 OpenClaw 被封杀,读懂 Anthropic 的这盘棋 – 人人都是产品经理, 你装了 10 个 AI 插件,Obsidian 还是一个文件夹 – 人人都是产品经理 关于AI智能体架构演进的系统性思考:从单体试水到多体协同的重构 – 人人都是产品经理, 当“人”变成Skill,我们又该何去何从? – 人人都是产品经理 Mythos 事件:前沿 AI 治理的意外实验 – 人人都是产品经理, 货代CRM:信用与风险管理怎么做,才能把坏账风险拦在放货之前? – 人人都是产品经理, 从HR收集自拍照到员工自助录入——我见证了园区人脸识别从”不可用”到”真好用”的全过程 – 人人都是产品经理 千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭? – 人人都是产品经理,
一文讲透AI的三大核心要素之一:算力
向上的小霍 · 2026-01-28 · via 人人都是产品经理

算力作为AI发展的三大支柱之一,远不止简单的硬件堆砌。本文深度解析AI算力的本质——从FLOPS到TOPS的单位差异,到内存带宽与芯片互联构成的『数据生命线』,揭示大模型训练背后那些被忽视的算力三角关系。你将理解为什么标称算力只是冰山一角,以及如何评估真实的AI算力效能。

算力、算法和数据是推动人工智能发展的三大核心要素,尤其是算力,更是经常被提到,但是算力到底是什么?

不是显卡,也不是芯片。

那么什么是算力?

广义上来说,算力是指用来计算的设备在单位时间内处理信息的能力。

在AI领域中,算力这个这个概念被进一步聚焦为执行特定类型的计算任务的速度和效率,主要是指大规模的线性代数运算。

AI算力不仅仅是单个芯片的理论峰值性能,更是一个涵盖了硬件架构、软件堆栈、数据传输和算法效率的综合系统能力的体现,是支撑大模型训练、推理、计算机视觉、语音识别等所有 AI 场景的核心基础设施。

AI 算力的核心围绕大模型、深度学习来展开,所有的设计都服务于用更低的精度、更高的并行度,来完成海量的 AI 特型运算。

注意:精度是 AI 算力的前提,没有精度标注的算力没有任何的实际意义。

算力单位-FLOPS

什么是FLOPS?

FLOPS(Floating Point Operations Per Second),也叫每秒浮点运算次数,是AI算力最核心、最通用的一个单位 。

神经网络的权重、激活值、梯度等核心数据本质上都是包含小数儿的实数,都得通过浮点数进行精确表示和计算。

什么是浮点运算?

浮点运算(Floating-Point Arithmetic)是计算机中用于处理非整数(含小数、极大 / 极小值整数) 的数值计算方式,核心是通过 “科学计数法” 的这种思路,用有限的二进制位数表示范围更广的数值,来解决整数运算没有办法处理的小数或极端数值的问题。

简单来说,就是把一个数拆成两部分存储和计算:

尾数(Mantissa):类似科学计数法里的 “有效数字”,决定数值的精度,比如 1.234×10³ 中的 “1.234;

指数(Exponent):类似科学计数法里的 “10 的幂次”,决定数值的范围,比如 1.234×10³ 中的 “3”。

FLOPS单位层级

AI算力

AI 算力侧重张量 / 矩阵运算,需要结合着精度(FP32/FP16/FP8/INT4)来区分。

同样的一款 AI 芯片,精度越低,算力越高,因为可以通过牺牲少量的精度,来换取更高的运算速度。

算力单位-TOPS

TOPS这个单位,主要是适配边缘 AI 设备,比如摄像头、无人机、车载 AI 模块、物联网终端,意思是每秒万亿次操作。

TOPS:包含整数运算 和 浮点运算,适合用来表示边缘设备的轻量 AI 任务,比如图像识别、语音唤醒,不需要需高精度浮点,一般的常用量级是1-100 TOPS。

FLOPS:只计算的是浮点运算,适配云端 / 服务器的复杂 AI 任务。

注意:TOPS 与 TFLOPS不可直接换算,场景不同没有对比意义。

AI 算力的两大核心应用场景

AI 算力的需求完全由场景决定,主要是分为模型训练和模型推理两大环节。

模型训练就是「造模型」,需要集群化的超高 AI 算力。

通过海量的数据调整模型的万亿级权重参数,本质其实是反复的做矩阵乘法和梯度下降,需要持续的超高算力和运算稳定性,单次训练就可能消耗数千亿亿次 FP8/BF16 浮点运算。

常见的算力载体有NVIDIA A100/H100、华为昇腾 910B、谷歌 TPU v5等这些。

模型推理其实就是使用模型,用训练好的模型对新输入的信息做预测,比如聊天机器人回复、图像识别、语音转文字。

模型推理需要高并发的处理能力(高吞吐)和快速的响应速度(低延迟),对设备的算力要求低于训练,但对算力利用率的要求更高;

内存带宽 & 芯片互联:AI 算力的数据流生命线

在 AI 算力体系中,标称算力(比如 H100 FP8 2EFLOPS)只是芯片的一个理论运算能力,内存带宽和芯片互联才是支撑这份能力能不能落地的两大核心数据流基础设施。

AI 训练任务是典型的数据密集型运算,大模型训练 和 推理都需要海量权重数据、特征数据在硬件中高速流转,如果把 AI 芯片的运算单元比作是上千名流水线工人,那么内存带宽就是工厂的原料输送管道,芯片互联就是多个工厂之间的高速货运专线。

管道太细,工人再多也会停工待料;专线不通,多个工厂只能自己生产自己的,没有办法协同完成大订单。

二者的核心作用是解决「数据传输速度跟不上运算单元处理速度」的问题,这在很大程度上决定了 AI 算力的实际利用率,目前行业内大模型训练的算力利用率 在60%-80%,瓶颈几乎都来自内存带宽或者芯片互联。

内存带宽:单颗 AI 芯片的内部数据大动脉

内存带宽是指AI 芯片的运算单元(CUDA 核心 / 张量核心)跟芯片内置内存之间,单位时间内可以传输的数据量,主要是用来衡量单个芯片内部的数据存取速度,而不是内存的存储容量。

可以理解容量是 “仓库的大小”,带宽是 “仓库到车间的输送速度”。

通用的单位是:GB/s(千兆字节 / 秒),AI 高端芯片用TB/s(太字节 / 秒)来表示,1TB/s=1024GB/s。

AI 芯片的核心是数千 / 数万个轻量级并行运算单元,这些单元的运算速度极快,可以达到每秒万亿次的级别,但是每一次运算都需要从内存中读取数据,运算完成后再将结果写回内存。

如果内存带宽不足,运算单元就会出现“停工待料”的情况,运算单元处理完一批数据之后,得等待内存传输下一批数据,这个时候芯片的标称算力再高,实际也只能发挥一部分能力, 这就是所谓的“内存墙”,是 AI 算力利用率的一个核心单芯片瓶颈。

现在普通计算机 / 服务器用的是DDR4/DDR5 内存,带宽大约是 50-100GB/s,但 AI 芯片必须用专用的高带宽内存 HBM(High Bandwidth Memory),核心原因是 DDR 的带宽根本不能匹配 AI 运算单元的处理速度,而 HBM 通过3D 堆叠技术,带宽实现了指数级的一个提升,这也是当前 AI 芯片的标配。

AI 芯片的算力越高,搭配的 HBM 带宽就得越高,算力和带宽是成正相关的关系,主要是为了让运算单元始终有数据可以处理,将芯片算力的利用率最大化。

内存带宽的实操关注要点:

在 选择AI 芯片硬件的时候,不能只看标称算力是多少,必须同步的看内存带宽,关注算力和带宽的匹配比。

如果一个AI 芯片标称是FP8 1EFLOPS,但内存带宽仅 500GB/s,那么带宽肯定严重不足,实际算力利用率大概率低于 30%。

高端 AI 芯片的算力 – 带宽匹配比,目前已经做到1EFLOPS 算力对应 1.5-2TB/s 带宽(H100 2EFLOPS 对应 3.35TB/s),可以说是行业最优水平。

芯片互联:AI 算力集群的外部数据高速路网

芯片互联是指很多颗 AI 芯片之间、多台 AI 服务器之间,甚至是整个算力集群之间的高速数据传输通道和技术体系。

核心是用来衡量算力集群的跨芯片 / 跨服务器的数据同步速度,解决单颗芯片算力不足,需要多芯片协同运算的问题。

AI 场景下的核心作用:让算力集群变成一个统一的超级芯片

大模型的参数量是远远超过单颗 AI 芯片的内存容量和运算能力的,比如 GPT-4 的参数量超 过了1 万亿,单颗 H100 芯片的的 HBM3 内存才 80GB,根本不能容纳整个模型的权重,更没办法单独完成模型训练。

所以就需要将大模型的参数拆分到数千颗 AI 芯片里面,每颗芯片负责一部分参数的运算,但模型的矩阵乘法、梯度下降是一个连续的运算过程,某颗芯片的运算结果会成为另一颗芯片的输入数据,这就要求芯片之间的数传必须做到高速、低时延、无卡顿。

如果互联带宽不足,数据传输太慢,芯片之间的数据传输就会排队,集群的运算速度会被最慢的互联通道给限制住。

如果互联时延过高的话,芯片之间的参数同步不及时,就会出现偏差,直接导致模型训练失败。

目前,全球 AI 算力集群的互联技术主要由英伟达和华为主导,都是专门儿为 AI 集群设计的闭源 或者是开源技术,不同于普通的网络技术,AI算力集群的互联技术能做到算力感知,能根据 AI 运算的数据传输需求动态调整带宽,可以最大化算力集群利用率。

算力三角:运算单元 – 内存带宽 – 芯片互联

AI 算力的实际发挥由运算单元(标称算力)、内存带宽、芯片互联组成的算力三角决定,三者必须要相互匹配,缺一不可:

如果运算单元强,内存带宽弱:那么单颗芯片的算力利用率就会很低,集群再大也没有什么意义;

如果内存带宽强,芯片互联弱:单颗芯片的算力能发挥,但是集群之间不能协同,整体算力是单颗芯片的简单叠加,而不是倍数提升;

如果三者均匹配的话:集群的算力能实现近似线性提升,比如 100 颗芯片的集群,实际算力能达到单颗的 80-90 倍,这才是大模型训练的理想状态。

作者:向上的小霍,现任某厂AI产品经理,公众号:向上的小霍。

本文由 @向上的小霍 原创发布于人人都是产品经理,未经作者许可,禁止转载。

题图来自 Pexels,基于CC0协议。

该文观点仅代表作者本人,人人都是产品经理平台仅提供信息存储空间服务。