惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Martin Fowler
Martin Fowler
有赞技术团队
有赞技术团队
博客园_首页
H
Help Net Security
GbyAI
GbyAI
aimingoo的专栏
aimingoo的专栏
V
Visual Studio Blog
The Cloudflare Blog
腾讯CDC
Jina AI
Jina AI
Last Week in AI
Last Week in AI
月光博客
月光博客
博客园 - 叶小钗
Google DeepMind News
Google DeepMind News
B
Blog RSS Feed
Blog — PlanetScale
Blog — PlanetScale
人人都是产品经理
人人都是产品经理
Engineering at Meta
Engineering at Meta
Y
Y Combinator Blog
Hugging Face - Blog
Hugging Face - Blog
博客园 - 聂微东
爱范儿
爱范儿
N
Netflix TechBlog - Medium
F
Fortinet All Blogs

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!
AI Infra企业无问芯穹再获超7亿元融资!CEO夏立雪:以中国方...
李冬梅 · 2026-05-07 · via InfoQ - 促进软件开发领域知识与创新的传播

5 月 7 日,无问芯穹宣布此前已再获超 7 亿元融资,联合领投方为杭州高新金投集团和惠远资本,跟投方包括国兴资本、秦淮数据、广发乾和、力合清瞳、中保投资、AEF NextGen、腾瑞资本、卡莱特、中信建投资本和宽德智能学习实验室 (Will),老股东君联资本、上海国投孚腾和元智未来追加投资。

目前,无问芯穹 Agentic MaaS 大模型服务平台上线 160 余种大模型,截至今年 4 月底,该平台日均 Token 调用量相较于去年底长超 20 倍。

据悉,本轮融资已于数月前完成,资金将重点投向三大方向:一是夯实无问芯穹多元异构技术的领先地位,扩大 Token (词元)经济时代,极致优化的可用算力规模;二是持续强化软硬协同的技术优势,加快从“电能到 Token”的生产效率跃升;三是构建具备自主进化能力的 AI 基础设施,依托企业级智能体服务平台,面向不同行业场景提供解决方案,提升从“Token 到生产力”的价值转化。

此次融资充分显示 Token 经济时代,投资方对 AGI 基础设施核心价值的深度认同。

在全球产业从“模型竞赛”迈入“AI 生产力”的关键转折期,无问芯穹正式发布 AI 生产力公式,提出“AI 生产力 = 智能规模 × Token 生产效率 × Token 价值转化”,将“Token 经济时代”的生产力价值释放过程,进行量化诠释,并凭借独特的“高效率 + 大规模 + 智能化”Agentic Infra 体系,业务迎来了急速成长,正成为中国 Token 经济的枢纽。

无问芯穹联合创始人兼 CEO 夏立雪表示:“在 Token 经济时代,AGI 基础设施扮演的角色,如同石化产业链中的炼化厂,它把能源转化为数字石油 (Token),为各类 AI 终端应用和服务输出基础资源,是 Token 经济的关键枢纽。无问芯穹提出的 AI 生产力公式,是我们对如何建造高效率、大规模、智能化的 Agentic Infra 这一命题的系统性回答。再获超 7 亿融资,将助力加速我们在这三个维度上的全面突破,以中国方案回答全球 Token 经济的核心命题。”

近期,Agentic AI 模型主导的 Token 经济产业迎来爆发,无问芯穹不仅凭借软硬协同与多元异构的技术优势,构筑了坚实的 AI Native 技术底座,更敏锐捕捉到多智能体协作与端到端落地的趋势,率先构建了新一代可自主进化的 Agentic Infra。

Token 经济浪潮已至,迈入“AI 生产力”新纪元

全球人工智能产业正经历一场深刻的范式转折。随着智能体从概念走向规模化落地,衡量 AI 智能输出的基本单元“Token”,正在成为驱动数字经济乃至实体世界的新型核心资源。

截至今年 4 月底,无问芯穹 Agentic MaaS 大模型服务平台的日均 Token 调用量相较于去年底,已增长超 20 倍,并持续对开源模型进行 Day0 适配上架。

国家统计局最新发布的数据也显示,截至今年 3 月,我国日均 Token 调用量突破 140 万亿,比上年末增长超 40%,人工智能正深度赋能千行百业,带动数字化经济快速扩张。这个爆发节奏,如同 3G 时代手机流量的起步阶段——当年每月 100MB 的流量微不足道,今天的 Token 用量也有着指数级增长空间。

从人类用户驱动,到人与智能体共存,再到智能体主导,全球 Token 需求量将沿着“从人到机器”的路径指数级跃迁。预计 2027 年以后,机器自主消费的 Token 规模将开始远超人类,推动全球 Token 需求大规模爆发式增长。

而 AGI 基础设施的长远价值,不仅在于技术领先,更在于推动构建可持续的 Token 经济生态。

今年 3 月,无问芯穹联合创始人兼 CEO 夏立雪在 2026 年中关村论坛上首次提出“中国特色 Token 经济学”理念:要打通“投入→电能→Token→生产力→价值”的完整经济链路,让 Token 从技术计量单位,升级为核心经济变量,真正实现 AI 产业的可持续发展。

我国拥有丰沛的能源结构优势、完整的 AI 产业链和全球最大规模的 AI 应用市场,完全有能力复刻“Made in China”的成功路径。无问芯穹以高效率、大规模和智能化的 Agentic Infra,将资源优势转化为高质量 AI 生产力,以“AI-Made in China”为全球人工智能发展注入中国动能。

面对这一历史性的产业机遇,无问芯穹正式发布 AI 生产力公式,将 Token 经济与公司核心能力深度锚定。也旨在为回答“AGI 基础设施如何提升全社会生产力”这一命题,提供全新思考。

首发 AI  生产力公式:智能规模 × Token 生产效率 × Token 价值转化

无问芯穹提出的 AI 生产力公式,即“AI 生产力 = 智能规模 × Token 生产效率 × Token 价值转化”

  • 智能规模:可通过技术极致优化的多元异构算力规模。在 Token 经济爆发期,算力规模已成为智能上限的核心瓶颈。单一芯片厂商的算力供给与成本结构,正在制约 AI 规模化落地进程。无问芯穹以“多元异构”的核心技术,在多种模型算法与多种芯片硬件之间,实现跨层次的极致优化,大幅提升算力的可用规模,破解当前算力短缺困局。

  • Token 生产效率:让同等资源生产更多 Token,以“Token/s”衡量。无问芯穹通过 Agentic Infra 自主式 AI 基座,推出面向 AI 原生企业的大规模模型训练推理一体化平台,以软硬件协同优化,通过跨越软件与硬件的深度优化与联合设计,极致挖掘芯片应用算力。

  • Token 价值转化:让同等 Token 创造更大生产力,以“生产力/Token”衡量。无问芯穹平台已接入包括 Kimi、智谱、DeepSeek、通义千问、MiniMax 等头部大模型,进一步优化、发挥万亿级参数开源大模型的智能上限,并面向 AI 原生企业、制造业、文化影视、智能终端等行业,输出系统级的 Token 生产力服务。

“Token 生产效率”与 “Token 价值转化”的单位相乘,即得到“生产力/s”——纵观人类工业文明进程,工业革命、互联网发明,均指向对于全社会“每秒生产力”的跨越式提升。当前,Token 已成为新的生产力价值单元,内化于生产力价值极大化释放的进程中。

Agentic MaaS 大模型服务平台:日均 Token 调用量爆发式增长 20 倍

作为公司核心产品之一,无问芯穹 Agentic MaaS 平台采用多层架构设计,为大模型公司以及需要接入大模型服务的 AIGC 应用公司,提供从模型接入、流量治理、推理优化到资源调度的全栈系统能力,并深度应用智能体能力,根据服务性能与负载情况动态智能调整底层模型资源,实现 7*24 的高可用服务守护。

平台针对智谱、Kimi、DeepSeek、通义千问、MiniMax 等国产主流开源模型提供高性能的服务优化,并对万亿参数大模型进行了深度推理优化。

在实际生产环境中,Agentic MaaS 平台展现出多项业内领先的性能优势。在执行精准度上,平台不仅能够支撑复杂的工具链,还确保了与原厂模型表现的高度一致(精度对齐率>99.9%)。在运行效率方面,平台将系统吞吐量大幅提升了 2 到 3 倍,整体时延缩减 50%,并把首字延迟控制在 500ms 以内。此外,高达 99.95% 的企业级高可用性,为各项真实业务提供了坚实的稳定支撑。

当前,Agentic MaaS 平台已上线 160 余种大模型,均支持开箱即用。截至 4 月底,Agentic MaaS 平台的日均 Token 调用量相较于去年底,已增长超 20 倍,构建起“推理成本持续降低→头部大模型公司深度合作→大量真实业务经验积累→推理优化技术持续快速迭代→性能、可靠性不断提升→日均调用量持续快速提升”的强劲增长飞轮。