惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

N
News and Events Feed by Topic
WordPress大学
WordPress大学
Vercel News
Vercel News
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
小众软件
小众软件
L
LangChain Blog
雷峰网
雷峰网
D
DataBreaches.Net
博客园 - 三生石上(FineUI控件)
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
T
Tor Project blog
NISL@THU
NISL@THU
Scott Helme
Scott Helme
量子位
S
Security Affairs
T
Threat Research - Cisco Blogs
博客园_首页
云风的 BLOG
云风的 BLOG
D
Docker
AWS News Blog
AWS News Blog
腾讯CDC
博客园 - 聂微东
The GitHub Blog
The GitHub Blog
U
Unit 42
Recent Announcements
Recent Announcements
Apple Machine Learning Research
Apple Machine Learning Research
G
Google Developers Blog
T
The Exploit Database - CXSecurity.com
MongoDB | Blog
MongoDB | Blog
Stack Overflow Blog
Stack Overflow Blog
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
L
LINUX DO - 热门话题
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
The Last Watchdog
The Last Watchdog
C
Cybersecurity and Infrastructure Security Agency CISA
IT之家
IT之家
W
WeLiveSecurity
P
Privacy & Cybersecurity Law Blog
F
Full Disclosure
L
Lohrmann on Cybersecurity
The Hacker News
The Hacker News
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
Y
Y Combinator Blog
S
Security @ Cisco Blogs
C
Cyber Attacks, Cyber Crime and Cyber Security
C
Check Point Blog
C
CXSECURITY Database RSS Feed - CXSecurity.com
N
News and Events Feed by Topic
PCI Perspectives
PCI Perspectives
I
InfoQ

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理, 企事业单位数字化的业务供需本质 – 人人都是产品经理, 医疗智能体·第1讲——医疗信息化重构:从“辅助软件”到“自主智能体”的范式转移 – 人人都是产品经理, 粉丝量就是空气!!! – 人人都是产品经理, 用户说“薯片碎了”,机器回“要买吗?”:意图识别的翻车与破局 – 人人都是产品经理, RAG召回准确率从75到90 我做对了这三件事 – 人人都是产品经理, AI大事件:Anthropic改收费、OpenAI发安全版、手术机器人纳入医保、阿里发布”秒悟” – 人人都是产品经理, Chrome 推出 Skills 新功能,Agent 重塑上网方式 – 人人都是产品经理, GitHub前创始人拿了a16z的1700万美元,做Agent时代的Git – 人人都是产品经理 拷贝或克隆其他 Flutter OH 项目到本地后无法运行 – 人人都是产品经理, 优惠券设计:优惠券创建 – 人人都是产品经理, 不用死磕文档!AI 助手 1 小时搞定飞书 CLI 安装 + 配置 + 知识库 – 人人都是产品经理, 用小龙虾做竞品分析报告:从2天到20分钟,我是怎么做到的 – 人人都是产品经理 用小龙虾做市场分析报告:搞懂这3个公式,市场规模不再靠猜 – 人人都是产品经理, 你早就在做 Harness 工程,只是不知道它叫这个名字 – 人人都是产品经理, Think Long就够?你可能想多了! – 人人都是产品经理, 货代SRM实战:供应商准入怎么做,才能让资源池不是通讯录而是可交付网络? – 人人都是产品经理, 如何做好用户调研?详解基本技巧 – 人人都是产品经理, 木鸟、途家、美团对打,平台春天行动开“卷” – 人人都是产品经理, 入职才发现公司不靠谱?小红书从业者求职避坑指南 – 人人都是产品经理, 美国 AI 三巨头联手封堵,中国 AI 突围之路在何方 – 人人都是产品经理, 小红书,放在需求对面的镜子 – 人人都是产品经理, AI 会带来大规模失业吗? – 人人都是产品经理, 从出单到补货前,我第一次犹豫:该不该放大? – 人人都是产品经理, Flutter 三方库鸿蒙化适配:5 种高效检查方式,快速判断是否需要适配 – 人人都是产品经理, 从做产品进阶拿结果:医美机构产品经理转岗科室运营经理 – 人人都是产品经理, 阿里HappyHorse,一场关于“Token经济”的阳谋 – 人人都是产品经理, To B AI:客户留存落地的观察与思考 – 人人都是产品经理, AI产品的“生命线”——数据采集、标注、清洗的产品化设计 – 人人都是产品经理, 谈谈AI Agent(二):当“孩子”能自己“体验世界”时,你该学什么? – 人人都是产品经理, UI/UX设计师的3层能力进阶,前两层让你活下来,第三层…才是真正的分水岭 – 人人都是产品经理, 2分钟 → 30秒,效率提升75%:B端产品经理如何用「规则枷锁」驯服AI幻觉? – 人人都是产品经理, 还没来得及学OpenClaw,来了个更猛的:Hermes Agent – 人人都是产品经理, AI日报:宇树机器人跑出10m/s刷新世界纪录 – 人人都是产品经理, 一文说透基金互金如何用情绪价值引导用户决策做转化 – 人人都是产品经理, 当浏览器开始替你”看”网页:AI 浏览器正在亲手拆掉它脚下的那张网 – 人人都是产品经理, 0代码,一天时间我Vibe Coding了个网站 – 人人都是产品经理, Hermes 和 OpenClaw 之争,Agent 的能力应该“装上去”还是“长出来”? – 人人都是产品经理 视频生成的“桌子”,字节Seedance 2掀完,阿里快乐马掀 – 人人都是产品经理, 从听不懂到完全信任:我的 Codex 深度产品体验 – 人人都是产品经理, 当虚拟偶像有了北京户口,与真人偶像还有什么区别? – 人人都是产品经理, 会说,远远比会做更重要 —— 对 SBTI 爆火现象的五层观察 – 人人都是产品经理, AI产品经理必看:当“搭环境”比“选模型”更重要,你的认知还在2024年吗? – 人人都是产品经理, 2026年AI产品商业化核心逻辑:从功能demo到规模化营收的3个必破卡点 – 人人都是产品经理, 京东围绕供应链,卷起裤腿下场的那些事儿 – 人人都是产品经理, SBTI一夜刷屏:它赢在了“太会说人话” – 人人都是产品经理, 折扣零售的真相:不是便宜,而是价值感! – 人人都是产品经理, 和甲方吵了一架,最后加钱做了——我学到的ToB产品经理生存法则 – 人人都是产品经理, 和几位小红书操盘手聊了8小时,干货全在这 – 人人都是产品经理, 智谱GLM-5.1登场,开源模型首超Opus4.6!!! – 人人都是产品经理 Anthropic收入凭什么反超OpenAI,终于有人把这事说清楚了 – 人人都是产品经理, 史上最有故事感的技术报告——Claude最强模型Mythos 7个极其精彩的细节 – 人人都是产品经理, 模型不是壁垒,Harness 也不是 – 人人都是产品经理, 抖音本地生活业务思考21 – 人人都是产品经理, Superpowers:145k Star的AI编码框架,到底是什么来头? Superpowers:145k Star的AI编码框架,到底是什么来头? – 人人都是产品经理, OpenAI 的路走错了,Anthropic Harness 解法启示:模型需要实践专科生 – 人人都是产品经理, 画原型图的前一步:设计站点地图 – 人人都是产品经理, 给 DeepSeek 的最后一封催更信 – 人人都是产品经理, 手把手教你用 Claude Code 搭建 AI 营销团队:5 个 Agent、12 项技能,独立完成研究、写作、设计全流程 – 人人都是产品经理, 你以为大模型在学语言?不,它在重新发明语言学 – 人人都是产品经理 所谓Skill,不过是AI时代的工业垃圾 – 人人都是产品经理, 聊一聊内容传播的几个方法 – 人人都是产品经理, 当平台开始吃掉生态:从 OpenClaw 被封杀,读懂 Anthropic 的这盘棋 – 人人都是产品经理, 你装了 10 个 AI 插件,Obsidian 还是一个文件夹 – 人人都是产品经理 关于AI智能体架构演进的系统性思考:从单体试水到多体协同的重构 – 人人都是产品经理, 当“人”变成Skill,我们又该何去何从? – 人人都是产品经理 Mythos 事件:前沿 AI 治理的意外实验 – 人人都是产品经理, 货代CRM:信用与风险管理怎么做,才能把坏账风险拦在放货之前? – 人人都是产品经理, 从HR收集自拍照到员工自助录入——我见证了园区人脸识别从”不可用”到”真好用”的全过程 – 人人都是产品经理 千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭? – 人人都是产品经理,
这家新公司融了 5500 万美元,想让 AI 真正能看懂图片 – 人人都是产品经理,
张艾拉 · 2026-04-28 · via 人人都是产品经理

英伟达押注的 AI 新秀 Elorian 横空出世,5500 万美元种子轮融资背后暗藏怎样的视觉推理革命?这家由 Google Brain 和苹果 AI 核心科学家创立的神秘公司,正试图攻克 AI 看懂图片却无法理解空间关系的终极难题。从机器人路径规划到工程设计意图识别,Elorian 要构建的是一套颠覆性的视觉推理底层能力。

最近出来了一家新公司,叫Elorian。

公司刚公开,就拿了5500 万美元种子轮融资,英伟达也是参投方之一。这笔钱在今天的 AI 创业里,也不算小。

更重要的是,这家公司才刚从隐身状态出来,连公开产品都还没有,就已经拿到这么大的种子轮,说明资本看中的不是一个短期热点,而是它瞄准的那个问题。

Elorian 瞄准的问题,可以用一句很简单的话来解释:

现在的 AI 会看图,但很多时候,它做的是识别和描述,不是真正意义上的理解。

如果只是问“图里有什么”,大多数模型已经能答得不错;但如果继续追问物体之间的位置关系、结构关系,或者让它根据画面做进一步判断,难度就会高很多。

Elorian 要做的就是这部分。

01 现在的 AI,为什么还不算真的“看懂图片”

今天的 DeepSeek、ChatGPT、Claude 这一类模型,当然已经会看图了,可以分析图片、理解图表、回答视觉问题。

你给模型一张照片,让它说“图里有一张桌子、一个杯子、一台电脑”,这类任务它通常能完成。

但如果你再问它:

  • 杯子离桌边近不近?
  • 这个物体到底挡住了后面多少空间?
  • 这张工程图里,改哪一块会影响整体结构?
  • 机器人应该从什么角度去抓这个杯子才更安全?

这时候,任务就不再是“识别图像内容”,而是要基于图像继续做分析和判断。现在很多模型在这类问题上,能力并不稳定。

OpenAI 自己也公开列过几项限制,包括精确空间定位比较吃力、某些图表线型和颜色变化不容易准确理解、复杂场景下也可能出现描述错误等。

学术评测里,这个问题也已经被反复指出了。

2026 年的 Spatial-DISE 评测,比较了32 个主流视觉语言模型,结论很直接:这些模型和人类之间还存在明显差距,尤其是在多步、多视角的空间推理任务上。

所以,把这件事说得更准确一点,不是“AI 看不懂图片”,而是:

AI 已经会看图,也会说图,但离真正依靠图像去理解结构、关系和约束,还差一段距离。

02 Elorian 在做什么

Elorian 官网最核心的一句话是:“Building the foundation of visual reasoning”。翻成更好懂的话,就是它想做一套真正面向“视觉推理”的基础能力。

不是把图片先翻成一段文字,再按文字来理解,而是让模型直接处理图像里的空间关系、物理约束、设计意图和抽象结构。

这家公司在官网里列出的几个典型方向,基本已经把它想去的场景讲清楚了:

机器人、工程设计、医学与科学、卫星图像、天气监测、灾害响应、精准农业。

这些方向有个共同点:它们都不只是“把图描述出来”就够了。

机器人要理解空间位置和动作路径;

工程设计要理解结构、约束和设计意图;

医学图像要理解组织关系、异常位置和上下文;

卫星图像和灾害响应则要从大规模图像里提取真正有用的判断依据。

所以简单来说,Elorian 的目标可以理解成:

让模型看到一张图之后,不只是复述内容,而是能继续推理。

03 创始团队:顶级华人科学家

Elorian 由两位华人科学家联合创办:

Andrew Dai曾在 Google Brain 和 DeepMind 工作近 14 年,做过 Gemini 相关的预训练与数据工作;

Yinfei Yang 此前是苹果 AI/机器学习团队的首席研究科学家,也在 Google Research 长期做多模态表示、视觉与语言基础模型。

Elorian 现在还没有公开产品,也没有客户名单。这个阶段,投资人看中的,主要就是两件事:团队和切入的问题。

Andrew Dai、Yinfei Yang 这类背景,本身就说明这家公司不是做应用的公司,而是要从底层能力开始做起。

还有一个细节也很能说明它的定位。Elorian 对自己的描述不是“研究实验室”,也不是“AI 应用公司”,而是research and product lab

也就是说,它不是只想做模型,而是希望把底层的研究能力尽快推到可以进入真实场景的产品里。

04 为什么它一出来就能融这么多钱

Elorian能拿到这么大的钱,原因大概有三层。

第一,团队稀缺。

这类既懂视觉、多模态,又真做过前沿模型的人,本来就不多。市场愿意为这类团队提前下注,不奇怪。

第二,问题够硬。

过去一年,AI 创业里最热的方向很多都在做“更快”、“更高效”。

Elorian 选的是一条相对更难的路:模型对图片的理解能力。这个问题更难,但一旦做出来,能进入的行业会更深。

第三,这条路本来就很烧钱。

这种公司前期不会很快长出一个轻量级的消费产品,它更像是先把底层能力做出来,再进入企业和行业场景。

训练、数据、模型架构、评测体系,全都需要时间和成本。官网自己也说,这轮融资会主要用来加大研发投入,推进视觉推理这条前沿方向。

05 国内相似方向的公司

中国也有相近方向的公司,但路径不太一样。

如果把 Elorian 理解成“专门做视觉推理底层能力”的公司,中国现在更像是分成两条路在做:

一条是从世界模型、视频模型往“理解现实世界”延伸

另一条是从机器人、具身智能往“看懂环境并做动作”推进

也就是说,国内更常见的做法,不是单独成立一家“视觉推理公司”,而是把这件事放进世界模型或机器人基础模型里一起做。

和 Elorian 相似(但不同)的国内公司,我觉得有三类。

第一类是生数科技。

这家公司我之前专门单独写过,清华系出身,也是刚拿到20亿人民币的融资。

它和 Elorian 不完全一样,但方向上有重合。生数现在公开讲的是“通用世界模型”,要做对数字世界和物理世界的建模、推理、预测和行动。

底层分成世界生成模型和世界行动模型,它的出发点还是视频和多模态生成,产品层最成熟的是视频生成应用 Vidu。

这和 Elorian 的差别很明显:

Elorian 现在更聚焦“看懂图片、理解结构和关系”;而生数是一家更宽的世界模型公司,视频生成和商业化走得更前。

第二类是北京人形机器人创新中心的 WoW。

这个方向和 Elorian 的底层目标其实更接近。WoW官方的描述是:它不是只让机器“看见”,而是融合了视觉、动作、物理感知和推理,让机器人能理解物理世界。

WoW 的重点不是“图片理解”本身,而是把视觉理解和物理规律、动作执行连起来。

相比 Elorian,WoW 更偏“面向机器人落地的物理世界理解”。

第三类是自变量机器人、智元这类做 VLA / 具身基座模型的公司。

自变量机器人自研的是统一的视觉—语言—动作模型,强调因果推理、空间智能和复杂操作;

智元发布的 GO-1 也不是普通的视觉语言模型,而是把视觉、力觉、语言和动作放到一起,直接输出动作序列。

这类公司的出发点和 Elorian 不一样:它们不是先把“视觉推理”做成一个独立基础层,而是直接面向机器人任务,把感知、理解、决策、动作一起做。

如果从公开进展和商业化看,国内这条线其实走得比 Elorian 更靠前一些。

原因不是底层理论更强,而是国内很多公司一开始就不是只做研究,它们更早把目标放在机器人、视频生成、工业场景和行业项目上,所以更容易展示阶段性成果。

但如果从问题定义看,Elorian 更纯粹:

它要解决的是一个更基础的问题:模型看到图之后,能不能真正理解空间关系、结构关系和约束条件。

作者:张艾拉 公众号:Fun AI Everyday

本文由 @张艾拉 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自作者提供