惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

IT之家
IT之家
Engineering at Meta
Engineering at Meta
腾讯CDC
宝玉的分享
宝玉的分享
H
Help Net Security
I
InfoQ
博客园 - Franky
The GitHub Blog
The GitHub Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Microsoft Security Blog
Microsoft Security Blog
M
MIT News - Artificial intelligence
博客园_首页
美团技术团队
Recent Announcements
Recent Announcements
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
雷峰网
雷峰网
The Cloudflare Blog
博客园 - 司徒正美
Vercel News
Vercel News
MyScale Blog
MyScale Blog
人人都是产品经理
人人都是产品经理
爱范儿
爱范儿
月光博客
月光博客

奇客Solidot–传递最新科技情报

NASA 关闭旅行者 1 号的 LECP 仪器以节省电力维持运行 奇客Solidot | 人形机器人打破人类半马世界纪录 奇客Solidot | 卫星无人机图像显示美国四成数据中心可能延期 奇客Solidot | 内存芯片短缺可能持续到 2030 年 奇客Solidot | 果糖不只是糖,它更像是激素 奇客Solidot | Grinex 交易所声称遭敌对国家黑客入侵 奇客Solidot | 大白鲨面临过热风险 奇客Solidot | 暗能量巡天绘制出迄今最大的高分辨率 3D 宇宙地图 微软正式将 FAT32 分区大小从 32GB 增加到 2TB 奇客Solidot | 拼多多美团等被罚 36 亿 奇客Solidot | 英伟达 CEO 反对进一步限制向中国出口芯片 奇客Solidot | 美国科技巨头成功在欧盟法律中将数据中心环境影响列为保密信息 奇客Solidot | 乌克兰军方开始大规模使用地面武装机器人 Firefox 加入了对 Web Serial API 的支持 奇客Solidot | 大自然仍然在铸造人类基因 奇客Solidot | 威尼斯如何应对海平面上升 SpaceX 将发射 ESA 的 Rosalind Franklin 火星漫游车 奇客Solidot | Discourse 强调会继续开源 奇客Solidot | 美国主流媒体封禁互联网档案馆的存档机器人 奇客Solidot | 新研究再次证实 AI 有害大脑 Mozilla 宣布开源可自托管 AI 客户端 Thunderbolt 奇客Solidot | Linux Mint 宣布采用更长的开发周期 奇客Solidot | 人类的噪音在伤害动物,我们会学会安静吗? 奇客Solidot | 帝企鹅因气候变化导致数量减少被列为濒危 奇客Solidot | 抹香鲸的发声沟通方式与人类相似 奇客Solidot | 中国手游如何征服世界 奇客Solidot | IPv6 普及度突破 50% 奇客Solidot | 挪威男子在移植其兄弟的干细胞后治愈 HIV 波士顿动力的机器狗集成了 Google 的 Gemini 模型 奇客Solidot | Cal.com 因 AI 从开源转为闭源
奇客Solidot | MIT 新计算机视觉算法以像素为单位识别图像
2022-04-26 · via 奇客Solidot–传递最新科技情报

对人类来说,识别场景中的物品就像看它们这么简单。但对于人工智能和计算机视觉系统来说,开发出对周围环境的高保真理解需要更多的努力。如果我们具体一点的话,需要大约 800 小时的手动标记训练图片工作。为了帮助机器更好地了解人们的做法,MIT CSAIL 的一组研究人员与康奈尔大学和微软合作开发了

STEGO

一种以像素为单位识别图像的算法

。通常创建计算机视觉(CV)训练数据需要人在图像中的特定对象周围画框——如给坐在草地上的狗画上的框——标记框内有什么东西(“狗”),以便用这些数据训练的 AI 可在草丛中分辨出狗。相反 STEGO(具有基于能量的图片优化的自我监督转换器)使用了名为“语义分割”的技术,该技术将类标签应用于图像中的每个像素,以便 AI 更准确地了解周围的世界。带标签的框中包含对象,也会包含边界内对象周围像素中的其他物体,而语义分割则标记对象的每个像素,但是只标记构成对象的像素——你只得到狗的像素,而不是狗的像素再加上一些草。这相当于机器学习使用 Photoshop 的智能套索和矩形框选工具的差别。这种技术的问题之一是范围。传统的多镜头监督系统通常需要数千张(如果不是数十万张)标记图像训练算法。将这个数字乘以即使构成单张 256x256 图像所需的 65,536 个单独的像素,现在所有这些像素都需要单独标记,所需的工作量很快就会大到不可能。CSAIL团队在新闻稿中写道,“STEGO 会寻找出现在整个数据集中的类似对象。”“然后它会将这些相似的对象联系在一起,在它学习的所有图像中构建一个统一的世界观。”