惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

T
Troy Hunt's Blog
人人都是产品经理
人人都是产品经理
MongoDB | Blog
MongoDB | Blog
Stack Overflow Blog
Stack Overflow Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Microsoft Security Blog
Microsoft Security Blog
F
Fortinet All Blogs
博客园 - 三生石上(FineUI控件)
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
P
Proofpoint News Feed
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
博客园 - Franky
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Martin Fowler
Martin Fowler
V
Visual Studio Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Microsoft Azure Blog
Microsoft Azure Blog
云风的 BLOG
云风的 BLOG
G
Google Developers Blog
WordPress大学
WordPress大学
腾讯CDC
J
Java Code Geeks
T
The Blog of Author Tim Ferriss
博客园 - 司徒正美
博客园 - 【当耐特】
小众软件
小众软件
Attack and Defense Labs
Attack and Defense Labs
宝玉的分享
宝玉的分享
Google DeepMind News
Google DeepMind News
罗磊的独立博客
Schneier on Security
Schneier on Security
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
量子位
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
O
OpenAI News
TaoSecurity Blog
TaoSecurity Blog
H
Heimdal Security Blog
Blog — PlanetScale
Blog — PlanetScale
Forbes - Security
Forbes - Security
B
Blog
I
InfoQ
D
DataBreaches.Net
月光博客
月光博客
T
Tenable Blog
S
Security Affairs
C
Check Point Blog
T
Threatpost
C
Cybersecurity and Infrastructure Security Agency CISA
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
www.infosecurity-magazine.com
www.infosecurity-magazine.com

ZDNet Korea

여기어때, 해양 관광 레저·티켓 할인 쿠폰 쏜다 11번가, 5월 바다여행지 숙박·체험 상품 할인 패스트파이브, 작년 매출 1500억원·영업익 60억원 혼다코리아, '뉴 파일럿 블랙 에디션' 사전 계약…7880만원 카카오엔터 추천 4월 화제의 신작 웹툰 4선 휴먼컨설팅그룹, 연구개발 허브 ‘양재센터’ 신설 더벤처스, K뷰티 '클레버스텝스' 시드 투자 민주당 "지방선거 이후 디지털자산기본법 논의 본격화" KFC, 가맹점주 대상 프랜차이즈 컨벤션 개최 스타벅스, 장애인의 날 맞아 공모전 수상작 굿즈 출시 "URL 포함된 고유가 지원금 알림 문자는 사기" 2025년 원화 결제 수출 비중 3.4%…역대 최고 삼양사, 국제베이커리페어 첫 참가…냉동생지 ‘프레팡’ 공개 문체부 콘텐츠 R&D 확대, 현장 체감은 엔비디아, '빌드 어 클로' 한국 첫 공개…"AI 에이전트 직접 구축" LS일렉트릭, 북미 데이터센터에 1700억 규모 전력 설비 공급 스타스테크, 콜라겐 스킨케어 ‘라보페’ 리브랜딩...국내외 유통망 확장 네이버 사우디 직원들 다시 사무실로…중동 사업 재궤도 올해는 결론 나오나…배달앱 사회적 대화기구 재출범부터 ‘균열’ [이종천] 2026년 통신시장, 아직 단통법 시절 ‘금난전권’ 그림자에 갇혀 있는가 KOSA, 의료·바이오 AI 인재 양성…실무형 교육 강화 빅밸류, 10년 만 첫 흑자…"올해 매출 100억원 목표" 트럼프, 호르무즈 해협 봉쇄령…"이란에 통행료 낸 선박 차단" 우리 동네 교통·안전 문제, ‘도시 데이터’로 해결 환경분야 시험·검사 전문성 ↑…산업계 수요 반영, 고난도 분석기술 교육 靑 "종전선언까지 비상대응...매점매석 금지 추가검토" "D램 가격 상승률, 1분기 70%→2분기 30~50%로 둔화 전망" "판교 정보보호클러스터 확 달라져"...9년만에 시설 대폭 개선 보안 개념이 바뀐다...'미토스 보고서' 7월 발표 벤츠, 전국 어디서나 같은 가격…다이렉트 직판제 전환 스타링크 위성 인터넷이 이동통신 결합상품으로 전기차 타이어, 내연기관보다 더 빨리 닳는 이유 [ZD브리핑] 삼성 TV 신제품 발표...AIDC 특별법 논의 속도 조선소 파운데이션 모델 개발 400억원 투입…산업현장 적용 추진 외식업 평균 차액가맹금 2600만원…가장 높은 곳은 치킨 GIST 에너지 전주기 연구체계 구축 "시동" 가맹점 수 1위는 '메가커피'...평균 매출액 1위는 '투썸' 풀무원, 파주 탄현면 일대 '평화의 숲' 가꾸기 진행 장애물 대응 "사람처럼"…4족보행로봇 상용 제어기 선보여 가맹산업 다시 성장 궤도…본부·브랜드·가맹점 수 일제히 증가 자율로봇 학습용 영상, 모자이크없이 원본 활용 가능해진다 연구개발특구, 2030까지 코스닥 400개, 매출 150조원 달성 삼성전자, 에어컨 생산라인 풀가동... 에어컨 수요 급증 대비 [SW키트] 전기차 설계 혁신, 다쏘시스템 '버추얼 트윈'서 나온다 [써보고서] 와이파이 끊어도 AI는 살아있다…구글 'AI 엣지 갤러리' 미·이란 종전협상 결렬...밴스 "핵 포기 확약 못받아" 중동 위기, 재생에너지 전환 불 지폈지만…구조적 제약 여전 KT, 온라인 전용 인터넷 요금제 출시 박윤영 KT, 부산 해저케이블 육양국 점검 미·이란 협상 긴장에도 비트코인 횡보…7만달러선 지켜 '미토스'에 미 백안관도 "사이버보안 비상" LGU+, 내일부터 유심 업데이트-무료 교체 [르포] 금융권 개발자들의 치열한 AI 경쟁…'AWS 게임데이' 가보니 에코프로, 캐나다서 리튬 메탈 음극재 R&D 지원금 64억원 획득 미국-이란 1차 회담 지속…아직 결론 못내 하나은행 '하나원큐', 일상 플랫폼으로 고도화 "이 선물 싫어" 화내는 아이...당신이 부모라면? "잘 팔리는 것 더 많이 팔자"…GS25 상품전략 공유회 가보니 MS 엑스박스, 업적 기능 개편…인사이더 대상 테스트 돌입 '은랑 LV.999' 뜬다…호요버스 '붕괴: 스타레일', 파격 보상 앞세워 3주년 축제 락스타게임즈, 해킹 사건 확인...해커 측 "돈 안 내면 정보 공개" '미토스'에 놀란 세계..."사이버보안 새 시대 예고" 쿠팡, 지방 물류센터 청년 일자리 더 늘린다 스테이블코인 시대, 달러는 질주…원화는 전략 '부재' 동진쎄미켐, "美신너 공장 하반기 양산 가동"...삼성전자와 특허 공동 출원 10만~60만 고유가 피해지원금...취약계층 27일부터 지급 "더러운 빙산인 줄 알았는데"…남극서 미지의 섬 발견 개보위 공무원들 "함께 모여 AI 공부"...'AX 엔진룸' 운영 콘텍트 렌즈로 시선 추적한다…"배터리·센서 필요없어" "AI는 실행, 사람은 설계"…넥써쓰, '위대한 기업' 향한 AX 전략 그래핀에 레이저 쐈더니 ‘가속’…무연료 우주선 가능할까 [우주로 간다] [피지컬AI 윤리] 재난·치안 로봇과 칸트의 정언 명령 NASA 유인우주선 ‘아르테미스 2호’ 무사 귀환 테슬라, 네덜란드서 FSD 사용 승인…유럽 서비스 확대 예고 TSMC, 1분기 최대 실적 경신…AI칩 호황 증명 개보위, 행안부 등과 개인정보 전송 안전성 강화 간담회 이연수 NC AI 대표 "모두가 크리에이터…다른 기업과 협력 원해" [AI는 지금] 엔비디아, GPU 시장서 86% 독주 가능한 까닭은 중기부 추경 1조6900억 확정...스타트업에 6719억 SKT, CPU에 NPU 더해 AI 추론 서버 성능 검증 과기정통부 추경 787억원 확정...청년 창업지원-전통기업 AX 확대 26.2조 전쟁추경 국회 통과...국민 70%에 10만~60만원 지원 메모리 품귀 '장기화' 진입… 韓 팹리스 수급난 고조 [박준성의 SW] AI 에이전트 아키텍처는? [안광섭의 AI 진테제] AI시대 디딤돌과 걸림돌 "300도에도 안 터진다"…열폭주 차단한 나트륨 배터리 나왔다 [영상] "아이폰 울트라, 배터리·두께 모두 잡았다" [카드뉴스] 중동전쟁, 왜 멈추지 않을까 쏠리드, 6G 국책과제 'AI-Native 무선 인터페이스 개발' 주관기관 선정 ETRI 원장 후보 김봉태·박세웅·백용순 박사 선정 LGU+, AWS 기반 AI 플랫폼 구축...인프라 운영 자동화 슈퍼센트 "게임사 넘어 '콘텐츠 테크 기업'으로…핵심 동력은 AI" HKC, 6세대 OLED 투자 '안갯속' 네이버, 빅테크 챗봇 경쟁 접고 생태계 AI 전략 시동 건다 [ZD SW투데이] 뉴엔AI '퀘타' 모델, K-AI 리더보드 종합 1위 外 배민, 5조 클럽 가입…4900억 자사주 소각해 주주환원 LG헬로비전, ‘어디든 간대호’ 연장 편성 넷마블 '왕좌의게임: 킹스로드', 온라인 쇼케이스 티저 영상 공개 '정보 유출' 롯데카드 4.5개월 영업정지 통지에 MBK 책임론 재점화 'K-AI 설계자'에 1000만원 쏜 과기부…배경훈, 행안부 커피차에 '깜놀'
더 강력한 3D AI 로봇이 멍청해진 이유는..."바로 코드 두 줄 때문"
AI 에디터 · 2026-04-29 · via ZDNet Korea

더 크고 강력한 인공지능(AI) 모델일수록 로봇을 더 잘 움직일 것이라는 통념이 데이터 앞에서 무너졌다. 가벼운 옛날 모델조차 평균 성공률 1%에 그쳤고, 같은 조건에서 더 강력한 신형 3D 모델은 0%로 더 무너졌다. 

저장대(浙江大学)와 상하이과기대(ShanghaiTech University) 공동 연구팀이 2026년 4월 발표한 논문 'R3D: Revisiting 3D Policy Learning'은 그 원인이 모델의 한계가 아니라, 모두가 무심코 사용해온 두 가지 기술적 관행에 있었다고 지적한다. 이 발견은 자율 로봇과 산업용 매니퓰레이터(manipulator, 물건을 집고 옮기는 로봇 팔) 개발 속도에 직결된다.

강력한 3D 모델이 1% 성공률에 머문 스케일링 역설

3D 정책 학습(3D Policy Learning)이란 로봇이 카메라로 본 장면을 평면 이미지가 아닌 입체 점구름(point cloud, 공간상의 점 좌표 집합)으로 받아들여 행동을 결정하는 방식이다. 평면 이미지보다 거리감과 깊이를 정확히 파악할 수 있어 차세대 로봇 학습 방식으로 주목받아 왔다.

그러나 R3D 연구팀은 기존 연구에서 반복적으로 관찰된 기현상에 주목했다. 가벼운 옛날 신경망인 포인트넷(PointNet)으로 만든 정책이 더 크고 정교한 트랜스포머(Transformer) 기반 모델보다 일관되게 더 좋은 성능을 냈다는 점이다. 연구팀이 시험한 결과, 강력한 유니3D(Uni3D) 인코더를 그대로 적용한 3D 디퓨전 폴리시(DP3)는 다섯 개 양손 조작 과제 평균 성공률이 0%에 그쳤다. 같은 조건의 가벼운 포인트넷 버전도 1%에 머물렀고, 정규화 방식을 바꾼 뒤에야 포인트넷은 59.6%, 유니3D는 64.7%까지 올랐다. AI 업계의 상식인 "모델이 클수록 성능이 좋다"는 명제가 정반대 결과를 만들어낸 것이다.

배치 정규화 한 줄과 누락된 데이터 증강이라는 두 범인

원인은 모델 구조가 아니라 두 가지 사소한 구현 관행에 있었다. 첫째 범인은 배치 정규화(Batch Normalization, BN)였다. 배치 정규화란 신경망 학습 과정에서 데이터를 일정한 범위로 맞춰주는 표준 기법으로, 이미지 분야에서는 안정적으로 작동한다. 그러나 로봇 학습은 한 번에 학습시키는 데이터 묶음이 작고 변동이 심해 배치 정규화가 오히려 학습을 무너뜨린다. 연구팀이 배치 정규화를 레이어 정규화(Layer Normalization, LN, 한 데이터 안에서 정규화하는 방식)로 바꾸자, 0%에 머물던 강력한 모델의 성공률이 64.7%로 단번에 뛰었다.

둘째 범인은 3D 데이터 증강(Data Augmentation)의 부재였다. 데이터 증강이란 한 장의 데이터를 살짝 변형해 여러 장처럼 만들어 모델에게 다양한 상황을 학습시키는 기법이다. 평면 이미지 학습에서는 이미 표준이지만, 3D 학습에서는 거의 적용되지 않고 있었다. R3D 연구팀은 점구름 색상 흔들기, 좌표에 미세 잡음 추가, 점 일부 삭제 같은 세 가지 증강 기법을 도입했다. 그 결과 학습 곡선이 안정화되고 시간이 지날수록 성능이 떨어지던 과적합(overfitting) 현상이 사라졌다.

그림1. 증강 없이는 훈련이 진행될수록 성공률이 떨어진다

공간 해상도를 압축하지 않은 디퓨전 트랜스포머의 78% 성능

R3D 연구팀은 두 범인 제거에 더해, 3D 정보를 끝까지 압축하지 않는 새로운 구조를 설계했다. 기존 DP3는 점구름 전체를 하나의 짧은 요약 벡터로 압축한 뒤 이를 행동 결정에 사용했다. 한 장면의 모든 디테일이 한 줄짜리 요약문으로 줄어든 셈이다.

R3D는 점구름을 여러 개의 패치(patch, 작은 조각)로 나누고, 각 패치의 위치와 모양 정보를 그대로 디퓨전 트랜스포머(Diffusion Transformer)라는 행동 생성 모듈에 넘긴다. 디퓨전 트랜스포머는 노이즈에서 출발해 점차 깨끗한 행동을 만들어내는 생성형 AI 구조로, 이미지 생성 모델과 같은 원리다. 행동을 만드는 과정에서 모델이 손잡이의 정확한 위치, 그릇의 가장자리 같은 세부 영역에 직접 주의를 기울일 수 있게 된 것이다. 

그 결과 동일한 인코더라도 이 구조를 적용했을 때 평균 성공률이 62.5%에서 77.5%로 상승했다. 여기에 로봇 관절각과 함께 손끝 위치까지 동시에 예측하는 보조 학습을 추가하자 79.75%까지 올라갔다.

디스코 조명 아래에서도 58.7%를 지킨 실제 로봇 검증

연구팀은 시뮬레이션을 넘어 실제 로봇 팔(xArm6)과 두 대의 깊이 카메라(Intel RealSense D435)로 실험을 진행했다. 케틀(주전자)을 가스레인지에 올리기, 서랍 열기, 수건 접기 세 가지 과제에서 R3D의 평균 성공률은 68.7%를 기록했다. 비교 대상이었던 최신 모델 메니플로(ManiFlow)는 47.3%, 파이제로(Pi0)는 52.0%에 머물렀다.

특히 인상적인 결과는 디스코 조명을 켜고 색상이 시시각각 변하는 환경에서의 시험이었다. 빛이 변하면 카메라가 잡는 색상도 달라져 모든 모델의 성능이 떨어졌지만, R3D는 58.7%를 유지한 반면 메니플로는 40.7%, DP3는 30.7%로 무너졌다. 약 18%포인트의 차이는 단순 수치로 보일 수 있지만, 실제 가정이나 물류창고처럼 조명이 일정하지 않은 현장에서는 로봇이 멈추느냐 작업을 끝내느냐를 가르는 격차가 된다. 카메라를 한 대만 쓸 때와 두 대 쓸 때의 비교에서도 R3D는 두 설정 모두에서 가장 높은 성공률을 보였다.

에디터 해석, 모델 키우기 경쟁이 끝나가는 신호일 가능성

R3D의 결과는 AI 업계가 경쟁적으로 모델 크기를 키워온 흐름과는 결이 다른 신호로 읽힐 가능성이 있다. 더 큰 모델이 더 나은 성능을 보장하지 않으며, 학습 안정성과 데이터 다양성 같은 기초 요소가 오히려 결정적이라는 점이 드러났기 때문이다. 다만 이 발견이 다른 AI 분야에까지 일반화될지는 두고 볼 필요가 있다. 논문은 양손 조작과 정밀 삽입 같은 특정 로봇 과제에 한정해 검증했으며, 자연어 처리나 이미지 생성처럼 데이터 규모가 훨씬 큰 영역에서는 다른 결론이 나올 수도 있다.

또한 이번 연구가 제시한 R3D 구조는 사전학습 데이터셋과 모델 크기, 카메라 구성에 따라 최적값이 달라진다는 점도 함께 보고됐다. 1024개 점에서는 ViT-tiny가, 8192개 점에서는 ViT-small이 가장 좋은 성능을 보인 결과는 모든 환경에 들어맞는 단일 정답이 없다는 의미로도 읽힌다. 로봇 정책 학습이 새로운 기반을 갖게 된 것은 분명하지만, 어떤 환경에 어떤 설정이 맞는지를 찾는 후속 연구가 이어질 것으로 보인다.

FAQ(이 FAQ는 본지가 리포트를 참고해 자체 작성한 내용입니다.)

Q1. 3D 정책 학습이 기존 2D 학습보다 좋은 점은 무엇인가요?

A1. 3D 정책 학습은 로봇이 평면 이미지가 아닌 입체 정보로 세상을 인식합니다. 덕분에 카메라 각도가 바뀌어도 흔들리지 않고, 로봇 종류가 달라져도 학습한 기술을 그대로 옮겨 쓸 수 있습니다. 거리감과 깊이를 정확히 파악할 수 있어 정밀한 조립이나 잡기 작업에 유리합니다.

Q2. R3D가 발견한 두 가지 핵심 개선점은 무엇인가요?

A2. 첫째는 배치 정규화 대신 레이어 정규화를 사용하는 것입니다. 로봇 학습은 데이터 변동이 커서 배치 정규화가 학습을 망치기 때문입니다. 둘째는 3D 데이터 증강을 도입하는 것입니다. 점구름의 색상과 위치를 살짝 흔들어 다양한 상황을 학습시키면 모델이 새로운 환경에서도 안정적으로 작동합니다.

Q3. 이 연구가 일반 사용자에게 어떤 영향을 미칠 수 있나요?

관련기사

A3. 가정용 로봇이나 물류 창고 로봇처럼 조명이 일정하지 않은 환경에서 로봇이 더 안정적으로 작동할 수 있게 됩니다. 또한 같은 학습 데이터로도 더 정확하게 작업하는 로봇을 만들 수 있어, 로봇 도입 비용을 낮추고 활용 범위를 넓히는 데 기여할 수 있습니다.

■ 이 기사는 AI 전문 매체 ‘AI 매터스’와 제휴를 통해 제공됩니다. 기사는 클로드 3.5 소네트와 챗GPT를 활용해 작성되었습니다. (☞ 기사 원문 바로가기)