惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Martin Fowler
Martin Fowler
博客园 - 三生石上(FineUI控件)
WordPress大学
WordPress大学
博客园_首页
宝玉的分享
宝玉的分享
S
SegmentFault 最新的问题
Jina AI
Jina AI
Hugging Face - Blog
Hugging Face - Blog
V
Visual Studio Blog
美团技术团队
IT之家
IT之家
罗磊的独立博客
Blog — PlanetScale
Blog — PlanetScale
Google DeepMind News
Google DeepMind News
月光博客
月光博客
Microsoft Azure Blog
Microsoft Azure Blog
H
Help Net Security
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Last Week in AI
Last Week in AI
博客园 - 叶小钗
M
MIT News - Artificial intelligence
B
Blog RSS Feed
有赞技术团队
有赞技术团队
Y
Y Combinator Blog

ZDNet Korea

여기어때, 해양 관광 레저·티켓 할인 쿠폰 쏜다 11번가, 5월 바다여행지 숙박·체험 상품 할인 패스트파이브, 작년 매출 1500억원·영업익 60억원 혼다코리아, '뉴 파일럿 블랙 에디션' 사전 계약…7880만원 카카오엔터 추천 4월 화제의 신작 웹툰 4선 휴먼컨설팅그룹, 연구개발 허브 ‘양재센터’ 신설 더벤처스, K뷰티 '클레버스텝스' 시드 투자 민주당 "지방선거 이후 디지털자산기본법 논의 본격화" KFC, 가맹점주 대상 프랜차이즈 컨벤션 개최 스타벅스, 장애인의 날 맞아 공모전 수상작 굿즈 출시 "URL 포함된 고유가 지원금 알림 문자는 사기" 2025년 원화 결제 수출 비중 3.4%…역대 최고 삼양사, 국제베이커리페어 첫 참가…냉동생지 ‘프레팡’ 공개 문체부 콘텐츠 R&D 확대, 현장 체감은 엔비디아, '빌드 어 클로' 한국 첫 공개…"AI 에이전트 직접 구축" LS일렉트릭, 북미 데이터센터에 1700억 규모 전력 설비 공급 스타스테크, 콜라겐 스킨케어 ‘라보페’ 리브랜딩...국내외 유통망 확장 네이버 사우디 직원들 다시 사무실로…중동 사업 재궤도 올해는 결론 나오나…배달앱 사회적 대화기구 재출범부터 ‘균열’ [이종천] 2026년 통신시장, 아직 단통법 시절 ‘금난전권’ 그림자에 갇혀 있는가 KOSA, 의료·바이오 AI 인재 양성…실무형 교육 강화 빅밸류, 10년 만 첫 흑자…"올해 매출 100억원 목표" 트럼프, 호르무즈 해협 봉쇄령…"이란에 통행료 낸 선박 차단" 우리 동네 교통·안전 문제, ‘도시 데이터’로 해결 환경분야 시험·검사 전문성 ↑…산업계 수요 반영, 고난도 분석기술 교육 靑 "종전선언까지 비상대응...매점매석 금지 추가검토" "D램 가격 상승률, 1분기 70%→2분기 30~50%로 둔화 전망" "판교 정보보호클러스터 확 달라져"...9년만에 시설 대폭 개선 보안 개념이 바뀐다...'미토스 보고서' 7월 발표 벤츠, 전국 어디서나 같은 가격…다이렉트 직판제 전환
"응급실 진단, AI가 의사 앞섰다"…하버드 연구 결과
이정현 미디어연구소 · 2026-05-05 · via ZDNet Korea

인공지능(AI)이 실제 응급실 사례에서 인간 의사보다 더 정확한 진단을 내렸다는 연구 결과가 발표돼 주목된다.

테크크런치 등 외신은 하버드 의과대학과 베스 이스라엘 디코니스 메디컬센터 공동 연구진이 진행한 연구가 국제 학술지 사이언스에 게재됐다고 최근 보도했다.

사진=클립아트코리아

연구진은 오픈AI의 추론 특화 AI 모델 ‘o1’과 ‘4o’의 진단 능력을 평가하기 위해 실제 응급실 환자 사례를 활용했다. 실험에서는 응급실을 찾은 환자 76명을 대상으로, 내과 전문의 두 명의 진단과 AI 모델의 진단을 비교했으며, 또 다른 전문의들이 블라인드 방식으로 이를 평가했다.

그 결과 o1 모델은 각 진단 단계에서 인간 의사와 GPT-4o 기반 모델을 상대로 동등하거나 더 우수한 성과를 보였다. 특히 환자 정보가 제한적인 초기 응급실 분류 단계에서 강점을 드러냈다. 연구진에 따르면 o1은 해당 단계에서 약 67%의 정확도를 기록해, 각각 55%와 50%를 기록한 인간 의사보다 높은 수치를 나타냈다.

치료 방향을 결정하는 환자 관리 평가에서도 격차는 컸다. o1 모델은 평균 89점을 기록한 반면, 의사들의 평균 점수는 34점에 그쳤다. 또한 의사가 AI의 도움을 받아도 점수는 크게 개선되지 않은 것으로 나타났다.

연구진은 이번 실험에서 별도의 데이터 전처리 없이 실제 전자 의료 기록과 동일한 정보를 AI에 제공했다고 강조했다.

다만 연구진은 이러한 결과가 AI가 실제 임상 환경에서 독립적으로 판단을 내릴 준비가 됐다는 의미는 아니라고 선을 그었다. 향후 실제 환자 치료 환경에서의 검증을 위한 전향적 임상시험이 필요하다고 밝혔다.

또한 이번 연구는 텍스트 기반 정보에 한정된 평가라는 점도 한계로 지적됐다. 연구진은 현재 AI 모델이 영상이나 신체 검사 등 비텍스트 정보에 대한 추론 능력은 상대적으로 제한적이라고 설명했다.

관련기사

전문가들은 이에 신중한 접근이 필요하다고 강조했다. 연구 공동 저자인 아르준 만라이는 “AI 모델이 다양한 기준에서 기존 성능을 능가했다”고 평가했지만, 가디언과의 인터뷰에서 “현재로서는 책임 소재를 명확히 할 수 있는 제도적 틀이 부족하다”고 지적했다.

또 다른 응급의학과 의사 크리스틴 판타가니는 이번 연구가 내과 의사와 AI를 비교한 점을 언급하며 “실제 응급의학 전문의와의 비교가 필요하다”고 비판했다. 이어 “응급실에서 가장 중요한 것은 최종 진단이 아니라 생명을 위협하는 상태를 신속히 판단하는 것”이라고 강조했다.