惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

人人都是产品经理
人人都是产品经理
Apple Machine Learning Research
Apple Machine Learning Research
云风的 BLOG
云风的 BLOG
罗磊的独立博客
博客园 - 三生石上(FineUI控件)
量子位
GbyAI
GbyAI
腾讯CDC
T
Tailwind CSS Blog
博客园 - Franky
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
D
Docker
G
Google Developers Blog
aimingoo的专栏
aimingoo的专栏
The GitHub Blog
The GitHub Blog
Microsoft Security Blog
Microsoft Security Blog
Stack Overflow Blog
Stack Overflow Blog
Hugging Face - Blog
Hugging Face - Blog
小众软件
小众软件
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
N
Netflix TechBlog - Medium
Jina AI
Jina AI
IT之家
IT之家
Y
Y Combinator Blog

ZDNet Korea

여기어때, 해양 관광 레저·티켓 할인 쿠폰 쏜다 11번가, 5월 바다여행지 숙박·체험 상품 할인 패스트파이브, 작년 매출 1500억원·영업익 60억원 혼다코리아, '뉴 파일럿 블랙 에디션' 사전 계약…7880만원 카카오엔터 추천 4월 화제의 신작 웹툰 4선 휴먼컨설팅그룹, 연구개발 허브 ‘양재센터’ 신설 더벤처스, K뷰티 '클레버스텝스' 시드 투자 민주당 "지방선거 이후 디지털자산기본법 논의 본격화" KFC, 가맹점주 대상 프랜차이즈 컨벤션 개최 스타벅스, 장애인의 날 맞아 공모전 수상작 굿즈 출시 "URL 포함된 고유가 지원금 알림 문자는 사기" 2025년 원화 결제 수출 비중 3.4%…역대 최고 삼양사, 국제베이커리페어 첫 참가…냉동생지 ‘프레팡’ 공개 문체부 콘텐츠 R&D 확대, 현장 체감은 엔비디아, '빌드 어 클로' 한국 첫 공개…"AI 에이전트 직접 구축" LS일렉트릭, 북미 데이터센터에 1700억 규모 전력 설비 공급 스타스테크, 콜라겐 스킨케어 ‘라보페’ 리브랜딩...국내외 유통망 확장 네이버 사우디 직원들 다시 사무실로…중동 사업 재궤도 올해는 결론 나오나…배달앱 사회적 대화기구 재출범부터 ‘균열’ [이종천] 2026년 통신시장, 아직 단통법 시절 ‘금난전권’ 그림자에 갇혀 있는가 KOSA, 의료·바이오 AI 인재 양성…실무형 교육 강화 빅밸류, 10년 만 첫 흑자…"올해 매출 100억원 목표" 트럼프, 호르무즈 해협 봉쇄령…"이란에 통행료 낸 선박 차단" 우리 동네 교통·안전 문제, ‘도시 데이터’로 해결 환경분야 시험·검사 전문성 ↑…산업계 수요 반영, 고난도 분석기술 교육 靑 "종전선언까지 비상대응...매점매석 금지 추가검토" "D램 가격 상승률, 1분기 70%→2분기 30~50%로 둔화 전망" "판교 정보보호클러스터 확 달라져"...9년만에 시설 대폭 개선 보안 개념이 바뀐다...'미토스 보고서' 7월 발표 벤츠, 전국 어디서나 같은 가격…다이렉트 직판제 전환
검증 모델 부족해 확산 제약…정부, AI 에이전트·MCP 안전망 ...
이나연 기자 · 2026-05-11 · via ZDNet Korea

과학기술정보통신부와 한국지능정보사회진흥원(NIA)이 인공지능(AI) 에이전트 성능 평가·벤치마크와 모델 컨텍스트 프로토콜(MCP) 안전·신뢰 검증 체계를 올해 안에 구축한다. 쇼핑·금융·예약·코딩 등 실생활 전 영역으로 에이전틱 AI 서비스가 빠르게 확산되는 가운데 이를 검증할 기반이 전무하다는 위기의식에 따른 대응이다. 

11일 업계에 따르면 NIA는 지난 6일부터 10일까지 'AI 에이전트 안전·신뢰성 검증 체계 지원' 사업 공모 안내서를 사전 공개했다. 사업은 과기정통부 소관으로 정부출연금 18억원을 투입하며 협약 체결일부터 오는 12월 31일까지 진행된다. 수행기관은 단독법인 또는 컨소시엄 형태로 1개를 선정한다. 

이번 사업은 AI 에이전트 마켓플레이스 개발 지원, AI 에이전트 및 활용 도구 개발·개방 지원과 함께 과기정통부 'AI 에이전트 인프라 및 생태계 조성 사업' 세 번째 세부 과제로 추진된다. 수행기관은 세 과제 중 하나에만 참여할 수 있으며 중복 지원은 허용되지 않는다. 세부 과제를 살펴보면 크게 AI 에이전트 성능 평가 프레임워크 구축 ▲AI 에이전트 성능 벤치마크 도구 개발 ▲MCP 안전·신뢰 검증 프레임워크 구축 세 축으로 구성된다.

AI 에이전트 안전·신뢰성 검증 체계 지원 공모 안내서 내 추진 체계 및 역할 갈무리 (사진=과학기술정보통신부, 한국지능정보사회진흥원)

AI 에이전트 성능 평가 프레임워크는 에이전트의 자율계획·도구 호출·다단계 실행 프로세스를 정량적으로 측정하는 체계다. 과업 성공률·도구 호출 정확도·실행 효율성(토큰 대비 비용·소요 시간 등) 등 핵심 지표를 수립하고, 국내 고유 응용프로그램인터페이스(API)·공공 데이터·결제 인프라 등 국내 서비스 환경과 한국어 문맥 이해를 반영한 평가 항목도 별도로 마련한다. 국제 표준을 준용한 에이전트 특화 평가 프로세스도 함께 수립한다.

벤치마크 도구는 다단계 추론 시나리오와 검증 데이터셋 5000건 이상을 구축해 에이전트 수행력을 객관적으로 측정한다. 최종 결과값의 정확도를 판단하는 규칙 기반 자동 채점과 실행 경로 기반 논리적 타당성 평가를 결합한 하이브리드 채점 체계를 적용한다. 외부 도구 호출·데이터 교환의 정확성을 검증하는 표준 규격 적합성 검증 기능도 탑재하며, 검증 결과와 통계를 담은 성능 평가 리포트 자동 생성 기능도 제공한다.

MCP 검증 프레임워크는 표준 적합성·상호운용성·안정성·보안성(인증·인가)·도구 기능 정확성 등을 검증하는 체계와 가이드라인으로 구성된다. 글로벌 MCP 표준 및 국내외 관련 표준과의 정합성을 검토해 검증 항목의 객관성을 확보하고, 산·학·연·관 전문가 280여개사로 구성된 에이전틱 AI 얼라이언스 안전·신뢰 분과를 통해 의견을 수렴한다. 개발·운영 기업이 참고할 수 있는 MCP 안전·신뢰 점검 가이드라인도 별도로 배포한다.

주목할 점은 사후 의무다. 선정된 수행기관은 사업 종료 후에도 개발 결과물인 MCP 안전·신뢰 검증 프레임워크와 AI 에이전트 성능 평가 프레임워크·벤치마크 도구를 최소 5년간 유지·운영해야 한다. 단기 구축에 그치지 않고 국내 에이전틱 AI 생태계의 지속적인 신뢰 기반으로 활용하겠다는 취지다. 

관련기사

다만 사전공개 단계인 만큼 사업 범위·예산·일정·평가항목 등 세부 내용은 본 공고 시 변경될 수 있다. 과기정통부와 NIA는 오는 27일 오후 2시 서울 중구 NIA 서울사무소에서 사업설명회를 예정이다. 

NIA는 "AI 에이전트가 외부 도구 및 데이터와 상호작용하는 과정에서 보안 위협과 예상치 못한 오작동에 대한 우려가 있다"며 "이용자 관점에서 AI 에이전트의 응답 정확도와 기능 실행 성공률 등을 확인할 수 있는 검증 모델이 부족해 서비스 확산에 제약이 존재한다"고 말했다.