惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

The GitHub Blog
The GitHub Blog
A
About on SuperTechFans
The Cloudflare Blog
G
Google Developers Blog
博客园_首页
Martin Fowler
Martin Fowler
Apple Machine Learning Research
Apple Machine Learning Research
L
LangChain Blog
D
Docker
C
Check Point Blog
T
Tailwind CSS Blog
博客园 - 司徒正美
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Hugging Face - Blog
Hugging Face - Blog
Microsoft Security Blog
Microsoft Security Blog
V
V2EX
博客园 - 叶小钗
T
The Blog of Author Tim Ferriss
酷 壳 – CoolShell
酷 壳 – CoolShell
IT之家
IT之家
M
MIT News - Artificial intelligence
Microsoft Azure Blog
Microsoft Azure Blog
博客园 - 【当耐特】
GbyAI
GbyAI

ZDNet Korea

여기어때, 해양 관광 레저·티켓 할인 쿠폰 쏜다 11번가, 5월 바다여행지 숙박·체험 상품 할인 패스트파이브, 작년 매출 1500억원·영업익 60억원 혼다코리아, '뉴 파일럿 블랙 에디션' 사전 계약…7880만원 카카오엔터 추천 4월 화제의 신작 웹툰 4선 휴먼컨설팅그룹, 연구개발 허브 ‘양재센터’ 신설 더벤처스, K뷰티 '클레버스텝스' 시드 투자 민주당 "지방선거 이후 디지털자산기본법 논의 본격화" KFC, 가맹점주 대상 프랜차이즈 컨벤션 개최 스타벅스, 장애인의 날 맞아 공모전 수상작 굿즈 출시 "URL 포함된 고유가 지원금 알림 문자는 사기" 2025년 원화 결제 수출 비중 3.4%…역대 최고 삼양사, 국제베이커리페어 첫 참가…냉동생지 ‘프레팡’ 공개 문체부 콘텐츠 R&D 확대, 현장 체감은 엔비디아, '빌드 어 클로' 한국 첫 공개…"AI 에이전트 직접 구축" LS일렉트릭, 북미 데이터센터에 1700억 규모 전력 설비 공급 스타스테크, 콜라겐 스킨케어 ‘라보페’ 리브랜딩...국내외 유통망 확장 네이버 사우디 직원들 다시 사무실로…중동 사업 재궤도 올해는 결론 나오나…배달앱 사회적 대화기구 재출범부터 ‘균열’ [이종천] 2026년 통신시장, 아직 단통법 시절 ‘금난전권’ 그림자에 갇혀 있는가 KOSA, 의료·바이오 AI 인재 양성…실무형 교육 강화 빅밸류, 10년 만 첫 흑자…"올해 매출 100억원 목표" 트럼프, 호르무즈 해협 봉쇄령…"이란에 통행료 낸 선박 차단" 우리 동네 교통·안전 문제, ‘도시 데이터’로 해결 환경분야 시험·검사 전문성 ↑…산업계 수요 반영, 고난도 분석기술 교육 靑 "종전선언까지 비상대응...매점매석 금지 추가검토" "D램 가격 상승률, 1분기 70%→2분기 30~50%로 둔화 전망" "판교 정보보호클러스터 확 달라져"...9년만에 시설 대폭 개선 보안 개념이 바뀐다...'미토스 보고서' 7월 발표 벤츠, 전국 어디서나 같은 가격…다이렉트 직판제 전환
과기정통부, 묵혀둔 AI 데이터 생성형 AI용으로 되살린다
이나연 기자 · 2026-05-07 · via ZDNet Korea

과학기술정보통신부가 기존 판별형 인공지능(AI) 중심 라벨링 데이터를 추론·행동 정보를 포함하는 생성형 AI용 데이터로 전환하는 업사이클링 사업에 나선다.

과기정통부와 한국지능정보사회진흥원은 AI 허브에서 제공 중인 기존 학습용 데이터를 최신 생성형 AI 환경에 맞게 재가공하는 'AI 학습용데이터 업사이클링' 사업 공고를 지난달 30일 시작했다고 7일 밝혔다. 

이번 사업은 대규모언어모델(LLM)과 피지컬 AI 분야를 중심으로 총 30종 데이터셋을 재가공하는 데 30억원이 투입된다. 신규 구축 대비 예산 효율이 높다는 점도 장점으로 꼽힌다. 사업 대상은 AI 허브에 구축된 데이터 691종을 생성형 AI용 확장 가능성·활용도 기준으로 전수 분석하고 외부 전문가 검토를 거쳐 최종 30종을 선정했다.

과학기술정보통신부 (사진=뉴스1)

LLM 데이터 분야에선 기존 텍스트 데이터를 질문-근거 검토-오류 검증-답변 확정으로 이어지는 추론 과정을 포함하도록 재구성한다. 동일 문제에 대해 복수의 추론 경로를 구성하고 근거 기반 판단 및 오류 수정 과정을 포함해 복잡한 문제 해결이 가능한 추론형 AI 학습 기반을 마련한다.

피지컬 AI 분야에서는 기존 이미지·영상 데이터를 시각 정보(V)·언어 명령(L)·행동 및 제어(A)를 통합한 구조로 고도화한다. 객체 인식을 넘어 시간 흐름에 따른 상황 변화와 객체 간 상호작용을 이해하고 목표 기반 행동을 생성할 수 있도록 연속적 장면 정보와 객체 움직임 데이터를 활용해 행동 경로와 작업 목표를 정의하는 형태로 재구성한다.

관련기사

업사이클링된 데이터는 AI 허브 홈페이지를 통해 공개돼 기업·연구기관·스타트업 등이 자유롭게 활용할 수 있도록 제공될 예정이다.

최동원 과기정통부 인공지능인프라정책관은 "이번 업사이클링 사업으로 적은 비용으로도 최신 생성형 AI 기술 환경에 맞는 학습용 데이터를 확보할 수 있을 것"이라며 "이미 축적된 데이터 자산이 낭비되지 않도록 활용 가치를 끌어올리겠다"고 밝혔다.