惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

L
LangChain Blog
Recent Announcements
Recent Announcements
GbyAI
GbyAI
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Microsoft Azure Blog
Microsoft Azure Blog
N
Netflix TechBlog - Medium
人人都是产品经理
人人都是产品经理
MongoDB | Blog
MongoDB | Blog
D
DataBreaches.Net
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
WordPress大学
WordPress大学
U
Unit 42
腾讯CDC
D
Docker
The GitHub Blog
The GitHub Blog
阮一峰的网络日志
阮一峰的网络日志
Vercel News
Vercel News
I
InfoQ
Jina AI
Jina AI
爱范儿
爱范儿
宝玉的分享
宝玉的分享
博客园 - Franky
G
Google Developers Blog
P
Proofpoint News Feed

ZDNet Korea

여기어때, 해양 관광 레저·티켓 할인 쿠폰 쏜다 11번가, 5월 바다여행지 숙박·체험 상품 할인 패스트파이브, 작년 매출 1500억원·영업익 60억원 혼다코리아, '뉴 파일럿 블랙 에디션' 사전 계약…7880만원 카카오엔터 추천 4월 화제의 신작 웹툰 4선 휴먼컨설팅그룹, 연구개발 허브 ‘양재센터’ 신설 더벤처스, K뷰티 '클레버스텝스' 시드 투자 민주당 "지방선거 이후 디지털자산기본법 논의 본격화" KFC, 가맹점주 대상 프랜차이즈 컨벤션 개최 스타벅스, 장애인의 날 맞아 공모전 수상작 굿즈 출시 "URL 포함된 고유가 지원금 알림 문자는 사기" 2025년 원화 결제 수출 비중 3.4%…역대 최고 삼양사, 국제베이커리페어 첫 참가…냉동생지 ‘프레팡’ 공개 문체부 콘텐츠 R&D 확대, 현장 체감은 엔비디아, '빌드 어 클로' 한국 첫 공개…"AI 에이전트 직접 구축" LS일렉트릭, 북미 데이터센터에 1700억 규모 전력 설비 공급 스타스테크, 콜라겐 스킨케어 ‘라보페’ 리브랜딩...국내외 유통망 확장 네이버 사우디 직원들 다시 사무실로…중동 사업 재궤도 올해는 결론 나오나…배달앱 사회적 대화기구 재출범부터 ‘균열’ [이종천] 2026년 통신시장, 아직 단통법 시절 ‘금난전권’ 그림자에 갇혀 있는가 KOSA, 의료·바이오 AI 인재 양성…실무형 교육 강화 빅밸류, 10년 만 첫 흑자…"올해 매출 100억원 목표" 트럼프, 호르무즈 해협 봉쇄령…"이란에 통행료 낸 선박 차단" 우리 동네 교통·안전 문제, ‘도시 데이터’로 해결 환경분야 시험·검사 전문성 ↑…산업계 수요 반영, 고난도 분석기술 교육 靑 "종전선언까지 비상대응...매점매석 금지 추가검토" "D램 가격 상승률, 1분기 70%→2분기 30~50%로 둔화 전망" "판교 정보보호클러스터 확 달라져"...9년만에 시설 대폭 개선 보안 개념이 바뀐다...'미토스 보고서' 7월 발표 벤츠, 전국 어디서나 같은 가격…다이렉트 직판제 전환
구글 엔지니어 "GLM-5.2, 美 모델 증류 없이도 미토스급 간다"
AI 에디터 · 2026-06-25 · via ZDNet Korea

중국 Z.ai(지푸AI)의 오픈소스 모델 GLM-5.2가 클로드 오퍼스(Claude Opus 4.8)에 필적하는 코딩 성능으로 주목받고 있다. 구글 엔지니어 패트릭 툴메(Patrick Toulme)는 이 모델의 훈련 방식을 두고 “이제 중국 모델은 미국산 모델을 증류(distillation)하지 않고도 더 높은 성능에 도달할 수 있다”는 분석을 내놨다.

GLM-5.2는 6월 17일 MIT 라이선스로 공개된 약 750B(활성 약 40B) 규모의 전문가 혼합(MoE) 모델로, 100만 토큰 컨텍스트를 지원한다. 프런티어SWE에서 74.4%를 기록해 GPT-5.5를 앞섰고 클로드 오퍼스 4.8(75.1%)에 1%포인트 안쪽까지 따라붙었다. API 비용은 오퍼스의 약 6분의 1 수준이다.

툴메의 핵심 주장은 “증류가 성능을 만든 게 아니다”라는 것이다. 그는 증류가 강화학습(RL)의 ‘콜드 스타트’ 문제만 해결했다고 설명했다. 강화학습은 모델이 실제로 작업을 완수한 ‘성공 궤적(trajectory)’이 있어야 학습되는데, 어려운 작업에서는 성공 사례가 없어 학습이 막힌다. 더 똑똑한 클로드·GPT에서 지식을 주입해 일단 성공 궤적을 만들면, 그 궤적으로 RL을 돌려 에이전틱 코딩 능력을 점진적으로 끌어올릴 수 있다는 것이다.

그는 “맨바닥에서 오퍼스 4.8 수준에 도달하는 것이, 오퍼스 4.8에서 페이블·미토스 등급으로 올라가는 것보다 더 어렵다”며 “GLM-5.2는 이미 성공 궤적을 만들고 있어, 더는 증류 없이 강화학습만으로 미토스급까지 계속 올라갈 것”이라고 했다.

GLM-5.2는 벤치마크 점수뿐 아니라 실사용 코딩에서도 근접한 평가를 받는다. 다만 가장 어려운 추론 과제에서는 여전히 오퍼스 4.8에 뒤진다. 경량화도 빠르게 진행돼, 언슬로스(Unsloth)의 2비트 동적 양자화는 원본 대비 약 82% 정확도를 유지하면서 용량을 84% 줄였고, 1비트 버전도 76%대 정확도를 보였다. 큰 모델임에도 로컬 구동 비용을 크게 낮출 수 있다는 뜻이다.

앤트로픽이 알리바바의 클로드 무단 증류 의혹을 제기하는 등 증류 논쟁이 거센 시점에, 툴메의 분석은 “증류는 출발점일 뿐 결국 강화학습이 성능을 가른다”는 관점을 더한다.

자세한 내용은 OfficeChai에서 확인할 수 있다.

이미지 출처: Z.ai

관련기사

■ 이 기사는 AI 전문 매체 ‘AI 매터스’와 제휴를 통해 제공됩니다. 기사는 클로드 3.5 소네트와 챗GPT를 활용해 작성되었습니다. (☞ 기사 원문 바로가기)