惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
WordPress大学
WordPress大学
人人都是产品经理
人人都是产品经理
Engineering at Meta
Engineering at Meta
小众软件
小众软件
I
InfoQ
有赞技术团队
有赞技术团队
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Martin Fowler
Martin Fowler
月光博客
月光博客
雷峰网
雷峰网
aimingoo的专栏
aimingoo的专栏
云风的 BLOG
云风的 BLOG
Last Week in AI
Last Week in AI
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
S
SegmentFault 最新的问题
The GitHub Blog
The GitHub Blog
Y
Y Combinator Blog
V
Visual Studio Blog
博客园 - 叶小钗
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
GbyAI
GbyAI
P
Proofpoint News Feed
Apple Machine Learning Research
Apple Machine Learning Research

ZDNet Korea

여기어때, 해양 관광 레저·티켓 할인 쿠폰 쏜다 11번가, 5월 바다여행지 숙박·체험 상품 할인 패스트파이브, 작년 매출 1500억원·영업익 60억원 혼다코리아, '뉴 파일럿 블랙 에디션' 사전 계약…7880만원 카카오엔터 추천 4월 화제의 신작 웹툰 4선 휴먼컨설팅그룹, 연구개발 허브 ‘양재센터’ 신설 더벤처스, K뷰티 '클레버스텝스' 시드 투자 민주당 "지방선거 이후 디지털자산기본법 논의 본격화" KFC, 가맹점주 대상 프랜차이즈 컨벤션 개최 스타벅스, 장애인의 날 맞아 공모전 수상작 굿즈 출시 "URL 포함된 고유가 지원금 알림 문자는 사기" 2025년 원화 결제 수출 비중 3.4%…역대 최고 삼양사, 국제베이커리페어 첫 참가…냉동생지 ‘프레팡’ 공개 문체부 콘텐츠 R&D 확대, 현장 체감은 엔비디아, '빌드 어 클로' 한국 첫 공개…"AI 에이전트 직접 구축" LS일렉트릭, 북미 데이터센터에 1700억 규모 전력 설비 공급 스타스테크, 콜라겐 스킨케어 ‘라보페’ 리브랜딩...국내외 유통망 확장 네이버 사우디 직원들 다시 사무실로…중동 사업 재궤도 올해는 결론 나오나…배달앱 사회적 대화기구 재출범부터 ‘균열’ [이종천] 2026년 통신시장, 아직 단통법 시절 ‘금난전권’ 그림자에 갇혀 있는가 KOSA, 의료·바이오 AI 인재 양성…실무형 교육 강화 빅밸류, 10년 만 첫 흑자…"올해 매출 100억원 목표" 트럼프, 호르무즈 해협 봉쇄령…"이란에 통행료 낸 선박 차단" 우리 동네 교통·안전 문제, ‘도시 데이터’로 해결 환경분야 시험·검사 전문성 ↑…산업계 수요 반영, 고난도 분석기술 교육 靑 "종전선언까지 비상대응...매점매석 금지 추가검토" "D램 가격 상승률, 1분기 70%→2분기 30~50%로 둔화 전망" "판교 정보보호클러스터 확 달라져"...9년만에 시설 대폭 개선 보안 개념이 바뀐다...'미토스 보고서' 7월 발표 벤츠, 전국 어디서나 같은 가격…다이렉트 직판제 전환
AMD, 인스팅트 MI350P PCIe GPU 출시
권봉석 기자 · 2026-05-08 · via ZDNet Korea

AMD가 8일 기업용 AI 추론 시장을 겨냥한 GPU 가속기 '인스팅트 MI350P PCIe'를 출시했다.

인스팅트 MI350P PCIe는 4세대 CDNA 아키텍처 기반 MI350 GPU를 활용한 제품으로 PCI 익스프레스 5.0 규격을 지원하는 서버와 워크스테이션용으로 설계됐다.

듀얼 슬롯 디자인으로 한 노드 당 최대 8개 GPU를 설치할 수 있고 기존 데이터센터를 유지하며 생성 AI와 에이전틱 AI 연산 역량을 강화할 수 있다.

인스팅트 MI350P PCIe. (사진=AMD)

HBM3E 메모리 144GB로 최대 4TB/s 메모리 대역폭을 갖춰 거대언어모델(LLM)과 증강검색(RAG) 워크로드 처리에 최적화됐다. 한 GPU에 최대 2500억개 매개변수 LLM을 로드해 실행할 수 있다.

관련기사

지원하는 자료형은 FP8, MXFP8, MXFP6, MXFP4 등 저정밀도 등을 지원해 추론 속도를 노였고 INT8·BF16에서는 희소성(sparsity) 가속을 통해 전력 효율과 처리량을 개선한다. 연산 성능은 MXFP4 기준 최대 4.6PFLOPS, MXFP8 기준 2.3PFLOPS다.

델테크놀로지스, HPE, 레노버, 시스코, 레드햇 등 주요 서버 제조사·소프트웨어 공급사가 지원 예정이다.