惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

量子位
博客园_首页
Google DeepMind News
Google DeepMind News
博客园 - Franky
The GitHub Blog
The GitHub Blog
GbyAI
GbyAI
有赞技术团队
有赞技术团队
Microsoft Azure Blog
Microsoft Azure Blog
G
Google Developers Blog
Recent Announcements
Recent Announcements
A
About on SuperTechFans
博客园 - 【当耐特】
博客园 - 三生石上(FineUI控件)
酷 壳 – CoolShell
酷 壳 – CoolShell
美团技术团队
罗磊的独立博客
IT之家
IT之家
博客园 - 聂微东
Stack Overflow Blog
Stack Overflow Blog
Jina AI
Jina AI
腾讯CDC
P
Proofpoint News Feed
Hugging Face - Blog
Hugging Face - Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com

ZDNet Korea

여기어때, 해양 관광 레저·티켓 할인 쿠폰 쏜다 11번가, 5월 바다여행지 숙박·체험 상품 할인 패스트파이브, 작년 매출 1500억원·영업익 60억원 혼다코리아, '뉴 파일럿 블랙 에디션' 사전 계약…7880만원 카카오엔터 추천 4월 화제의 신작 웹툰 4선 휴먼컨설팅그룹, 연구개발 허브 ‘양재센터’ 신설 더벤처스, K뷰티 '클레버스텝스' 시드 투자 민주당 "지방선거 이후 디지털자산기본법 논의 본격화" KFC, 가맹점주 대상 프랜차이즈 컨벤션 개최 스타벅스, 장애인의 날 맞아 공모전 수상작 굿즈 출시 "URL 포함된 고유가 지원금 알림 문자는 사기" 2025년 원화 결제 수출 비중 3.4%…역대 최고 삼양사, 국제베이커리페어 첫 참가…냉동생지 ‘프레팡’ 공개 문체부 콘텐츠 R&D 확대, 현장 체감은 엔비디아, '빌드 어 클로' 한국 첫 공개…"AI 에이전트 직접 구축" LS일렉트릭, 북미 데이터센터에 1700억 규모 전력 설비 공급 스타스테크, 콜라겐 스킨케어 ‘라보페’ 리브랜딩...국내외 유통망 확장 네이버 사우디 직원들 다시 사무실로…중동 사업 재궤도 올해는 결론 나오나…배달앱 사회적 대화기구 재출범부터 ‘균열’ [이종천] 2026년 통신시장, 아직 단통법 시절 ‘금난전권’ 그림자에 갇혀 있는가 KOSA, 의료·바이오 AI 인재 양성…실무형 교육 강화 빅밸류, 10년 만 첫 흑자…"올해 매출 100억원 목표" 트럼프, 호르무즈 해협 봉쇄령…"이란에 통행료 낸 선박 차단" 우리 동네 교통·안전 문제, ‘도시 데이터’로 해결 환경분야 시험·검사 전문성 ↑…산업계 수요 반영, 고난도 분석기술 교육 靑 "종전선언까지 비상대응...매점매석 금지 추가검토" "D램 가격 상승률, 1분기 70%→2분기 30~50%로 둔화 전망" "판교 정보보호클러스터 확 달라져"...9년만에 시설 대폭 개선 보안 개념이 바뀐다...'미토스 보고서' 7월 발표 벤츠, 전국 어디서나 같은 가격…다이렉트 직판제 전환
엔비디아-AWS, 협력 확대…AI 추론·벡터 검색 지원
김미정 · 2026-06-24 · via ZDNet Korea

엔비디아와 아마존웹서비스(AWS)가 기업용 인공지능(AI) 추론과 벡터 검색, 대규모 학습 환경을 업그레이드했다. 

엔비디아는 '아마존 EC2'와 '아마존 오픈서치' 전반에 엔비디아 AI 인프라 적용 범위를 넓혔다고 24일 공식 홈페이지에서 밝혔다. 핵심은 엔비디아 블랙웰 기반 그래픽처리장치(GPU)를 탑재한 'EC2 G7 인스턴스'와 '엔비디아 cuVS' 기반 오픈서치 서버리스 벡터 검색 가속이다.

아마존 EC2 G7 인스턴스는 엔비디아 RTX 프로 4500 블랙웰 서버 에디션 GPU를 기반으로 작동한다. AI 추론과 그래픽, 공간 컴퓨팅, GPU 가속 데이터 분석 업무를 겨냥한 신규 인스턴스다.

젠슨 황 엔비디아 최고경영자(CEO)

G7은 기존 G6 인스턴스와 비교해 AI 추론 성능을 최대 4.6배 높였다. 그래픽 성능은 최대 2.1배 향상됐다. 아마존 EMR에서 엔비디아 cuDF 라이브러리를 활용한 아파치 스파크 업무도 더 빠르게 처리할 수 있다.

G7 인스턴스는 최대 8개 GPU와 총 256기가바이트(GB) GPU 메모리, 초당 700기가비트(Gbps) EFA 지원 네트워킹, 최대 7.6테라바이트(TB) 로컬 NVMe SSD 스토리지를 지원한다. 1개, 2개, 4개, 8개 GPU 구성과 베어메탈 구성을 제공해 기업이 업무에 맞춰 인프라를 선택할 수 있도록 했다.

이를 통해 AI 개발팀은 낮은 지연시간에 추론 환경을 구축할 수 있으며, 미디어·엔터테인먼트 기업은 고해상도 영상 제작과 렌더링 업무에 활용할 수 있다. 시뮬레이션과 컴퓨터 지원 설계, 가상 데스크톱 인프라, 게임, 공간 컴퓨팅 분야도 같은 인스턴스를 쓸 수 있다.

AWS는 오픈서치 서버리스에도 엔비디아 cuVS를 적용했다. 차세대 아마존 오픈서치 서버리스는 모든 벡터 컬렉션에서 GPU 가속 벡터 인덱싱을 기본 컴퓨팅 방식으로 사용한다.

이는 검색증강생성(RAG), 의미 기반 검색, 추천 시스템, 에이전틱 AI 애플리케이션을 구축하는 기업에 의미가 크다. 기존에는 별도 최적화 프로젝트에 가까웠던 GPU 기반 벡터 검색을 AWS 기본 기능처럼 활용할 수 있기 때문이다.

관련기사

엔비디아는 cuVS 적용으로 벡터 인덱싱 속도가 중앙처리장치(CPU) 기반 방식보다 최대 10배 빨라지고, 비용은 4분의 1 수준으로 낮아질 수 있다고 설명했다. 이를 통해 수십억 단위 벡터 데이터베이스(DB)도 1시간 내에 구축할 수 있다고 밝혔다.

엔비디아는 "이번 협력은 AWS의 AI 인프라 계층 전반을 강화하는 데 초점을 맞췄다"며 "운영 부담을 늘리지 않으면서 대규모로 작동하는 생산급 AI 인프라"라고 밝혔다.