TOKENPOST

엔비디아 베라 루빈, 코어위브 생산 투입…처리량 최대 4.8배

토포AI로 이 기사 더 깊이 읽기

AI 가속기 랙에 연결되는 광케이블과 작업자의 손 / TokenPost.ai (mono)

엔비디아($NVDA)의 베라 루빈 NVL72가 코어위브($CRWV) 클라우드에서 생산용 AI 작업에 투입됐다. Cognition은 해당 시스템에서 생산용 에이전트 AI 작업을 수행한 첫 고객으로 소개됐다.

코어위브는 공식 블로그에서 베라 루빈 NVL72를 제한적으로 제공하기 시작했으며, 여러 지역에 배치한 Rubin GPU를 기반으로 고객 작업을 생산 환경에 온보딩하고 있다고 밝혔다. Cognition의 SWE-2 추론 작업에서는 GB200 NVL72 대비 총 토큰 처리량이 최대 4.8배로 나타났다고 설명했다.

베라 루빈 NVL72는 72개 Rubin GPU와 36개 Vera CPU를 하나의 랙 단위 시스템으로 결합한 플랫폼이다. 코어위브는 Cognition이 랙 인수 후 며칠 안에 별도의 맞춤형 구축 작업 없이 생산용 작업을 시작했다고 밝혔다.

오늘의 스탬프0명이 오늘 찍었어요

댓글0

첫 댓글을 남겨 보세요.