
엔비디아의 차세대 AI 아키텍처인 베라 루빈(Vera Rubin) 기반 클라우드 인프라가 실전 프로덕션 환경에 처음 배치됐다.
AI 특화 클라우드 기업 코어위브(CoreWeave)는 샌프란시스코에서 열린 자체 컨퍼런스 '코어위브 풀리 커넥티드(CoreWeave Fully Connected)'에서 엔비디아 베라 루빈 NVL72 시스템의 클라우드 서비스를 상용화했다고 발표했다. 이번 시스템에는 초고속 스케일아웃 네트워크를 위한 스펙트럼-X(Spectrum-X) 102.4T 이더넷 네트워킹 기술이 결합됐다.
세계 최초의 자율형 AI 소프트웨어 엔지니어 '데빈(Devin)'을 개발한 응용 AI 연구소 코그니션(Cognition)이 베라 루빈 NVL72에서 실제 운영 워크로드를 돌리는 첫 번째 고객사로 참여한다.
코어위브는 9월 초 첫 베라 루빈 NVL72 프로덕션 랙을 수령한 직후 며칠 만에 코그니션 전용 클러스터 구축을 완료했다. 코그니션 엔지니어들은 프론티어코드(FrontierCode) 작업 일부에 AI 에이전트를 투입해 실제 개발 업무 환경을 구성하고, 이전 세대 플래그십인 GB200 NVL72 기반 인프라와 추론 성능을 다각도로 비교 검증했다.
초기 성능 측정 결과 베라 루빈 NVL72는 소프트웨어 엔지니어링 추론 워크로드(SWE-2)에서 GB200 NVL72 대비 전체 토큰 처리량을 최대 4.8배 끌어올린 것으로 집계됐다. 강화학습 워크로드에서도 출력 토큰 처리량이 3.8배 증가하는 성과를 나타냈다.
코그니션 측은 지난 9개월간 코어위브의 브릿지 용량에서 시작해 수천 개 규모의 GPU로 인프라를 넓혀왔으며, 데빈의 모델 학습부터 강화학습, 실전 프로덕션 추론에 이르는 전 과정을 코어위브 클라우드 위에서 운영하고 있다. 이번 베라 루빈 자원 역시 기존 인프라 환경과 동일하게 코어위브 쿠버네티스 서비스(CKS), SUNK, 미션 컨트롤, 샌드박스, 이너퍼런스 엔진을 통해 유연하게 제어된다.
AI 에이전트 연산 구동에 특화된 엔비디아 베라(Vera) CPU 공급 라인업도 한층 강화된다. 랙 단일 구성당 128개의 베라 CPU와 1만1264개 코어가 탑재되는 베라 배포 모델을 활용하면 코어당 1개 환경을 할당하는 방식으로 1만1000개가 넘는 에이전트 샌드박스 환경을 동시 운용할 수 있다. 하드웨어 격리 스택을 지원하는 스펙트럼-X 이더넷 스위치와 블루필드-4(BlueField-4) DPU가 결합되어 에이전트 간 통신 병목을 최소화한다.
엔비디아 베라 CPU 환경에서 진행된 내부 시험 결과, 에이전트 샌드박스의 초기 구동 시간이 3배 이상 단축된 것으로 확인됐다. 코딩 벤치마크인 터미널벤치(Terminal-Bench) 기준 전체 작업 수행 성능도 1.7배 개선됐다. 코어위브 샌드박스는 모델 평가, 에이전트 도구 활용, 강화학습을 위한 안전한 독립 실행 계층으로 쓰인다.
인프라 하드웨어 확장과 더불어 소프트웨어 생태계를 매끄럽게 연결하는 통합 개발 플랫폼 '코어위브 포지(CoreWeave Forge)'도 함께 공개됐다. 포지는 가시성 확보 도구인 앤바이어스(Weights & Biases), 오픈파이프(OpenPipe)의 모델 학습 후 처리 기술, 오픈소스 마리모(marimo) 노트북 환경을 하나의 워크플로우로 묶었다.
이와 함께 에이전트의 관측 데이터를 실시간 분석하는 '코어위브 에이전트 렌즈(Agent Lens)'도 공식 정식 서비스(GA)에 들어갔다. 에이전트 렌즈를 도입한 시스템은 프로덕션 시스템 내 장애 탐지율이 20% 향상되고 문제 수정 비용은 기존 대비 절반 수준으로 줄어든 것으로 나타났다.
서버리스 방식의 강화학습 파이프라인은 고객사가 직접 관리 환경을 구축하는 방식에 비해 학습 속도를 1.4배 높이고 비용을 40% 절감하는 효과를 입증했다. 엔비디아 디나모(Dynamo) 체계 역시 코어위브의 관리형 추론 서비스와 비공개 프리뷰 형태의 RL 롤아웃(Rollouts) 기능을 측면 지원한다. 캔바(Canva), 캐피털원(Capital One), 마스터클래스(MasterClass) 등이 포지 플랫폼을 사전 도입해 초기 운영을 시작했다.






