AI 브리핑
기업과 기술의 중요한 변화를 계속 쌓아드려요
기술·시장 테마
AI 반도체
2026.09.10 업데이트 · 사건 11건
지금의 흐름
엔비디아가 NVLink Fusion과 Vera Rubin NVL72를 축으로 GPU·전력·스토리지·자본까지 아우르는 AI 팩토리 생태계를 빠르게 표준화하고 있어요.
핵심 변화
- 1커스텀 XPU 제조사의 NVIDIA 랙스케일 플랫폼 종속 심화
- 2GPU 공급자에서 전력·자본·부지까지 아우르는 인프라 총괄자로 확장
- 3칩·네트워킹·스토리지 전 계층의 자체 표준 주도권 장악
변화 타임라인
d-Matrix, NVIDIA NVLink Fusion 채택해 Raptor XPU 랙스케일 연동
AI 추론 칩 스타트업 d-Matrix가 차세대 Raptor XPU를 NVIDIA NVLink Fusion을 통해 NVLink 스케일업 네트워킹, MGX 랙 아키텍처, Spectrum-X 네트워킹에 연결하기로 발표했다. 이더넷 대비 XPU 간 지연시간 3배 감소, 패킷 처리율 10배 향상, XPU당 3TB/s 대역폭을 제공하며, AWS·Arm·Intel·Samsung 등도 NVLink Fusion 생태계에 참여한다.
왜 중요한가요? 커스텀 XPU 제조사가 자체 랙스케일 인프라 구축 없이 NVIDIA의 검증된 AI 팩토리 플랫폼에 직접 통합할 수 있게 되어, 맞춤형 반도체의 대규모 배포 장벽을 낮춘다.
NVIDIA, NVLink Fusion에 NVHBM 커스텀 HBM 기술 추가...AWS Trainium4부터 지원
NVIDIA가 메모리 컨트롤러를 HBM 베이스 다이에 통합한 NVHBM 기술을 NVLink Fusion 생태계에 추가했다. 표준 HBM4E 대비 최대 30% 대역폭 향상, 15% 전력 절감, XPU 컴퓨트 다이 면적 25% 절감을 제공하며, Amazon Annapurna Labs가 첫 협력사로 차세대 Trainium4부터 NVLink Fusion을 지원한다.
왜 중요한가요? 커스텀 AI 칩 제작사들이 메모리 성능·효율을 높이면서도 NVIDIA GPU와 공통 랙스케일 아키텍처로 상호운용할 수 있게 되어, 하이퍼스케일러의 자체 칩 개발과 NVIDIA 생태계 통합이 가속화된다.
OpenAI, 자체 추론 칩 'Jalapeño' 첫 성능 결과 공개
OpenAI가 자체 개발한 추론 전용 칩 Jalapeño의 첫 성능 결과를 공개했으며, 최신 AI 모델에서 더 높은 처리량과 낮은 지연 시간, 업계 최고 수준의 전력 효율성을 달성했다고 발표했다.
왜 중요한가요? OpenAI가 자체 실리콘 개발을 통해 AI 추론 비용과 성능을 직접 통제하려는 움직임으로, AI 반도체 공급망과 경쟁 구도에 영향을 줄 수 있다.
NVIDIA, Groq 3 LPX 정식 생산 돌입…Vera Rubin NVL72 기반 에이전틱 추론 가속
NVIDIA가 Vera Rubin NVL72 플랫폼과 결합되는 Groq 3 LPX 추론 하드웨어를 정식 생산에 돌입시켰다고 발표했다. Artificial Analysis 벤치마크에서 100,000토큰 장문맥 작업 기준 초당 3,400토큰을 생성해 경쟁 플랫폼보다 4배 빠른 성능을 기록했으며, Nebius가 이를 첫 도입한 AI 클라우드가 되었고 CoreWeave와 SpaceXAI도 관련 Vera Rubin 인프라를 도입했다.
왜 중요한가요? 에이전틱 AI 시스템의 장문맥·고처리량 추론 수요에 대응하는 전용 하드웨어가 실제 양산·배포 단계에 들어서면서 클라우드·인프라 업체들의 AI 팩토리 구축 경쟁이 가속화된다.
NVIDIA, Apollo·BlackRock·Blackstone 등과 5000억 달러 규모 AI 인프라 금융 플랫폼 구축
NVIDIA가 Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs, KKR와 파트너십을 맺고 AI 컴퓨팅 인프라 구축에 5000억 달러 이상의 제3자 자본을 조달하는 독립 금융 플랫폼을 신설했으며, 일부 경우 NVIDIA가 잔존가치를 최대 25%까지 보증한다.
왜 중요한가요? AI 데이터센터 구축이 개별 프로젝트 단위에서 대규모 기관 자본이 투입되는 반복 가능한 인프라 자산군으로 전환되는 신호로, AI 컴퓨팅 시장의 자금 조달 구조와 규모가 근본적으로 확대된다.
NVIDIA, 구글·MS와 800VDC AI 데이터센터 전력 아키텍처 공동 개발 및 MGX 호환 랙 발표
NVIDIA가 구글, 마이크로소프트와 Open Compute Project를 통해 800VDC 고전압 직류 전력 아키텍처를 공동 개발하고, 2026년 하반기 출시될 MGX 호환 800VDC 파워랙과 2027년 예정된 로우 파워 센터 등 단계별 로드맵을 공개했다. 80개 이상 기업이 이 표준에 맞춰 제품을 개발 중이다.
왜 중요한가요? AI 데이터센터의 전력 전달 효율을 높여 GPU 밀도와 컴퓨팅 성능 확장의 병목을 해소하는 인프라 표준으로, 기존 시설도 하이브리드 방식으로 업그레이드 가능해 대규모 AI 인프라 투자의 실질적 확장 경로를 제공한다.
엔비디아, 전력 인프라 기업 랜시엄에 최대 30억 달러 투자
엔비디아가 전력 인프라 개발업체 랜시엄 지분 약 20%를 20억 달러에 확보하고, 전력망 연결 등 조건 충족 시 10억 달러를 추가 투자해 지분을 최대 30%까지 늘리는 계약을 체결했다. 랜시엄의 텍사스 애빌린 캠퍼스는 스타게이트 프로젝트의 첫 가동 거점이다.
왜 중요한가요? 엔비디아가 GPU 공급을 넘어 데이터센터 부지와 전력망까지 직접 확보하며 AI 인프라 경쟁의 무게중심이 전력 확보로 이동하고 있음을 보여준다.
NVIDIA, cuFile API 오픈소스화 및 'Storage-Next' AI 스토리지 이니셔티브 발표
NVIDIA가 FMS 콘퍼런스에서 GPU가 스토리지에 직접 접근할 수 있게 하는 cuFile API와 그 하위 스토리지 소프트웨어 스택을 오픈소스로 공개했으며, 스토리지 업체들과 함께 GPU 중심의 AI 스토리지 표준을 만드는 'Storage-Next' 이니셔티브를 주도한다고 밝혔다. 또한 Vera BlueField-4 STX가 압축·암호화 파이프라인에서 x86 CPU보다 최대 3.21배 높은 처리량을 낸다는 벤치마크도 공개했다.
왜 중요한가요? AI 에이전트가 대량의 동시 스토리지 요청을 생성하는 환경에서 GPU 직접 스토리지 접근 표준화는 데이터센터 인프라 경제성과 AI 팩토리 성능에 직접적인 영향을 미친다.
NVIDIA, Spectrum-6 이더넷 스위치 시스템 출시…초당 102.4테라비트
엔비디아가 Vera Rubin 플랫폼용 네트워킹 제품인 Spectrum-6 이더넷 스위치 시스템을 공개했다. 초당 102.4테라비트 용량으로 이전 세대 대비 2배 성능을 제공하며 CoreWeave, Microsoft, Nebius, SpaceXAI, Tesla가 초기 도입 기업으로 참여한다.
왜 중요한가요? 대규모 GPU 클러스터의 네트워크 병목을 해소해 AI 학습·추론 속도와 비용 효율성을 높이는 인프라 발전으로, 주요 클라우드·AI 기업들의 즉시 도입이 확인된 구체적 제품 출시다.
NVIDIA, Vera Rubin NVL72 플랫폼 양산 개시…메가와트당 토큰처리량 10배 향상
NVIDIA가 Vera Rubin NVL72 플랫폼의 대량 생산을 시작해 CoreWeave, Google Cloud, Microsoft Azure, Oracle Cloud 등 파트너사에서 랙이 가동되고 있다. 7개 칩과 5개 랙 트레이를 하나의 시스템으로 공동설계했으며, DeepSeek-R1 벤치마크 기준 기존 Grace Blackwell NVL72 대비 메가와트당 처리량이 10배 높다. 6세대 NVLink와 Spectrum-6 이더넷 스위치, 코패키지 광학 스위치도 함께 도입됐다.
왜 중요한가요? 전력 제약이 있는 대규모 AI 데이터센터에서 토큰당 비용과 처리량을 크게 개선해 주요 클라우드 사업자들의 AI 인프라 확장 전략에 직접 영향을 미친다.
Wistron, 포트워스에 7억달러 규모 NVIDIA AI 시스템 생산 공장 개소
Wistron이 텍사스 포트워스에 미국 첫 생산시설(D1)을 개설하고 NVIDIA GB300 Grace Blackwell Ultra 슈퍼칩 생산을 시작했으며, 향후 Vera Rubin 슈퍼칩도 생산할 예정이다. 7억달러 투자로 500명 이상을 고용했고 연말까지 1000명으로 확대 계획이다.
왜 중요한가요? NVIDIA의 미국 내 5000억달러 AI 플랫폼 제조 공약의 일환으로, AI 반도체 공급망의 미국 현지화와 생산 능력 확대를 보여주는 구체적 사례이다.