AI 브리핑
기업과 기술의 중요한 변화를 계속 쌓아드려요
기업 테마
NVIDIA
2026.09.11 업데이트 · 사건 36건
지금의 흐름
엔비디아가 2026년 9월 허깅페이스 인수와 CUDA 생태계 확장, RTX 스파크 출시를 동시에 밀어붙이며 칩 제조사에서 AI 생태계 전체 지배자로 전환하고 있어요.
핵심 변화
- 1하드웨어 판매에서 소프트웨어·플랫폼 종속 구조로의 수익모델 전환
- 2데이터센터 중심에서 로컬 PC·엣지 디바이스로 확장되는 AI 배포 축
- 3경쟁 칩사와 개방형 표준(NVLink Fusion)으로 묶어 생태계 락인을 강화하는 전략
변화 타임라인
젠슨 황, 내년 70% 성장 자신감…"우리는 칩이 아니라 생태계를 판다"
젠슨 황 엔비디아 CEO는 골드만삭스 컨퍼런스에서 내년에도 매출이 전년 대비 70% 성장할 것이라고 자신했어요. 엔비디아는 단순 칩 제조사가 아니라 AI 생태계 전체를 아우르는 사업 구조로 전환했다는 점을 성장 자신감의 배경으로 제시했어요. 이번 회계연도 매출은 약 4000억달러로 마감될 것으로 예상돼요.
왜 중요한가요? Nvidia의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
NVIDIA Details BioNeMo Inference Runtime (BioIR): 2.90x Higher Boltz-2 Folding Throughput and 58.5K Residues per GPU-Hour on 8xH100
NVIDIA가 Boltz-2, OpenFold2, OpenFold3 등 단백질 구조 예측 모델의 추론을 가속하는 BioNeMo Inference Runtime(BioIR)을 공개했어요. 8xH100 기준 벤치마크에서 기존 torch.compile 기반 오픈소스 구현 대비 GPU-시간당 처리량이 2.90배(58.5K vs 20.2K 잔기) 향상됐고, AlphaFold Database 확장 작업에서 3,100만 개 후보 복합체 생성에 이미 실전 적용됐어요. GitHub에 오픈소스로 공개돼 있으며 표준 PyTorch 워크플로를 유지하면서 커널 선택, CUDA Graph 최적화, Ray 기반 다중 GPU 병렬화의 3단계 가속을 제공해요.
왜 중요한가요? Nvidia의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
Skild AI Taps NVIDIA Physical AI to Teach Robots New Tasks From a Single Video
Skild AI가 단일 비디오 시연만으로 로봇에 새로운 장기 작업을 가르치는 로봇 파운데이션 모델 S1을 출시했어요. 이 모델은 가중치 업데이트나 태스크별 재학습 없이 인컨텍스트 러닝 방식으로 동작하며, NVIDIA의 Isaac Lab, Cosmos, Omniverse 등 인프라를 활용해 개발됐어요. Skild는 첫 상업 배포 10개월 만에 연간 매출 1억 달러 규모에 도달했고, Foxconn과 함께 NVIDIA Blackwell 시스템 조립 공정에도 로봇을 배치하고 있어요.
왜 중요한가요? NVIDIA의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
[AI는 지금] AMD 추격에 '쿠다' 더 세졌다…엔비디아, AI SW 주도권 강화 가속
엔비디아가 쿠다 툴킷 13.4를 공개하며 차세대 GPU '루빈' 지원, 공유 GPU 관리 기능 강화, AI 코딩 에이전트 연동 등을 추가했어요. 멀티 프로세스 서비스(MPS) V3로 하나의 GPU를 여러 작업이 세밀하게 공유할 수 있게 됐고, 쿠다 MCP 서버를 통해 AI 코딩 에이전트가 쿠다 문서와 예제에 접근할 수 있어요. AMD도 ROCm 10과 ROCm.AI를 출시하며 추격에 나서면서 GPU 소프트웨어 생태계 경쟁이 치열해지고 있어요.
왜 중요한가요? Nvidia의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
d-Matrix, NVIDIA NVLink Fusion 채택해 Raptor XPU 랙스케일 연동
AI 추론 칩 스타트업 d-Matrix가 차세대 Raptor XPU를 NVIDIA NVLink Fusion을 통해 NVLink 스케일업 네트워킹, MGX 랙 아키텍처, Spectrum-X 네트워킹에 연결하기로 발표했다. 이더넷 대비 XPU 간 지연시간 3배 감소, 패킷 처리율 10배 향상, XPU당 3TB/s 대역폭을 제공하며, AWS·Arm·Intel·Samsung 등도 NVLink Fusion 생태계에 참여한다.
왜 중요한가요? 커스텀 XPU 제조사가 자체 랙스케일 인프라 구축 없이 NVIDIA의 검증된 AI 팩토리 플랫폼에 직접 통합할 수 있게 되어, 맞춤형 반도체의 대규모 배포 장벽을 낮춘다.
NVIDIA, IBC 2026에서 'AI for Media' 제품군 확장 발표 - 합성영상 탐지·비디오 슈퍼해상도 등
NVIDIA가 IBC 2026에서 방송·스포츠·스트리밍 워크플로우를 위한 NVIDIA AI for Media를 확장했다. 합성 영상 탐지(SVD) NIM 마이크로서비스의 정확도가 텍스트-투-비디오 99.3%, 이미지-투-비디오 97.7%로 향상됐고, 3D 신체 포즈 추정, 비디오 프레임 생성(VFG), 비디오 슈퍼 해상도(VSR), TrueHDR 등 GPU 가속 SDK가 추가됐다. Dalet, TwelveLabs, Wowza, Vizrt, Ross Video 등 파트너사가 이를 각자 플랫폼에 통합 중이다.
왜 중요한가요? 방송·스트리밍 업계가 콘텐츠 진위 검증, 컴플라이언스, 영상 품질 향상을 위해 AI를 실시간 프로덕션 워크플로우에 통합하는 실질적 사례로, NVIDIA의 미디어 산업 AI 생태계 확장을 보여준다.
엔비디아, GPU 커널까지 러스트로 개발하는 ‘CUDA 러스트’ 공개...안전한 AI 인프라 구축
엔비디아가 GPU 커널을 러스트 언어로 직접 작성해 네이티브 PTX 코드로 컴파일하는 'CUDA 러스트'를 공개했어요. 기존에는 러스트가 CUDA 커널을 호출하는 수준에 그쳤지만, 이번 발표로 GPU 커널 개발 자체에 러스트를 활용할 수 있게 됐어요. 엔비디아는 2027년 이후까지 관련 기술을 지속 발전시킬 계획이에요.
왜 중요한가요? Nvidia의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
NVIDIA Announces CUDA Rust with cuda-oxide (SIMT) and cutile-rs (Tile) for Compile-Time-Safe GPU Kernels
NVIDIA가 GPU 커널 작성에 Rust를 사용할 수 있도록 하는 CUDA Rust를 발표했어요. SIMT 모델을 위한 cuda-oxide와 Tile 모델을 위한 cutile-rs 두 오픈소스 프로젝트로 구성되며, 둘 다 Rust의 소유권 규칙을 활용해 컴파일 시점에 버퍼 앨리어싱 버그를 잡아내요. cutile-rs는 안정 버전 Rust에서 동작하며 Hugging Face의 Grout, mistral.rs에서 이미 사용되고 있지만 두 프로젝트 모두 아직 알파 단계로 프로덕션 사용은 확정되지 않았어요.
왜 중요한가요? Nvidia의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
브룩필드, 네이버 AI 팩토리 '전략적 파트너십' 공식화
글로벌 자산운용사 브룩필드가 네이버, 엔비디아와 함께 추진하는 한국 소버린 AI 팩토리 구축 협력을 공식적인 전략적 파트너십으로 발표했어요. 브룩필드는 이번 협력을 자사 사업의 주요 파트너십으로 공식화했어요.
왜 중요한가요? Nvidia의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
엔비디아·크라우드스트라이크, 사이버보안 AI 모델군 '세이프마인드' 공개
엔비디아와 크라우드스트라이크가 공격 경로 탐지와 방어책 자동 마련을 동시에 수행하는 보안 특화 AI 모델군 '세이프마인드'를 공동 개발해 크라우드스트라이크 보안 플랫폼과 연계해 공개했다.
왜 중요한가요? AI 기반 사이버 공격에 대응해 공격·방어 속도 격차를 줄이는 실질적 보안 제품이 출시되어 기업 보안 운영에 영향을 미친다.
엔비디아 RTX 스파크 탑재 PC, 10월 출시
엔비디아가 미디어텍과 공동 개발한 윈도 PC용 SoC 'RTX 스파크'(N1X) 탑재 제품이 오는 10월부터 글로벌 출시돼요. Arm 기반 그레이스 CPU와 블랙웰 GPU를 통합 메모리 구조로 결합해 대규모 AI 모델 처리와 생성 AI, 게임·콘텐츠 제작 성능 향상을 내세웠어요. 레노버는 요가 프로 9n과 요가 9n 투인원 등 두 제품을 공급할 예정이며 국내 출시 일정과 가격은 아직 정해지지 않았어요.
왜 중요한가요? Nvidia의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
엔비디아, 차세대 AI PC 칩 'RTX 스파크' 10월 출시...개인용 AI 라우터 '페어' 공개
엔비디아가 IFA 2026에서 Arm 기반 'RTX 스파크' 프로세서를 탑재한 윈도우 PC를 10월 출시한다고 발표했어요. RTX 스파크는 블랙웰 GPU와 그레이스 CPU를 결합한 슈퍼칩으로, 최대 128GB 통합 메모리와 20코어 CPU, 최대 1페타플롭스의 AI 연산 성능을 제공해요. 또한 개인용 AI 라우터 '페어'도 함께 공개됐어요.
왜 중요한가요? Nvidia의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
NVIDIA, IFA 2026에서 로컬 AI 가속 발표 - PAIR·RTX Spark PC 포함
NVIDIA는 IFA 2026에서 Microsoft 및 파트너들과 함께 Hermes Agent, OpenClaw, Perplexity Portable Computer에 대한 로컬 AI 지원 간소화, llama.cpp·vLLM 최적화로 최대 1.9배 빠른 로컬 추론, PAIR(Personal AI Router) 도구, 그리고 10월 출시되는 RTX Spark Windows PC(Lenovo·Acer)를 발표했습니다.
왜 중요한가요? 로컬에서 실행 가능한 AI 에이전트 인프라와 하드웨어가 확장되어 개발자·사용자가 클라우드 의존 없이 더 빠르고 안전하게 AI 에이전트를 운용할 수 있게 됩니다.
엔비디아, 허깅페이스 17.5조원에 인수 발표
엔비디아가 오픈소스 AI 플랫폼 허깅페이스를 129억3030만달러(약 17조5600억원)에 인수하기로 공식 합의했다. 투자자에게 119억달러 지급, 합류 직원에게 최대 10억달러 규모 주식 보상을 제공하며, 내년까지 인수를 마무리하고 개방형 플랫폼 운영 방식을 유지할 계획이다.
왜 중요한가요? 엔비디아 사상 최대 규모 인수합병으로, GPU·데이터센터 중심 사업에서 모델·데이터셋·개발자 도구까지 AI 생태계 전반으로 영향력을 확대하며 오픈소스 AI 생태계의 주도권 구도를 바꾼다.
Nvidia RTX Spark ‘Superchip’: The First AI PCs Are Here
IFA 2026에서 Nvidia와 파트너사들이 RTX Spark 슈퍼칩을 탑재한 첫 노트북과 미니 PC를 공개했어요. 이 기기들은 AI 모델을 로컬 컴퓨터에서 직접 구동할 수 있도록 설계됐어요.
왜 중요한가요? Nvidia의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
‘NBA 2K27’ With NVIDIA DLSS 5 Leads 26 New Games Coming to GeForce NOW
NVIDIA는 GeForce NOW 클라우드 게임 서비스에 9월 26종의 신규 게임을 추가한다고 발표했어요. 대표작인 'NBA 2K27'에는 NVIDIA DLSS 5의 3D-Guided Neural Rendering 기술이 적용되어 조명과 재질 표현의 사실감을 높였고, RTX 5080급 클라우드 성능으로 스트리밍할 수 있어요. 이외에도 'The Blood of Dawnwalker', 'Onimusha: Way of the Sword' 등의 신작이 이번 주 서비스에 합류했어요.
왜 중요한가요? NVIDIA의 공식 변경이라 관련 제품과 개발 전략에 직접 영향을 줄 수 있어요.
NVIDIA·CrowdStrike, Nemotron 기반 에이전틱 사이버보안 시스템 SafeMind 발표
CrowdStrike가 NVIDIA Nemotron 오픈 모델을 자사 위협 데이터로 파인튜닝해 만든 방어 모델과 공격형 에이전트가 상호 대응하는 코이볼루션 루프 구조의 에이전틱 사이버보안 시스템 SafeMind를 Falcon 플랫폼에 네이티브로 출시했다. Falcon IQ와 Guardian AI 확장도 함께 공개됐다.
왜 중요한가요? 공격이 자동화되는 시대에 방어 측도 프론티어급 AI 모델을 갖추게 되어, 기업·공공·금융 등 보안 운영 방식에 실질적 변화를 가져올 수 있다.
엔비디아, 오픈소스 AI 플랫폼 허깅페이스 129억달러에 인수
엔비디아가 세계 최대 오픈소스 AI 모델 플랫폼 허깅페이스를 129억달러(약 18조원)에 인수하기로 합의했다.
왜 중요한가요? 하드웨어 중심 엔비디아가 AI 모델·개발자 플랫폼까지 확보해 GPU 중심 AI 컴퓨팅 생태계를 수직통합하려는 전략으로, 오픈소스 AI 생태계에 큰 영향을 미친다.
NVIDIA, NVLink Fusion에 NVHBM 커스텀 HBM 기술 추가...AWS Trainium4부터 지원
NVIDIA가 메모리 컨트롤러를 HBM 베이스 다이에 통합한 NVHBM 기술을 NVLink Fusion 생태계에 추가했다. 표준 HBM4E 대비 최대 30% 대역폭 향상, 15% 전력 절감, XPU 컴퓨트 다이 면적 25% 절감을 제공하며, Amazon Annapurna Labs가 첫 협력사로 차세대 Trainium4부터 NVLink Fusion을 지원한다.
왜 중요한가요? 커스텀 AI 칩 제작사들이 메모리 성능·효율을 높이면서도 NVIDIA GPU와 공통 랙스케일 아키텍처로 상호운용할 수 있게 되어, 하이퍼스케일러의 자체 칩 개발과 NVIDIA 생태계 통합이 가속화된다.
NVIDIA, Groq 3 LPX 정식 생산 돌입…Vera Rubin NVL72 기반 에이전틱 추론 가속
NVIDIA가 Vera Rubin NVL72 플랫폼과 결합되는 Groq 3 LPX 추론 하드웨어를 정식 생산에 돌입시켰다고 발표했다. Artificial Analysis 벤치마크에서 100,000토큰 장문맥 작업 기준 초당 3,400토큰을 생성해 경쟁 플랫폼보다 4배 빠른 성능을 기록했으며, Nebius가 이를 첫 도입한 AI 클라우드가 되었고 CoreWeave와 SpaceXAI도 관련 Vera Rubin 인프라를 도입했다.
왜 중요한가요? 에이전틱 AI 시스템의 장문맥·고처리량 추론 수요에 대응하는 전용 하드웨어가 실제 양산·배포 단계에 들어서면서 클라우드·인프라 업체들의 AI 팩토리 구축 경쟁이 가속화된다.
퍼플렉시티, 엔비디아 협력으로 로컬 실행 AI 에이전트 '포터블 컴퓨터' 공개
퍼플렉시티가 엔비디아와 협력해 클라우드 연결 없이 사용자 기기에서 구동되는 AI 에이전트 '포터블 컴퓨터'를 공개했다. 오케스트레이터, 플래너, 도구 라우터, 스케줄러, 로컬 검색 인덱스, 추론 엔진 등으로 구성되어 문서 분석, 코드 작업, 데이터 처리를 로컬에서 처리한다.
왜 중요한가요? 클라우드 전송 없이 민감 데이터를 처리할 수 있는 온디바이스 에이전트 플랫폼으로, 기업 보안·프라이버시 요구를 충족하는 새로운 에이전트 배포 방식을 제시한다.
오픈AI, 엔비디아 지원으로 오하이오 10GW 데이터센터 20년 임대 계약 체결
오픈AI가 소프트뱅크 산하 SB에너지와 오하이오주 10GW 규모 데이터센터에 대해 20년 임대 계약을 체결했으며, 엔비디아가 최대 1050억 달러 규모 금융 보증을 제공하고 초기 독점 칩 공급권과 SB에너지 지분을 확보하기로 했다.
왜 중요한가요? 이는 현재까지 발표된 AI 인프라 프로젝트 중 최대 규모로, AI·인프라·반도체 기업 간 새로운 공동 자금조달 및 컴퓨팅 자원 확보 모델을 제시한다.
LG-엔비디아, 휴머노이드 로봇·AI 팩토리·모빌리티 3대 분야 전략적 협력 MOU 체결
LG그룹이 엔비디아와 로봇, AI 팩토리, 모빌리티 3개 분야 전략적 사업협력 MOU를 체결했다. LG는 내년 1분기 엔비디아 아이작 그루트와 젯슨 토르 기반 이족보행 휴머노이드 로봇을 공개할 계획이며, LG전자 액추에이터·LG이노텍 센서·LG에너지솔루션 배터리를 탑재한다. 연내 휠베이스 로봇 'LG 클로이드'를 테네시 세탁기 공장에 투입해 실증하고, 2027~2028년에는 엔비디아 베라 루빈 기반 AI 데이터센터를 충남 천안에 80MW 규모로 구축하며, 모빌리티 분야에서는 엔비디아 드라이브 하이페리온 기반 차세대 AIDV 컴퓨팅 플랫폼을 개발한다.
왜 중요한가요? 대기업 그룹 차원의 엔비디아 플랫폼 기반 피지컬 AI·AI 팩토리·모빌리티 전면 도입은 제조·인프라 현장에 AI 전환을 구체적으로 실증하는 사례로, 산업 전반의 AX 확산에 영향을 줄 수 있다.
NVIDIA, Apollo·BlackRock·Blackstone 등과 5000억 달러 규모 AI 인프라 금융 플랫폼 구축
NVIDIA가 Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs, KKR와 파트너십을 맺고 AI 컴퓨팅 인프라 구축에 5000억 달러 이상의 제3자 자본을 조달하는 독립 금융 플랫폼을 신설했으며, 일부 경우 NVIDIA가 잔존가치를 최대 25%까지 보증한다.
왜 중요한가요? AI 데이터센터 구축이 개별 프로젝트 단위에서 대규모 기관 자본이 투입되는 반복 가능한 인프라 자산군으로 전환되는 신호로, AI 컴퓨팅 시장의 자금 조달 구조와 규모가 근본적으로 확대된다.
NVIDIA, 구글·MS와 800VDC AI 데이터센터 전력 아키텍처 공동 개발 및 MGX 호환 랙 발표
NVIDIA가 구글, 마이크로소프트와 Open Compute Project를 통해 800VDC 고전압 직류 전력 아키텍처를 공동 개발하고, 2026년 하반기 출시될 MGX 호환 800VDC 파워랙과 2027년 예정된 로우 파워 센터 등 단계별 로드맵을 공개했다. 80개 이상 기업이 이 표준에 맞춰 제품을 개발 중이다.
왜 중요한가요? AI 데이터센터의 전력 전달 효율을 높여 GPU 밀도와 컴퓨팅 성능 확장의 병목을 해소하는 인프라 표준으로, 기존 시설도 하이브리드 방식으로 업그레이드 가능해 대규모 AI 인프라 투자의 실질적 확장 경로를 제공한다.
현대차그룹, 전사적 AX 성과 발표…신차 개발 기간 단축 프로젝트 추진
현대차그룹이 사내 생성AI 플랫폼 '에이치챗프로'를 임직원 80%가 활용하고 있다고 밝히고, AI 도입으로 연간 수십억원 비용과 소요 시간 절반 이상을 절감했다고 발표했다. 신차 개발 기간 단축을 위한 톱다운 방식 대형 프로젝트를 추진 중이며, 새만금에 AI데이터센터 설립을 추진하고 엔비디아와 GPU 물량 확보 제휴를 논의했다.
왜 중요한가요? 제조 중심 대기업이 개별 업무 효율화를 넘어 그룹 전체 핵심 프로세스(신차 개발기간)를 AI로 재구성하는 톱다운 AX 사례로, 산업 전반의 AI 전환 방향성을 보여준다.
NVIDIA, 상시 에이전트용 오픈모델 'Nemotron 3.5 Lightning'과 라우팅 라이브러리 'NeMo Switchyard' 공개
MarkTechPost 보도로 Nemotron 3.5 Lightning의 세부 사양(30B MoE, 3B 활성 파라미터, Mamba-2+MoE+Attention 하이브리드, 1M 토큰 컨텍스트, OpenMDW-1.1 라이선스, 단일 GPU 배포)과 NeMo Switchyard의 LangChain 벤치마크 비용 절감(74%), Cognition Devin Desktop 적용 사례(28% 비용 절감) 등 추가 세부정보가 확인됨.
왜 중요한가요? 엔터프라이즈가 프런티어 모델 대신 소형 오픈 모델과 라우팅으로 에이전트 워크로드 비용과 지연을 크게 줄일 수 있음을 구체적 사례로 입증했다.
엔비디아, 전력 인프라 기업 랜시엄에 최대 30억 달러 투자
엔비디아가 전력 인프라 개발업체 랜시엄 지분 약 20%를 20억 달러에 확보하고, 전력망 연결 등 조건 충족 시 10억 달러를 추가 투자해 지분을 최대 30%까지 늘리는 계약을 체결했다. 랜시엄의 텍사스 애빌린 캠퍼스는 스타게이트 프로젝트의 첫 가동 거점이다.
왜 중요한가요? 엔비디아가 GPU 공급을 넘어 데이터센터 부지와 전력망까지 직접 확보하며 AI 인프라 경쟁의 무게중심이 전력 확보로 이동하고 있음을 보여준다.
NVIDIA, 물리 AI용 오픈 월드 모델 'Cosmos 3' 발표
NVIDIA가 비전-언어 모델, 물리 기반 월드 시뮬레이터, 월드 액션 모델의 백본으로 쓸 수 있는 믹스처-오브-트랜스포머 구조의 'Cosmos 3'를 Super(64B), Nano(16B), Edge(4B) 세 가지 크기로 OpenMDW 1.1 라이선스 하에 공개했다. Omniverse·OpenUSD와 결합해 로봇, 자율주행차, 비전 AI 시스템을 위한 시뮬레이션 및 합성 데이터 생성 워크플로우를 지원한다.
왜 중요한가요? 물리 AI 개발에 필요한 대규모·다양한 학습 데이터 확보와 시뮬레이션 검증을 오픈 모델로 지원함으로써 로보틱스·자율주행 분야의 개발 장벽을 낮춘다.
NVIDIA, 자율주행용 오픈 모델 'Alpamayo 2 Super' 상용 라이선스로 공개
NVIDIA가 로보택시·자율주행차용 340억 파라미터 비전-언어-액션 모델 Alpamayo 2 Super를 Hugging Face에 공개했다. 32B VLM과 2.3B 디퓨전 액션 디코더로 구성되며 OpenMDW-1.1 라이선스로 파인튜닝, 파생 모델, 상업적 재배포가 가능하다. Alpamayo 전체 모델군에도 동일 라이선스가 적용돼 기존 R&D용 모델도 즉시 상업 배포가 가능해졌다.
왜 중요한가요? 자동차 제조사와 공급사가 자체 데이터로 커스터마이징한 자율주행 모델을 별도 허가 없이 상업적으로 배포할 수 있게 되어, 자율주행 개발의 진입장벽과 비용을 낮추고 오픈소스 AV 생태계 경쟁을 촉진한다.
NVIDIA, cuFile API 오픈소스화 및 'Storage-Next' AI 스토리지 이니셔티브 발표
NVIDIA가 FMS 콘퍼런스에서 GPU가 스토리지에 직접 접근할 수 있게 하는 cuFile API와 그 하위 스토리지 소프트웨어 스택을 오픈소스로 공개했으며, 스토리지 업체들과 함께 GPU 중심의 AI 스토리지 표준을 만드는 'Storage-Next' 이니셔티브를 주도한다고 밝혔다. 또한 Vera BlueField-4 STX가 압축·암호화 파이프라인에서 x86 CPU보다 최대 3.21배 높은 처리량을 낸다는 벤치마크도 공개했다.
왜 중요한가요? AI 에이전트가 대량의 동시 스토리지 요청을 생성하는 환경에서 GPU 직접 스토리지 접근 표준화는 데이터센터 인프라 경제성과 AI 팩토리 성능에 직접적인 영향을 미친다.
NVIDIA 등 120여 기관, 에이전트 AI 보안 위한 SAFE 가이드라인 초안 발표
NVIDIA, Cisco, CrowdStrike, Hugging Face, Red Hat 등 120개 이상 기관이 참여한 Open Secure AI Alliance가 Linux Foundation과 함께 에이전트 AI 사이버보안 사고 정보를 공유하는 SAFE(Shared AI Findings Exchange) 가이드라인 RFC를 공개했으며, NVIDIA는 NOOA 에이전트 하네스 등 오픈소스 보안 도구를 스택 전반에 제공했다.
왜 중요한가요? 에이전트 AI 확산에 따라 업계 전체가 보안 사고 정보를 공유하는 표준 체계를 마련함으로써 시스템적 위험 감소와 신뢰 가능한 AI 에이전트 운영 기반을 구축할 수 있다.
NVIDIA-KAIST 공동 AI 연구실 설립, 한국 AI 생태계 협력 확대
NVIDIA와 KAIST가 서울에 에이전틱 AI 연구를 위한 공동 AI 연구실을 설립했으며, 이는 한국 대학과 글로벌 기술기업 간 첫 공동 AI 연구소다. 협력에는 NVIDIA Nemotron 오픈 모델과 NVIDIA AI Cloud 컴퓨팅이 포함된다. 또한 SK그룹과 NVIDIA는 AI 인프라 및 메모리 기술 협력을 확대하기로 했다.
왜 중요한가요? 한국이 NVIDIA와의 협력을 통해 AI 인프라와 에이전틱 AI 연구 역량을 강화하며 글로벌 AI 생태계에서의 위치를 확대하려는 국가적 움직임을 보여준다.
NVIDIA, Spectrum-6 이더넷 스위치 시스템 출시…초당 102.4테라비트
엔비디아가 Vera Rubin 플랫폼용 네트워킹 제품인 Spectrum-6 이더넷 스위치 시스템을 공개했다. 초당 102.4테라비트 용량으로 이전 세대 대비 2배 성능을 제공하며 CoreWeave, Microsoft, Nebius, SpaceXAI, Tesla가 초기 도입 기업으로 참여한다.
왜 중요한가요? 대규모 GPU 클러스터의 네트워크 병목을 해소해 AI 학습·추론 속도와 비용 효율성을 높이는 인프라 발전으로, 주요 클라우드·AI 기업들의 즉시 도입이 확인된 구체적 제품 출시다.
NVIDIA, Vera Rubin NVL72 플랫폼 양산 개시…메가와트당 토큰처리량 10배 향상
NVIDIA가 Vera Rubin NVL72 플랫폼의 대량 생산을 시작해 CoreWeave, Google Cloud, Microsoft Azure, Oracle Cloud 등 파트너사에서 랙이 가동되고 있다. 7개 칩과 5개 랙 트레이를 하나의 시스템으로 공동설계했으며, DeepSeek-R1 벤치마크 기준 기존 Grace Blackwell NVL72 대비 메가와트당 처리량이 10배 높다. 6세대 NVLink와 Spectrum-6 이더넷 스위치, 코패키지 광학 스위치도 함께 도입됐다.
왜 중요한가요? 전력 제약이 있는 대규모 AI 데이터센터에서 토큰당 비용과 처리량을 크게 개선해 주요 클라우드 사업자들의 AI 인프라 확장 전략에 직접 영향을 미친다.
Wistron, 포트워스에 7억달러 규모 NVIDIA AI 시스템 생산 공장 개소
Wistron이 텍사스 포트워스에 미국 첫 생산시설(D1)을 개설하고 NVIDIA GB300 Grace Blackwell Ultra 슈퍼칩 생산을 시작했으며, 향후 Vera Rubin 슈퍼칩도 생산할 예정이다. 7억달러 투자로 500명 이상을 고용했고 연말까지 1000명으로 확대 계획이다.
왜 중요한가요? NVIDIA의 미국 내 5000억달러 AI 플랫폼 제조 공약의 일환으로, AI 반도체 공급망의 미국 현지화와 생산 능력 확대를 보여주는 구체적 사례이다.