88코어 Vera, 에이전트 병목이 CPU로 내려온 날
NVIDIA Vera CPU 첫 인도는 AI 에이전트 경쟁의 병목이 GPU 추론뿐 아니라 샌드박스, 툴 호출, RL 평가를 떠받치는 CPU로 이동했음을 보여줍니다.
NVIDIA Vera CPU 첫 인도는 AI 에이전트 경쟁의 병목이 GPU 추론뿐 아니라 샌드박스, 툴 호출, RL 평가를 떠받치는 CPU로 이동했음을 보여줍니다.
NVIDIA AI-Q agent skill은 Claude Code와 Codex가 기업 데이터 연구를 로컬 AI-Q 서버에 위임하게 만드는 새 실행 구조입니다.
NVIDIA SANA-WM은 2.6B 파라미터로 720p 60초 월드 모델을 주장합니다. 진짜 의미는 영상 품질보다 오픈 모델의 비용 구조입니다.
NVIDIA가 Hermes Agent를 RTX와 DGX Spark에 최적화하며 로컬 상시 실행 self-improving agent 경쟁을 밀고 있습니다.
NVIDIA와 Ineffable Intelligence의 협력은 모델 경쟁이 인간 데이터 이후의 RL 인프라 경쟁으로 이동하고 있음을 보여줍니다.
Nvidia가 Mamba-Transformer 하이브리드 MoE 아키텍처의 Nemotron 3 Super를 공개했습니다. 120B 파라미터 중 12B만 활성화하며, 에이전틱 AI의 context explosion 문제를 해결하는 새로운 아키텍처 패러다임입니다.
DeepMind 출신 창업자들의 Reflection AI가 매출 없이 $25B 밸류에이션을 받았습니다. Nvidia $800M, JPMorgan 국가안보 펀드까지 참여한 이 딜의 본질은 AI 기술이 아니라 지정학적 인프라 포지셔닝입니다.
DeepSeek이 V4 모델의 사전 접근을 Nvidia와 AMD에 거부하고 Huawei에 독점 제공했습니다. 1조 파라미터 모델이 중국산 칩에 최적화되며, 글로벌 AI 생태계의 분기가 현실이 되고 있습니다.
Nvidia가 GTC 2026에서 7개 칩, 5개 랙의 Vera Rubin 플랫폼을 공개하고 2027년까지 1조 달러 매출을 전망했습니다. 추론 변곡점, AI 공장, 에이전트 스케일링이 핵심 키워드입니다.