NVIDIA AI, Nemotron-Labs-Diffusion 공개: Qwen3-8B 대비 한 번의 순전파당 토큰 6배를 처리하는 3모드 언어 모델
NVIDIA AI Releases Nemotron-Labs-Diffusion: A Tri-Mode Language Model with 6× Tokens Per Forward Over Qwen3-8B

TL;DR AI
1분핵심 요약
엔비디아는 Nemotron-Labs-Diffusion 3B/8B/14B 모델 패밀리를 공개했습니다.
이 시스템은 하나의 공유 구조 안에 AR 디코딩, 확산 기반 블록 디코딩, 셀프 스페큘레이션을 결합했습니다.
공동 AR-확산 학습 목표로 빠른 병렬 생성과 높은 언어 모델 정확도를 함께 노립니다.
가중치를 바꾸지 않고도 엣지와 클라우드 서버에 맞춰 활용할 수 있는 단일 모델 스택을 지향합니다.
