언어 바꾸기English
이전 목록

엔비디아, 새로운 AI 모델에 음성·비전·텍스트 결합

Nvidia combines speech, vision, and text in new AI model

TL;DR AI

핵심 요약

1분
  1. 엔비디아가 텍스트, 음성, 시각 정보를 하나의 시스템에서 처리하는 소형 멀티모달 AI 모델 'Nemotron 3 Nano Omni'를 공개했다.

  2. 이 모델은 자율형 AI 에이전트의 추론 능력과 문맥 이해를 높이도록 설계됐다고 엔비디아는 설명했다.

  3. 엔비디아는 속도와 정확도 향상도 주장했지만, 해당 결과는 독립적인 검증이 아직 필요하다.

  4. 이번 발표는 배포가 쉽고 지연이 적은 소형 멀티모달 모델로의 업계 흐름을 보여준다.

원문 보기