언어 바꾸기English
이전 목록

GLM-5.3-Flash, 상위 모델과 맞먹는 성능을 더 낮은 비용으로 구현하고 Nvidia 없이도 구동

GLM-5.3-Flash matches top models at a fraction of the cost, and runs without Nvidia

TL;DR AI

핵심 요약

1분
  1. Z.ai가 총 3,200억 개, 활성 180억 개 파라미터와 100만 토큰 컨텍스트를 갖춘 MIT 라이선스 오픈웨이트 멀티모달 모델 GLM-5.3-Flash를 출시했다.

  2. 이 모델은 벤치마크에서 더 큰 프런티어 모델에 근접한 성능을 보이면서 토큰 비용은 크게 낮췄다고 알려졌다.

  3. Z.ai는 엔비디아 하드웨어 대신 중국산 AI 칩으로 대규모 추론 서비스를 운영했다고 밝혀 모델 가격과 CUDA 생태계 의존도에 도전장을 던졌다.

원문 보기