언어 바꾸기English
이전 목록

AMD와 Cerebras, 저지연·고처리량 AI 추론 협력… EPYC 프로세서와 Cerebras Wafer-Scale Engine(WSE) 솔루션을 Helios 랙 스케일 인프라에 결합

AMD and Cerebras partner on low-latency, high-throughput AI inference — EPYC processors in Helios rack-scale infrastructure paired with Cerebras' Wafer-Scale Engine (WSE) solutions

TL;DR AI

핵심 요약

1분
  1. AMD와 Cerebras가 역할을 분리한(disaggregated) AI 추론 플랫폼을 공동 개발합니다.

  2. AMD의 EPYC 기반 Helios 랙과 Instinct MI400 GPU가 프롬프트 처리와 긴 컨텍스트의 prefill을 맡고, Cerebras의 Wafer-Scale Engine은 지연에 민감한 토큰 생성을 담당합니다.

  3. 이 서비스는 2026년 하반기 Cerebras Cloud에서 출시될 예정입니다.

  4. 작업을 단계별로 최적화해 효율·처리량·비용을 개선하고, Nvidia의 추론 전략에도 압박을 줄 수 있습니다.

원문 보기