본문으로 건너뛰기
toldrop
트렌드리포트
toldrop

“LLM추론” 검색 결과

최신테크코딩사이언스게이밍영상투자논문하드웨어

검색된 기사

테크·2026년 6월 3일

AMD MI300X에서 DeepSeek-V4-Flash 구동하기 | Hacker News

Hacker News

테크·2026년 6월 1일

10년 된 Xeon이면 충분하다 | Hacker News

Hacker News

테크·2026년 5월 29일

표준 GPU에서의 실시간 LLM 추론: 요청당 초당 3천 토큰 | Hacker News

Hacker News

테크·2026년 5월 28일

Perplexity AI, Hugging Face tokenizers Crate보다 p50 지연 시간을 5배 낮춘 Unigram 토크나이저 오픈소스 공개

MarkTechPost

테크·2026년 5월 21일

N 토큰/초는 실제로 얼마나 빠른가? | Hacker News

Hacker News

1페이지다음
트렌드리포트