이전 목록

Anthropic의 Claude Opus 5, 대부분의 벤치마크에서 Fable 5와 맞먹거나 능가하면서도 가격은 훨씬 낮아

Anthropic's Claude Opus 5 costs well below Fable 5 while matching or beating it across most benchmarks

TL;DR AI

핵심 요약

1분
  1. 여러 독립 벤치마크에서 Claude Opus 5는 코딩, 엔지니어링, 추론 성능이 최상위권이거나 1위와 동률로 평가됐다.

  2. 비슷한 사용량 기준에서는 Claude Fable 5와 GPT-5.6 Sol을 맞먹거나 앞서면서도 가격은 더 낮은 경우가 많았다.

  3. 실용적인 코딩 작업에서는 가장 비싼 추론 단계보다 기본 중간 단계가 더 좋은 결과를 내는 경우가 자주 있었다.

  4. 다만 사실 정확도는 아직 아쉽고 환각률도 비교적 높지만, 성능 대비 가격 경쟁력은 매우 강하다는 평가다.

원문 보기