언어 바꾸기English
이전 목록

AI 벤치마크 ‘자전거를 탄 펠리컨 그리기’를 Gemini 3.1 Pro와 Qwen3.6-35B-A3B에 시켜보면 이렇게 된다

This is what happens when AI benchmark “Draw a pelican riding a bicycle” is tried on Gemini 3.1 Pro and Qwen3.6-35B-A3B

TL;DR AI

핵심 요약

1분
  1. PyCon US 2026에서 Simon Willison은 오랫동안 이어온 ‘펠리컨이 자전거를 타는’ 이미지 벤치마크 결과를 다시 소개했다.

  2. 그는 Gemini 3.1 Pro와 Qwen3.6-35B-A3B 같은 최신 모델이 특히 더 자연스럽고 완성도 높은 이미지를 만들었다고 평가했다.

  3. Claude Sonnet 4.5, Claude Opus 4.7, Gemma 4, GLM-5.1 등도 전반적으로 개선된 모습을 보였다.

  4. 다만 이 벤치마크는 모델별 강점과 특성을 드러내는 데는 유용하지만, AI 성능 전체를 판단하기에는 너무 좁다고 강조했다.

원문 보기