고전적인 튜링 테스트에서 기계 지능이 인간보다 더 인간답게 보였다
In a classic Turing test, machine intelligence was more convincingly human than humans

TL;DR AI
1분핵심 요약
UC 샌디에이고 연구진은 GPT-4.5가 고전적 튜링 테스트에서 73%의 확률로 인간으로 판정됐고, 같은 환경의 실제 사람보다도 더 자주 사람처럼 보였다고 밝혔다.
연구팀은 약 500명의 참가자를 대상으로 무작위 텍스트 채팅 실험을 진행해 최신 모델과 인간을 비교했다.
LLaMa-3.1-405B도 페르소나 프롬프트를 주자 높은 성능을 보였지만, ELIZA나 GPT-4o 같은 오래된 시스템은 훨씬 낮은 결과를 보였다.
이번 결과는 최신 AI가 인간 대화를 매우 설득력 있게 흉내 낼 수 있음을 보여주며, 기만·신뢰·온라인 신원 문제에 대한 우려를 키운다.
