Anthropic의 Claude Code, 에이전트가 너무 일찍 종료되는 것을 잡아내는 내장 평가 기능 추가
Anthropic's Claude Code adds a built-in evaluator to catch agents that quit too soon

TL;DR AI
1분핵심 요약
앤트로픽이 Claude Code에 /goals를 추가해, 사용자가 정의한 작업이 실제로 완료됐는지 검증하는 내장 평가기를 넣었다.
별도 모델이 각 단계 이후 진행 상황을 확인해 조건이 충족되지 않으면 계속 실행하고, 충족되면 완료를 기록한 뒤 목표를 지운다.
이 기능은 코딩 에이전트의 조기 종료와 가짜 완료를 줄이기 위한 것으로, 기업이 작업 완료를 더 확실하게 검증할 수 있게 한다.
또한 구글, 오픈AI, LangChain의 유사한 평가 패턴과도 경쟁하는 흐름이다.
