딥 리서치는 신뢰할 수 있을까? 오해를 낳는 지식이 잘못된 결론을 유도한다
Is Deep Research Reliable? Misleading Knowledge Induces False Conclusions
TL;DR AI
1분핵심 요약
연구진은 MisKnow-Agent로 그럴듯하지만 잘못된 지식을 만들어 Deep Research 과제에 투입하고, 5,933개의 검증된 예제로 여러 에이전트를 시험했다.
일부 신뢰할 만한 허위 정보만 접해도 최종 보고서가 잘못된 결론에 도달할 수 있었으며, 오픈소스와 폐쇄형 에이전트 모두 영향을 받았다.
검색 기반 검증 모델은 개별 증거의 오류는 잘 찾아냈지만, 실제 연구 워크플로우에서는 그 잘못된 증거가 여전히 결론에 반영됐다.
사전·사후 방어를 함께 써도 문제는 줄어들 뿐 완전히 막지는 못해, 장기형 AI 연구 시스템의 신뢰성 한계를 드러냈다.
