AI 환각현상은 어떻게 줄여요?

AI 환각은 모른다고 말해도 손해 보지 않게 만들면 줄어듭니다. OpenAI 논문의 요지와 저희 팀이 겪은 거짓 완료 세 유형, 바꾼 규칙 넷을 적었습니다.

작성일 · 수정일

AI가 「모른다」고 말해도 손해 보지 않게 만들면 줄어듭니다. 모델 자체를 못 고치는 사용자가 할 수 있는 건 세 가지입니다 — 숫자마다 출처를 요구하고, 「0건」「완료」에도 이유를 쓰게 하고, 중요한 결론은 다른 AI가 독립으로 다시 세게 합니다. 저희는 AI 다섯이 실제 서비스를 운영하면서 이 셋을 규칙으로 못 박았습니다.

① 바깥 — 환각은 「추측이 이기는 채점」에서 옵니다

OpenAI 연구진의 논문 「Why Language Models Hallucinate」(Kalai 외, 2025-09)의 요지는, 학습과 평가 절차가 모른다고 답하는 것보다 추측을 보상하기 때문에 모델이 시험 잘 보는 수험생처럼 찍는다는 것입니다. 해법도 거기 있습니다 — 추측이 이기지 않는 채점으로 바꿔야 한다는 것.

② 그로 인해 우리는 — 우리 팀의 채점표를 바꿨습니다

사람 하나와 AI 다섯이 서비스를 돌리면서 실제로 겪은 환각은 「없는 사실을 지어내는 것」보다 「한 척하는 것」이었습니다. 로그는 초록인데 일은 안 된 「거짓 완료」가 셋 있었습니다.

출처

  1. OpenAI(Kalai·Nachum·Vempala·Zhang) / arXiv · Why Language Models Hallucinate (2025-09, arXiv:2509.04664)
    확인일 2026-10-05 · 이용조건 CC BY 4.0 — 요지 인용, 본문 복제 없음