오픈AI(OpenAI)가 AI를 활용해 작성한 수학 연구 논문 3편을 공식적으로 철회했습니다. 이는 핵심 논문 중 하나에서 발견된 부호 오류(sign error) 때문인데, 이 오류가 해당 논문의 주요 논증뿐만 아니라 이를 기반으로 한 다른 두 논문의 구성까지 무효화시켰기 때문입니다. 철회된 논문들은 '분할 아벨 8차원 다양체의 Weil 클래스의 대수성', 'K3 곡면의 Kuga–Satake 대응의 대수성', 'K3 곡면의 곱에 대한 유리 Hodge 추측'을 다루고 있었습니다.
이번 철회는 2026년 10월 7일자 논문 'Algebraicity of Weil classes on split abelian eightfolds'에서 부호 오류가 발견되면서 시작되었습니다. 이 오류는 '안정화-트레이스 상쇄 논증'에 영향을 미쳐, 이 논증에 의존하는 두 편의 다른 논문에서 사용된 구성까지 무효화시킨 것으로 알려졌습니다. 오픈AI는 철회된 논문들의 README 파일에 증명의 공백을 설명하는 안내와 보관된 원고 링크를 제공하고 있으며, 개정된 논문의 이전 공개 판본도 계속 열람할 수 있도록 조치했습니다. 이와 별도로, 다른 14편의 원고는 증명 보완, 명제 수정, 가정 명확화, 유효하지 않은 인용 삭제 등을 반영하여 개정되었고, 13편의 추가 원고는 개정된 논문을 인용하도록 참고문헌과 버전 날짜가 갱신되었습니다. 또한, 주요 결과의 형식화 비율은 전체 719개 중 300개, 약 42%에 도달했다고 밝혔습니다.
이번 사건은 AI가 생성한 복잡한 수학적 증명에 대한 검증의 중요성을 다시 한번 부각시킵니다. 수학계에서는 AI가 방대한 양의 논문을 빠르게 생성할 수 있지만, 그 정확성을 검증하는 과정에 막대한 인적 자원이 필요하다는 우려가 제기되어 왔습니다. 특히, 사람이 작성한 논문보다 AI가 쓴 글이 더 읽기 어렵다는 지적도 있어, 대규모 AI 생성 논문의 검증 부담은 더욱 커질 수 있습니다. 오픈AI는 이번 사례를 통해 AI 기반 연구의 신뢰성을 높이기 위한 형식화(formalization) 작업의 중요성을 인식하고, 앞으로 AI의 글쓰기 능력 향상에도 더 투자할 것으로 보입니다. 이는 AI가 단순한 생성 도구를 넘어, 엄밀한 학술 연구의 파트너로 자리매김하기 위한 필수적인 과정이 될 것입니다.