인공지능(AI)이 수학 문제 해결에서 놀라운 성능을 보이는 이유가 단순히 뛰어난 추론 능력 때문이 아니라, 방대한 정보를 기억하고 활용하는 능력 덕분이라는 분석이 나왔습니다. AI는 문제의 초기 조건부터 중간 계산, 제약 사항, 심지어 실패한 접근 방식까지 모두 거대한 '상징적 작업 공간(symbolic workspace)'에 보존하며 추론을 진행합니다. 이는 인간의 제한된 작업 기억(working memory)이 정보를 청킹(chunking)하거나 종이 같은 외부 도구를 통해 보완하는 방식과 대조적입니다.
인간의 작업 기억은 매우 제한적이어서 복잡한 암산이나 긴 증명 과정을 머릿속으로만 유지하기 어렵습니다. 수학자들은 표기법, 메모지, 도표 등을 활용해 외부 기억을 확장하고, 익숙한 기호를 묶는 청킹으로 정보를 압축합니다. 하지만 AI의 대규모 언어모델(LLM) 컨텍스트 윈도우(context window)는 원래 질문, 정의, 예제, 중간 계산, 그리고 모델이 생성한 모든 추론을 한꺼번에 담을 수 있습니다. 이는 인간의 능동적인 내부 작업 기억과 달리, 기록된 내용을 불완전하게 검색하고 활용하는 거대한 외부 노트와 유사하며, 수십, 수백 개의 조건을 명시적인 형태로 보존할 수 있게 합니다. 특히 수학은 가정과 변환을 기호로 기록하고 검증할 수 있어, 이처럼 큰 컨텍스트와 명시적 중간 상태의 이점이 극대화됩니다.
이러한 AI의 능력은 다수의 제약 조건, 긴 계산, 광범위한 경우 분석, 정확한 기호 관리가 필요한 문제에서 특히 강력한 성능 차이를 만듭니다. 인간은 100단계 논증의 각 국소 추론을 이해하더라도 전체 구조를 유지하기 어려울 수 있지만, AI는 거의 모든 중간 상태를 기록하여 더 긴 추론 사슬(reasoning chain)을 유지할 가능성이 있습니다. 이는 AI가 '소리 내어 생각하는(think aloud)' 것처럼 보이는 현상과도 연결되며, 실제로는 더 넓은 탐색과 많은 중간 상태 생성을 통해 성능을 높이는 것입니다. 현재 AI는 아인슈타인(Einstein)처럼 문제의 틀을 근본적으로 바꾸는 깊이 있는 통찰보다는 폰 노이만(von Neumann)처럼 속도와 폭, 그리고 무제한 노트를 결합한 모습에 가깝다고 평가됩니다. 다음 단계는 잘못 설정된 문제를 재구성하는 능력, 즉 아인슈타인식 깊이를 갖추는 것이 될 것입니다.