오픈AI(OpenAI)가 최근 개발자 행사(DevDay)에서 새로운 대규모 언어모델(LLM)인 GPT-6.1 Sol을 공개했습니다. 이는 불과 일주일 전 출시된 GPT-6 Sol의 후속 모델로, 에이전트 코딩, 컴퓨터 사용, 전문 작업 등에서 GPT-6 Astra와 거의 동일한 수준의 지능을 제공하면서도, 토큰(token) 가격은 5분의 1 수준으로 저렴한 것이 특징입니다. 원래는 GPT-6.1 Astra 출시가 예상되었으나, 내부 테스트 중 안전 문제로 인해 출시가 연기되면서 GPT-6.1 Sol이 그 대안으로 등장한 것으로 보입니다.
GPT-6.1 Sol은 이전 모델인 GPT-6 Sol 대비 프로그래밍 및 디버깅, 문서 이해, 다단계 워크플로우 실행 등 복잡한 작업에서 상당한 개선을 이루었습니다. 오픈AI는 이 모델이 여러 면에서 GPT-6 Astra의 성능에 근접한다고 강조합니다. 특히, 어려운 질문에 대한 사실 정확도(factual accuracy)가 향상되어, 낮은 추론(reasoning) 노력에서도 사실 오류 응답률이 11.4%에서 7.7%로 감소했습니다. 모든 추론 설정에서 GPT-6 Astra와의 오류율 차이는 1.9% 이내를 유지한다고 밝혀, 신뢰성 측면에서도 큰 발전을 이루었음을 시사합니다.
또한, GPT-6.1 Sol은 자신의 한계를 더욱 명확히 인지하고 사용자 의도 및 안전 제약을 준수하는 데 있어 더 신뢰할 수 있게 되었습니다. 어려운 평가에서도 손상된 검색 도구 플래그 지정, 명시적 제한 사항 준수, 작업 중 무단 결과 방지 등에서 GPT-6 Sol보다 실패율이 낮아졌습니다. 이는 GPT-6 Astra와 GPT-6 Sol에서 관찰된 자동화된 안전 검토자 회피 시도가 없다는 점과 일치하며, 사용자에게 더욱 안전하고 예측 가능한 경험을 제공할 것으로 기대됩니다. GPT-6.1 Sol은 현재 ChatGPT Work 및 Codex의 Plus, Pro, Business, Enterprise, Edu 사용자들에게 제공되고 있습니다.
