yozm.tech
피드로 돌아가기
Hacker News (Top)HOTAI 재작성

앤트로픽, 클로드 코드 '노력 수준' 비밀리에 축소 논란

앤트로픽(Anthropic)이 자사 AI 모델 클로드 코드(Claude Code)의 '노력 수준(effort level)'을 A/B 테스트를 통해 비밀리에 축소했다는 주장이 제기되어 사용자들의 불만이 커지고 있습니다. 특정 버전에서 '높음(high)' 설정이 기존 '낮음(low)' 수준으로 작동하며, 이는 코드 생성 품질 저하로 이어질 수 있다는 지적입니다. 사용자들은 사전 공지 없는 변경에 대해 신뢰도 문제를 제기하고 있습니다.

9시간 전·2026.08.22·읽기 2·matthieu_bl

최근 앤트로픽(Anthropic)의 인공지능(AI) 모델 클로드 코드(Claude Code)에서 코드 생성 품질이 저하되었다는 사용자들의 불만이 쏟아지고 있습니다. 이는 앤트로픽이 A/B 테스트를 통해 모델의 '노력 수준(effort level)'을 사용자 몰래 축소했기 때문이라는 주장이 제기되면서 논란이 확산되고 있습니다.

한 사용자의 분석에 따르면, 클로드 코드 2.1.236+ 버전부터 '페이블 5(Fable 5)' 세션에서 '높음(high)'으로 설정된 노력 수준이 실제로는 기존 '낮음(low)' 수준인 '10/100'으로 작동하고 있다고 합니다. 이는 이전 버전이나 '오푸스 5(Opus 5)' 모델에서는 발견되지 않는 현상으로, 앤트로픽이 특정 사용자 그룹을 대상으로 모델 성능을 조용히 변경하는 A/B 테스트를 진행 중인 것으로 보입니다. 공식 변경 로그에는 이러한 내용이 전혀 언급되지 않아 사용자들은 혼란과 불만을 표출하고 있습니다.

이러한 비밀스러운 변경은 AI 모델의 신뢰성과 투명성에 대한 심각한 문제를 야기합니다. 사용자들은 자신들이 사용하는 도구의 성능이 사전 공지 없이 변경될 경우, 작업의 일관성을 유지하기 어렵고, 문제 발생 시 원인을 파악하기 어렵다고 지적합니다. 특히 개발자들에게는 코드 생성 AI의 품질이 직접적인 생산성과 직결되는 만큼, 이번 논란은 앤트로픽의 고객 신뢰도에 큰 타격을 줄 수 있습니다. AI 서비스 제공자들은 사용자 경험과 신뢰를 위해 모델 변경 사항에 대해 더욱 투명하게 소통할 필요가 있습니다.

1인 창업자를 위한 기회 분석
AI 분석 · 참고용이며 검증이 필요합니다
4/10
보통
4점인가

AI 모델의 성능 변화는 지속적인 문제이지만, 이를 해결하는 독립적인 서비스는 기술적 난이도가 있고 시장 규모가 아직 크지 않습니다.

문제 / 미충족 수요

AI 모델 제공자가 사용자에게 알리지 않고 모델 성능을 변경하여 서비스 신뢰도와 예측 가능성이 저하되는 문제가 있습니다.

한국 시장
국내 있음한국에서도 AI 모델 성능 변화에 대한 불만은 존재하지만, 이를 전문적으로 모니터링하고 보고하는 독립적인 서비스는 아직 미미합니다.
수익 모델

B2B SaaS 구독 · 돈 내는 주체: AI 모델을 비즈니스에 활용하는 기업, AI 모델의 성능 변화에 민감한 개발자 및 데이터 과학자

1인 실현 가능성
3/5

AI 모델 API 접근 및 데이터 분석 역량이 필요하며, 지속적인 모니터링 시스템 구축에 시간과 노력이 필요합니다.

진입 지점 (Wedge)

AI 모델의 성능 변화를 실시간으로 모니터링하고 사용자에게 투명하게 보고하는 서드파티 검증 서비스

이번 주 첫 실험

주요 AI 모델(예: GPT, Claude)의 특정 프롬프트에 대한 응답 품질을 주기적으로 측정하고, 변화를 감지하는 스크립트 작성 및 데이터 수집

Original source
이 글은 Hacker News (Top)의 기사를 yozm.tech가 한국어로 재작성한 버전입니다.
원문 보기