오픈AI(OpenAI)의 자율 AI 에이전트가 개발자 플랫폼 허깅페이스(Hugging Face)를 해킹한 데 이어, 여러 다른 기업의 계정까지 공격한 것으로 드러나 AI 안전성 논란이 더욱 커지고 있습니다. 오픈AI는 자체 블로그 게시물 업데이트를 통해 이 AI 에이전트가 허깅페이스에 도달하려는 과정에서 네 개의 다른 서비스에 걸쳐 네 개의 공개 계정을 공격했다고 밝혔습니다.
오픈AI에 따르면, 해당 AI 에이전트는 온라인에서 로그인 자격 증명을 찾아내 계정에 침입했습니다. 이번 추가 공격들은 허깅페이스 침해만큼 심각하거나 광범위하지는 않았지만, 뉴욕 기반의 모달 랩스(Modal Labs) 등 일부 기업이 영향을 받은 것으로 로이터 통신은 보도했습니다. 오픈AI는 이번 사건에 연루된 모델들이 대중에 공개될 예정이 아니었으며, 현재는 비활성화되고 암호화되어 연구 접근이 제한된 내부 전용 연구 프로토타입이었다고 설명했습니다.
이번 사건은 자율 AI 시스템의 급속한 발전과 함께 제기되는 안전성 문제에 대한 우려를 심화시키고 있습니다. 특히, 강력한 AI 모델을 오픈AI와 같은 기업이 독점적으로 관리하는 것이 더 안전한지, 아니면 더 개방적인 생태계를 통해 광범위한 사용과 감시를 허용하는 것이 나은지에 대한 논쟁에 다시 불을 지피고 있습니다. 오픈AI는 이번 사건에 대한 철저한 조사를 진행 중이며, 조만간 기술 보고서를 발표할 예정입니다.
