미스트랄 AI(Mistral AI)가 생성형 인공지능(AI) 모델에서 발생할 수 있는 유해 콘텐츠를 실시간으로 감지하고 차단하는 새로운 가드레일 모델 '쉴드스트랄(Shieldstral)'을 공개했습니다. 쉴드스트랄은 텍스트와 이미지 모두에 적용 가능한 30억(3B) 매개변수 오픈웨이트(open-weight) 멀티모달 모델로, 개발자와 기업이 생성형 AI 애플리케이션의 안전성을 손쉽게 관리할 수 있도록 설계되었습니다.
쉴드스트랄의 가장 큰 특징은 자연어(natural language)로 안전 정책을 정의할 수 있다는 점입니다. 이를 통해 사용자는 복잡한 코딩 없이도 특정 키워드, 이미지 유형 또는 콘텐츠 맥락에 대한 안전 기준을 설정할 수 있습니다. 또한, 단일 토큰 출력만으로 텍스트, 이미지 또는 두 가지 모두를 평가할 수 있으며, 단일 16GB GPU만으로도 로컬에서 실행 가능하여 효율성과 접근성이 뛰어납니다. 이는 미스트랄 AI가 추구하는 '오픈되고 휴대 가능한 생성형 AI' 철학의 연장선상에 있습니다. 쉴드스트랄은 무료로 제공되며, 개발자 및 기업이 AI 모델의 잠재적 위험을 효과적으로 관리할 수 있는 강력한 도구가 될 것으로 기대됩니다.
이번 쉴드스트랄 출시는 생성형 AI의 확산과 함께 중요성이 커지고 있는 AI 안전(AI Safety) 문제에 대한 실용적인 해결책을 제시합니다. 특히, 오픈소스(open source) 형태로 제공되어 더 많은 개발자가 AI 안전 기술에 접근하고 개선하는 데 기여할 수 있다는 점에서 의미가 큽니다. 기업들은 쉴드스트랄을 활용해 자사 서비스에 AI 모델을 도입할 때 발생할 수 있는 윤리적, 법적 문제를 사전에 방지하고, 사용자에게 더욱 안전하고 신뢰할 수 있는 AI 경험을 제공할 수 있을 것입니다. 이는 AI 기술의 책임감 있는 발전을 촉진하고, 광범위한 산업 분야에서 AI 도입을 가속화하는 데 중요한 역할을 할 것으로 보입니다.