yozm.tech
피드로 돌아가기
TechCrunchHOTAI 재작성

Abliteration.ai is making a business out of removing AI guardrails

AI 모델의 유해성 방지 안전장치(guardrail)를 제거한 모델을 상업적으로 제공하는 스타트업 애블리터레이션.AI(Abliteration.ai)가 등장했습니다. 이들은 사이버 보안 강화 등 긍정적 활용 가능성을 주장하지만, 유해 콘텐츠 생성 등 악용 우려도 제기되고 있습니다. 오픈소스 AI 모델의 안전장치 제거 기술이 상용화되면서 논란이 커지고 있습니다.

7시간 전·2026.09.03·읽기 1·Rebecca Bellan

인공지능(AI) 모델의 유해성 방지 안전장치(guardrail)를 제거한 버전을 상업적으로 제공하는 스타트업 애블리터레이션.AI(Abliteration.ai)가 등장해 논란이 되고 있습니다. 이 회사는 오픈소스 AI 모델의 안전장치 제거 기술을 서비스화하여, 사용자들이 웹 브라우저나 API를 통해 쉽게 접근할 수 있도록 했습니다. 이는 기존에 연구자나 개발자들이 비공식적으로 수행하던 작업을 상업적 영역으로 끌어올린 것으로, AI 안전과 악용 가능성에 대한 중요한 질문을 던지고 있습니다.

애블리터레이션.AI는 최근 출시된 Z.ai의 GLM-5.3을 포함한 여러 오픈 가중치(open-weight) 모델의 수정 버전을 호스팅하고 있습니다. 이들은 '공격적인 사이버 활동, 레드팀(red-teaming) 테스트, 에이전트 테스트' 등 기존 모델이 거부하던 작업을 수행할 수 있도록 돕는 것이 목표라고 밝혔습니다. 이는 방어자가 공격자와 동일한 도구를 사용해 취약점을 파악하고 방어 전략을 강화할 수 있다는 사이버 보안 분야의 오랜 논리와 일맥상통합니다. 실제로 테크크런치(TechCrunch)의 테스트 결과, 이 서비스는 크롬(Chrome) 비밀번호를 훔치는 파이썬(Python) 프로그램이나 위험한 병원균 배양 프로토콜을 쉽게 생성했습니다. 애블리터레이션.AI는 아직 벤처 캐피탈 투자를 유치하지 않았지만, 고객 수익만으로 주요 클라우드 제공업체와 계약을 맺고 있다고 전했습니다.

이러한 서비스는 AI 안전 전문가들 사이에서 큰 우려를 낳고 있습니다. AI 안전 비영리 단체 시브AI(CivAI)의 앤드류 윤(Andrew Yoon) 연구 책임자는 안전장치가 제거된 모델을 '사회병질자(sociopath)'에 비유하며, 가까운 미래에 이러한 모델이 해로운 목적으로 사용될 것이라고 경고했습니다. 정부가 GPU 접근에 대한 고객 신원 확인을 의무화하고 유해 활동을 탐지하는 분류기(classifier)를 요구해야 한다는 주장도 나옵니다. 애블리터레이션.AI는 자체적으로 일부 완화된 안전장치를 제공하고 고객이 원하는 가드레일을 추가할 수 있는 기능을 제공하지만, 누가 서비스에 접근할 수 있는지에 대한 책임 문제는 여전히 해결해야 할 과제로 남아 있습니다.

애블리터레이션.AI의 등장은 오픈소스 AI 모델의 확산과 함께 AI 안전의 경계가 어디까지인가에 대한 근본적인 질문을 제기합니다. 창업자 데본(Devon)은 안전장치가 제거된 모델이 '악의적인 행위자를 모델링'하여 방어자들이 더 빠르게 대응하고 사이버 보안을 가속화할 수 있다고 주장합니다. 이미 영국과 유럽의 여러 레드팀 스타트업들이 은행, 항공사 등 중요 인프라를 다루는 기업의 사이버 보안 강화를 위해 이 서비스를 활용하고 있다고 합니다. 하지만, 모든 사람이 이러한 '무검열' 모델에 쉽게 접근할 수 있게 되는 것이 인터넷을 더 안전하게 만들지, 아니면 더 위험하게 만들지는 업계와 정부가 함께 고민해야 할 중요한 문제입니다.

1인 창업자를 위한 기회 분석
AI 분석 · 참고용이며 검증이 필요합니다
4/10
보통
4점인가

명확한 B2B 수요가 있지만, 기술적 난이도와 법적, 윤리적 리스크가 매우 높아 1인 창업자가 쉽게 접근하기 어렵습니다.

문제 / 미충족 수요

AI 모델의 안전장치 제거 기술이 상업화되면서, 이를 활용한 사이버 보안 강화와 동시에 악용 가능성 사이의 균형점을 찾는 것이 중요해졌습니다.

한국 시장
국내 미진출 — 기회한국에서도 사이버 보안 레드팀 분야에서 유사한 수요가 있을 수 있으나, AI 모델의 안전장치 제거에 대한 사회적, 법적 논의가 부족합니다.
수익 모델

B2B SaaS 구독, API 종량제 · 돈 내는 주체: 은행, 항공사 등 중요 인프라를 운영하는 대기업의 사이버 보안팀, 또는 이들을 대상으로 하는 레드팀 전문 보안 기업

1인 실현 가능성
2/5

AI 모델 개발 및 호스팅, 보안 전문성, 법적 규제 대응 등 1인이 감당하기에는 기술적, 운영적, 법률적 장벽이 높습니다.

진입 지점 (Wedge)

특정 산업군(예: 금융, 국방)의 사이버 보안 레드팀을 위한 맞춤형 '안전장치 제거 AI 모델' 및 컨설팅 서비스 제공

이번 주 첫 실험

특정 산업군의 사이버 보안 전문가들을 대상으로 '안전장치 제거 AI 모델'의 필요성과 활용 사례에 대한 설문조사 및 인터뷰를 진행하여 니즈를 확인합니다.

Original source
이 글은 TechCrunch의 기사를 yozm.tech가 한국어로 재작성한 버전입니다.
원문 보기