최근 AI 스타트업 언블록드(Unblocked)가 대규모 언어모델(LLM)의 효율성을 획기적으로 개선할 수 있는 '관계형 컨텍스트 엔진(Relational Context Engine)'을 공개했습니다. 이 기술은 기존 검색 증강 생성(RAG) 방식의 한계로 지적되던 높은 토큰(token) 소모 문제를 해결하며, LLM이 필요한 정보를 훨씬 더 적은 비용으로 처리할 수 있도록 돕습니다. 이는 AI 애플리케이션 개발 비용을 절감하고 성능을 향상시키는 데 중요한 진전으로 평가받고 있습니다.
언블록드의 관계형 컨텍스트 엔진은 LLM에 질문과 관련된 모든 문서를 통째로 전달하는 대신, 필요한 정보만을 선별하여 구조화된 형태로 제공합니다. 기존 RAG는 관련성이 높은 문서를 찾아 LLM에 전달했지만, 여전히 불필요한 정보가 포함되어 토큰 소모를 유발했습니다. 언블록드 엔진은 문서 내의 핵심 엔티티(entity)와 그 관계를 파악하고, 이를 그래프 데이터베이스(graph database) 형태로 변환하여 LLM에 전달합니다. 이 과정에서 토큰 소모를 최대 90%까지 줄일 수 있어, LLM 운영 비용을 대폭 절감할 수 있습니다.
이러한 효율성 증대는 AI 서비스의 상용화와 확산에 큰 영향을 미칠 것으로 보입니다. 특히 금융, 법률, 의료 등 방대한 양의 전문 지식을 다루는 분야에서 LLM의 활용성을 높일 수 있습니다. 토큰 비용 절감은 개발자들이 더 복잡하고 정교한 AI 애플리케이션을 경제적으로 구축할 수 있게 하며, 이는 결국 최종 사용자에게 더 저렴하고 고도화된 AI 서비스를 제공하는 기반이 될 것입니다. 언블록드의 기술은 LLM의 실질적인 비용 효율성을 개선하여 AI 기술의 대중화에 기여할 잠재력을 가지고 있습니다.