인도어 기반의 인공지능(AI) 모델 '가르기(Gargi)'가 영어가 아닌 인도 현지 언어의 고유한 세계관을 보존하면서 에이전트(agentic) 작업을 수행하는 대규모 언어모델(LLM)을 개발하고 있어 주목받고 있습니다. 이는 기계가 10억 명에 달하는 인도인들의 언어를 이해하기 위해 그들이 영어를 사용해야 하는 장벽을 허물겠다는 비전을 제시합니다.
가르기는 인도어(Indic languages)를 처음부터 구축한 언어 모델과 공유 지식 인프라를 통해 다양한 언어 모델을 만들고 있습니다. 현재 3,800만 명의 화자를 가진 말라얄람어(Malayalam) 모델 M1을 출시했으며, 1억 1천만 개의 매개변수(parameter)를 가지고 있습니다. 또한, 7,900만 명의 화자를 가진 타밀어(Tamil) 모델 T1은 개발 예정이며, 칸나다어(Kannada)와 텔루구어(Telugu) 모델도 데이터 수집 및 개발을 계획하고 있습니다. 이는 각 언어의 독특한 문화적 맥락과 지식을 AI에 반영하려는 시도입니다.
이러한 접근 방식은 단순히 번역을 넘어 각 언어가 가진 고유한 사고방식과 표현을 AI가 직접 이해하고 활용할 수 있게 합니다. 이는 전 세계적으로 지배적인 영어 중심의 AI 개발에서 벗어나 언어적 다양성을 존중하고 보존하는 중요한 의미를 가집니다. 가르기의 노력은 인도 시장뿐만 아니라 비영어권 사용자들에게도 자국어 기반의 AI 서비스가 확산될 가능성을 보여주며, 글로벌 AI 생태계의 포용성을 높이는 데 기여할 것으로 기대됩니다.