서버리스 벡터 데이터베이스 터보퍼퍼(Turbopuffer)가 차세대 스토리지 아키텍처인 v3를 발표하며, 기존의 '벡터 데이터베이스' 개념에 작별을 고했습니다. 터보퍼퍼는 v3에서 문서와 인덱스가 저장되고, 기록되며, 압축되고, 쿼리되는 방식을 전면 개편합니다. 이는 벡터 검색을 포함한 모든 검색 속도를 향상시킬 뿐만 아니라, 더 많은 SQL 쿼리를 터보퍼퍼에서 빠르고 효율적으로 처리할 수 있는 기반을 마련할 예정입니다.
터보퍼퍼는 v1에서 저렴하고 빠른 벡터 검색에 특화된 서버리스 벡터 데이터베이스로 시작했습니다. 객체 스토리지를 진실의 원천(source of truth)으로 삼아 경제성을 확보하고, NVMe SSD 및 메모리 캐시를 통해 성능을 높였습니다. 이후 v2에서는 강력한 텍스트 및 정규 표현식(regex) 검색 기능을 추가하며 다양한 비검색 용도로도 활용되었지만, 핵심 스토리지 아키텍처는 여전히 ANN(Approximate Nearest Neighbor) 벡터 인덱스를 중심으로 설계되어 있었습니다. 이러한 벡터 중심 설계는 그룹 바이(GROUP BY)나 집계(aggregations) 같은 특정 쿼리 계획의 확장을 제약하는 문제점을 안고 있었습니다.
이에 터보퍼퍼는 ANN 인덱스를 '그저 또 다른 보조 인덱스'로 전환하고, 새로운 기본 인덱스(primary index)를 도입하는 대대적인 변화를 추진하고 있습니다. 이로써 벡터 검색 성능은 유지하면서도, 텍스트, 정규 표현식, SQL 쿼리 등 다양한 유형의 검색 및 데이터 처리에서 최첨단 성능을 제공할 수 있게 됩니다. 이번 아키텍처 변경은 기존 벡터 데이터베이스의 한계를 뛰어넘어, 더욱 범용적이고 강력한 검색 및 데이터 처리 플랫폼으로 진화하려는 터보퍼퍼의 전략적 움직임으로 해석됩니다.
