카멜AI(CamelAI)가 개발자들을 위한 새로운 서비스 '스트림(Stream)'을 선보였습니다. 이 서비스는 딥시크 V4 플래시(DeepSeek V4 Flash) 모델을 월 5달러의 고정 요금으로 무제한 사용할 수 있는 API를 제공합니다. 이는 토큰 사용량이나 GPU 운영에 대한 걱정 없이 코딩 에이전트와 같은 고부하 AI 애플리케이션을 구동할 수 있게 함으로써, 개발자들이 예측 불가능한 비용 문제에서 벗어나 온전히 개발에 집중할 수 있도록 돕습니다.
스트림 API는 딥시크 V4 플래시(0731 버전) 모델을 기반으로 하며, OpenAI 호환 엔드포인트를 제공하여 기존 OpenAI SDK를 사용하는 개발자들이 쉽게 통합할 수 있습니다. 특히 헤르메스(Hermes), 오픈코드(OpenCode), 오픈클로(OpenClaw), 에이더(Aider) 등 주요 코딩 에이전트와의 호환성을 강조하며, 이들 에이전트가 파일 읽기, 도구 호출, 재시도, 긴 대화 기록 유지 등 복잡한 작업을 수행할 때 발생하는 예측 불가능한 토큰 비용 문제를 해결합니다. 단, 초기 플랜에서는 한 번에 하나의 활성 생성(active generation)만 지원하며, 추가 요청은 큐에 대기하게 됩니다. 256K의 컨텍스트 윈도우(context window)를 제공하여 긴 에이전트 세션도 문제없이 처리할 수 있습니다.
이러한 정액제 모델은 AI 에이전트 개발의 고질적인 문제였던 비용 예측 불확실성을 해소한다는 점에서 큰 의미를 가집니다. 기존 종량제 방식은 에이전트의 복잡한 작업 흐름 때문에 토큰 사용량을 예측하기 어려웠고, 이는 곧 개발 비용의 불안정성으로 이어졌습니다. 스트림은 이러한 문제를 해결하여 개발자들이 비용 걱정 없이 자유롭게 실험하고, 더 나아가 사용자들에게도 예측 가능한 AI 서비스를 제공할 수 있는 기반을 마련합니다. 이는 AI 애플리케이션의 확산과 혁신을 가속화하는 중요한 전환점이 될 수 있습니다.
