최근 '트랜스크레베르 엔트레비스타(Transcrever Entrevista)'라는 새로운 웹 서비스가 'Show HN'을 통해 공개되며 주목받고 있습니다. 이 서비스는 사용자가 웹 브라우저에서 직접 오디오 파일을 업로드하여 인터뷰 내용을 텍스트로 변환하고, 심지어 화자(speaker)까지 자동으로 분리해주는 기능을 제공합니다. 특히, 생성된 텍스트를 원본 오디오와 함께 들으며 쉽게 수정할 수 있는 편집 환경을 제공하여 인터뷰 녹취 작업의 효율성을 크게 높였습니다.
'트랜스크레베르 엔트레비스타'는 MP3, M4A, WAV, MP4 등 다양한 오디오 및 비디오 포맷을 지원하며, 최대 2시간 분량 또는 500MB 크기의 파일을 처리할 수 있습니다. 특히 2명의 화자(인터뷰어와 인터뷰이)에게 최적화되어 있으며, 최대 6명까지 화자 분리가 가능하다고 설명합니다. AI 기반으로 텍스트 초안을 생성한 후, 사용자는 각 문단별로 원본 오디오를 재생하며 정확성을 검토하고 수정할 수 있습니다. 무료 샘플로는 처음 5분 분량의 오디오를 처리해볼 수 있으며, 회원가입 없이도 24시간 동안 오디오와 녹취록을 이용할 수 있습니다. 이후에는 자동으로 삭제되므로, 장기 보관을 원하면 회원가입 후 저장해야 합니다. 최종 결과물은 DOCX 또는 TXT 형식으로 다운로드할 수 있습니다.
이러한 브라우저 기반의 인터뷰 녹취 서비스는 기자, 연구자, 콘텐츠 크리에이터 등 정기적으로 인터뷰를 진행하는 전문가들에게 매우 유용할 것으로 예상됩니다. 기존에는 별도의 소프트웨어를 설치하거나 복잡한 과정을 거쳐야 했던 녹취 작업을 웹에서 간편하게 처리할 수 있게 함으로써 접근성을 높였습니다. 특히 AI 기술을 활용한 화자 분리 및 텍스트 초안 생성 기능은 수동 녹취에 소요되는 시간과 노력을 획기적으로 줄여줄 수 있으며, 원본 오디오와 연동된 편집 기능은 정확도를 높이는 데 기여할 것입니다. 이는 인터뷰 콘텐츠 제작 과정의 효율성을 개선하고, 더 나아가 다양한 분야에서 음성 데이터를 텍스트로 활용하는 방식을 변화시킬 잠재력을 가지고 있습니다.
