최근 '레송(Lessong)'이라는 새로운 명령줄 인터페이스(CLI) 도구가 공개되어, 사용자가 좋아하는 어떤 노래든 언어 학습 자료로 변환할 수 있게 되었습니다. 이 도구는 MP3 파일을 입력받아 보컬 제거, 가사 타이밍 분석, 번역, 그리고 텍스트 음성 변환(TTS) 과정을 거쳐 학습용 오디오를 자동으로 생성합니다. 벨기에 라디오 방송 '클래식 21'의 90년대 인기 코너 '플랜 랑그(Plan Langue)'에서 영감을 받아 개발되었으며, 팝송을 통해 영어를 가르치던 방식을 현대 AI 기술로 자동화한 것이 특징입니다.
레송의 핵심 기능은 정교한 AI 기술 스택에 기반합니다. 먼저 '데먹스(Demucs)'를 활용해 노래에서 보컬과 반주를 분리하고, '일레븐랩스(ElevenLabs)'의 음성 인식 기술로 보컬의 단어별 타이밍을 추출합니다. 이후 '오픈AI(OpenAI)'의 대규모 언어모델(LLM)을 이용해 가사를 번역하고 노래의 구조(벌스, 코러스 등)를 분석합니다. 각 가사 줄은 원어와 번역된 언어로 번갈아 발음되며, 이 과정은 원곡의 반주 루프 위에서 진행됩니다. 학습 구간이 끝나면 실제 원곡의 해당 부분이 재생되어 학습 효과를 극대화합니다. 이 모든 과정은 단 하나의 명령어로 실행되며, 약 4분 길이의 노래를 처리하는 데 4~5분 정도 소요됩니다.
레송은 언어 학습 방식에 있어 흥미로운 변화를 가져올 잠재력을 지니고 있습니다. 단순히 가사를 번역하는 것을 넘어, 노래의 맥락과 감정을 활용하여 보다 몰입감 있는 학습 경험을 제공합니다. 이는 특히 젊은 세대에게 친숙한 미디어를 통해 언어 학습의 장벽을 낮추고 동기를 부여하는 데 효과적일 수 있습니다. 또한, 사용자가 직접 좋아하는 노래를 학습 자료로 만들 수 있다는 점에서 개인화된 학습 콘텐츠 제작의 가능성을 열어줍니다. 이처럼 레송은 AI 기술을 활용해 교육 콘텐츠 제작의 자동화와 개인화를 한 단계 발전시킨 사례로 평가할 수 있습니다.