PDF 문서를 번역할 때, 번역 품질 자체보다 표나 이미지, 제목과 본문의 관계 등 문서의 레이아웃이 깨지는 문제가 사용자들에게 큰 불편함을 초래해왔습니다. 일반 번역기에 PDF 텍스트를 입력하면 문장은 번역되지만, 문서 구조가 뒤섞이거나 수식, 특수문자가 변형되고 스캔 PDF는 아예 텍스트 추출조차 어려운 경우가 많았습니다. 이러한 문제점을 해결하기 위해, 원본 문서의 구조를 최대한 유지하면서 번역하는 새로운 도구 'PDF Translate'가 개발되어 주목받고 있습니다.
'PDF Translate'는 PDF 파일을 직접 입력받아 번역하며, 제목, 문단, 폰트, 페이지 구조는 물론 표와 이미지까지 원본과 유사하게 유지하는 데 중점을 둡니다. 디지털 PDF는 물론, OCR(광학 문자 인식) 기술을 활용해 스캔 PDF도 번역할 수 있으며, 수식이나 특정 문자를 보호하는 옵션과 60개 이상의 언어를 지원합니다. 특히, 번역본만 있는 PDF 출력과 원문-번역문을 나란히 볼 수 있는 이중 컬럼 PDF 기능을 제공하여 논문이나 계약서 등 용어 확인이 중요한 문서 작업에 유용합니다. 또한, 긴 문서를 번역하기 전 문서 요약 및 Q&A 기능을 통해 필요한 정보를 빠르게 파악할 수 있도록 돕습니다.
이 도구의 핵심은 단순히 텍스트를 번역하는 것을 넘어, '다시 읽을 수 있는 문서'를 만드는 데 있습니다. 논문이나 기술 문서처럼 표, 수식, 각주가 많은 PDF는 텍스트 번역 품질이 좋아도 레이아웃이 깨지면 실제 내용을 이해하기 어렵기 때문입니다. 'PDF Translate'는 이러한 문서의 위치 관계와 구조를 보존함으로써 사용자가 번역된 내용을 더 효율적으로 이해하고 활용할 수 있도록 지원합니다. 이는 기존 번역 서비스들이 간과했던 중요한 사용자 경험을 개선하는 시도로, 복잡한 문서를 다루는 연구자, 학생, 비즈니스 전문가들에게 큰 도움이 될 것으로 기대됩니다.