본문 바로가기

서식을 잃지 않는 문서 번역

워드 문서, 엑셀 통합 문서, PDF를 다른 언어로 번역하고 같은 파일로 돌려받으세요. 표, 차트, 수식, 그림이 모두 제자리에 있습니다. 아무것도 저장하지 않습니다. 절대로요.

도구 3개, 회원가입 없음, 워터마크 없음

워드 문서 번역은 Word 문서를 다른 언어로 옮기면서 제목, 표, 머리글, 각주, 그림을 그대로 둡니다. 엑셀 파일 번역은 통합 문서에 같은 일을 하되, 수식이 참조하는 텍스트는 건드리지 않아 숫자가 계속 맞게 합니다. PDF 번역은 번역한 문단을 같은 페이지, 같은 그림 위에 다시 배치합니다. 세 도구 모두 파일이 어떤 언어로 쓰였는지 알아내고, 50개 이상 언어 사이에서 번역하며, 문서를 어디에도 보내지 않습니다. 아래에서는 ‘서식 유지’에 실제로 무엇이 필요한지, 그리고 기계 번역을 어디서 사람이 확인해야 하는지 설명합니다.

문서를 번역기에 붙여 넣으면 깨지는 이유

Word 문단은 단순한 텍스트 한 줄이 아닙니다. 같은 글꼴, 크기, 색상을 공유하는 구간인 런(run)이 나란히 놓여 있고, 그 사이사이에 필드, 책갈피, 메모 앵커, 각주 참조, 그림이 끼어 있습니다. 텍스트를 복사해 번역한 뒤 다시 붙여 넣으면 글자가 아닌 것은 전부 사라집니다. 굵은 글씨, 링크, 페이지 번호 필드, 각주 표시가 모두요.

런 단위로 번역하는 뻔한 해결책은 더 나쁩니다. 언어마다 어순이 달라서 “the red house”는 “la casa roja”가 되어야 합니다. 형용사가 자리를 옮기고, 굵은 서식도 함께 옮겨 가야 합니다. 조각을 따로 번역하면 “la roja casa”가 되는데, 스페인어 사용자라면 아무도 이렇게 쓰지 않습니다. 문단은 통째로 번역하되 서식이 단어와 함께 따라가야 하고, 그런 다음 런 단위로 다시 넣어야 합니다. 이 도구들이 바로 그렇게 하며, 그래서 굵은 단어, 하이퍼링크, 강조 표시된 구절이 번역문에서도 올바른 단어에 붙습니다.

파일의 나머지, 즉 스타일, 번호 매기기, 페이지 설정, 테마, 이미지는 전혀 다시 쓰지 않습니다. 다운로드하는 파일은 원본에 단어만 바뀐 것이지, 원본처럼 보이도록 새로 만든 문서가 아닙니다.

스프레드시트는 텍스트가 아니라 프로그램입니다

통합 문서에는 문서에 없는 문제가 있습니다. 일부 단어는 수식이 비교 대상으로 삼는 데이터입니다. =COUNTIF(C:C, "Paid")는 영어 단어 “Paid”가 들어 있는 셀을 셉니다. 셀을 “Pagado”로 번역하면 수식은 여전히 실행되고 숫자도 표시되지만, 그 숫자는 이제 0입니다. 드롭다운 목록, 제품 이름으로 찾는 조회, 이름으로 참조하는 표 열도 똑같이 소리 없이 망가집니다.

그래서 엑셀 파일 번역은 통합 문서의 모든 수식, 유효성 검사 목록, 피벗 테이블, 표 참조를 먼저 읽고, 그것들이 의존하는 텍스트는 원래대로 정확히 둡니다. 그렇게 둔 셀이 몇 개인지 페이지에 표시되므로, 모르는 사이에 번역되지 않고 남는 것은 없습니다. 시트 이름도 그대로 둡니다. 다른 시트나 다른 통합 문서의 수식이 시트를 이름으로 찾기 때문입니다.

번역되는 것은 사람이 읽는 모든 것입니다. 셀 텍스트, 여러 서식이 섞인 서식 있는 텍스트 셀, 메모와 노트, 도형과 텍스트 상자, 차트 제목과 레이블입니다. 숫자, 날짜, 코드, 주소는 그대로 두며, 수천 개의 셀에 반복되는 텍스트는 한 번만 번역해 어디서나 똑같이 읽히게 합니다.

기계 번역, 솔직히 얼마나 좋은가

여기서 쓰는 번역은 Mozilla가 Firefox 페이지 번역용으로 만든 것입니다. 자연스럽고 빠르며, 영어와 널리 쓰이는 유럽 언어 사이에서 가장 뛰어납니다. 문서 내용을 파악하거나, 검토받을 초안을 만들거나, 아무도 번역가에게 돈을 주고 맡기지 않을 일상적인 자료(편지, 설명서, 가격표, 보고서)를 번역하는 데 매우 좋습니다.

하지만 문구 하나하나가 중요한 곳에서 전문가를 대신할 수는 없습니다. 기계 번역은 완벽하게 읽히면서도 미묘하게 다른 뜻의 문장을 만들 수 있고, 회사의 용어를 알 방법도 없습니다. 법률, 의료, 금융 문서나 인쇄할 문서는 반드시 그 언어에 능통한 사람에게 확인받으세요. 맥락 없는 짧은 텍스트, 예를 들어 “Net”이나 “Draw”라는 스프레드시트 열 이름은 어떤 번역가에게도 가장 어려운 경우이니, 제목들은 한 번 훑어보세요.

직접 번역 모델이 없는 언어는 영어를 거쳐 번역합니다. 자동으로 이루어지고 대개 잘 되지만, 뉘앙스를 두 번 잃을 수 있으므로 영어와 직접 오가는 조합이 가장 정확합니다.

언어 데이터, 그리고 첫 실행이 오래 걸리는 이유

어떤 언어로 처음 번역할 때는 그 언어의 언어 데이터를 다운로드합니다. 언어에 따라 약 15~70 MB이며, 시작하기 전에 페이지에서 정확한 크기를 알려 드립니다. 한 번 받으면 보관되므로 같은 언어의 다음 문서는 1~2초 만에 시작하며, 원할 때 언제든 도구 페이지에서 삭제할 수 있습니다.

문서를 어디에도 보낼 필요가 없는 이유도 여기에 있습니다. 번역은 여기서, 끌어다 놓은 파일에 대해 이루어지며, 오가는 것은 누구에게나 똑같은 언어 데이터뿐입니다.

이 도구들의 기반 기술

실제 작업을 수행하는 오픈 소스 엔진과, 이들이 구현한 규격입니다.

  • Bergamot TranslatorMPL-2.0 — 번역 처리 — Firefox에 내장된 Mozilla의 엔진.
  • Firefox Translations modelsMPL-2.0 — Mozilla가 학습시켜 이 사이트에서 수정 없이 제공하는 언어 모델.
  • fflateMIT — .docx와 .xlsx의 실체인 ZIP 패키지를 열고 다시 쓰기.
  • HarfBuzzMIT — 번역된 PDF에서 벵골어, 힌디어, 아랍어 등 복잡한 문자를 조합하고, 글꼴을 사용된 글자만 남도록 축소.
  • Bijoy2UnicodeMIT — 오래된 PDF 속 Bijoy(SutonnyMJ) 방식 벵골어 텍스트를 번역할 수 있도록 유니코드로 변환.
  • BharatType Hindi Text UtilitiesMIT — 오래된 PDF 속 Kruti Dev 방식 힌디어 텍스트를 번역할 수 있도록 유니코드로 변환.
  • Noto Sans CJKOFL-1.1 — 번역된 PDF의 중국어, 일본어, 한국어 조판.
  • ECMA-376 (Office Open XML)Specification — Word와 Excel 파일의 기반 표준이며, 어떤 부분이 텍스트인지 정의.

자주 묻는 질문

정말 무료인가요?

네. 회원가입도, 페이지 수 제한도, 워터마크도 없습니다. 번역은 저희 서버에서 하지 않으므로 번역할 때마다 요금이 붙지 않습니다.

문서가 저장되거나 업로드되나요?

아니요. 문서는 여기서 번역되고 어디에도 보내지지 않으며, 아무것도 저장하지 않습니다. 유일하게 다운로드되는 것은 누구에게나 똑같은 언어 데이터입니다.

어떤 언어를 지원하나요?

50개 이상입니다. 스페인어, 프랑스어, 독일어, 포르투갈어, 이탈리아어, 네덜란드어, 폴란드어, 러시아어, 우크라이나어, 튀르키예어, 아랍어, 페르시아어, 히브리어, 힌디어, 벵골어, 우르두어, 타밀어, 중국어, 일본어, 한국어, 인도네시아어, 태국어, 베트남어 등이 포함되며, 어느 언어에서든 다른 어느 언어로든 번역할 수 있습니다.

PDF를 바로 번역할까요, 워드로 먼저 변환할까요?

읽거나 공유하려면 [PDF 번역](translate-pdf)을 쓰세요. 페이지가 원래 모습 그대로 유지됩니다. 번역문을 계속 편집하려면 [PDF 워드 변환](pdf-to-word)으로 변환한 뒤 [워드 문서 번역](translate-docx)을 쓰세요. Word 문서는 길어진 텍스트에 맞춰 내용이 다시 흐르지만, PDF 페이지는 그럴 수 없습니다.

오래된 .doc, .xls 파일은요?

Word나 Excel에서 열어 .docx나 .xlsx로 저장하거나, 스프레드시트라면 [XLS XLSX 변환](xls-to-xlsx)으로 변환한 다음 새 파일을 번역하세요.