Почему документ ломается, если вставить его в переводчик
Абзац Word — это не строка текста. Это ряд фрагментов (runs) — участков с одинаковым шрифтом, размером и цветом, — между которыми стоят поля, закладки, привязки комментариев, ссылки на сноски и изображения. Скопируйте текст, переведите и вставьте обратно — и всё, что не было буквами, пропадёт: полужирный, ссылки, поле с номером страницы, знак сноски.
Очевидное решение — переводить по фрагментам — ещё хуже. В разных языках разный порядок слов, поэтому «the red house» должно стать «la casa roja»: прилагательное перемещается, и полужирный должен переместиться вместе с ним. Переведите части по отдельности — и получится «la roja casa», чего ни один испаноговорящий не написал бы. Каждый абзац нужно переводить целиком, чтобы форматирование двигалось вместе со словами, а затем раскладывать обратно по фрагментам. Именно так работают эти инструменты, и поэтому полужирное слово, гиперссылка или выделенная фраза оказываются в переводе на нужных словах.
Всё остальное в файле — стили, нумерация, параметры страницы, темы, изображения — вообще не переписывается. Файл, который вы скачиваете, — это ваш оригинал с другими словами, а не новый документ, сделанный похожим на него.
Таблицы — это программы, а не просто текст
У книги есть проблема, которой нет у документа: часть её слов — это данные, с которыми сравнивают формулы. =COUNTIF(C:C, "Paid") считает ячейки со словом «Paid». Переведите ячейки как «Pagado» — и формула по-прежнему работает, по-прежнему показывает число, только теперь это ноль. Выпадающие списки, поиск по названию товара и столбцы таблиц, на которые ссылаются по имени, ломаются так же незаметно.
Поэтому «Перевести Excel» сначала читает все формулы, списки проверки данных, сводные таблицы и ссылки на таблицы в книге, и любой текст, от которого они зависят, остаётся в точности как был. Страница сообщает, сколько таких ячеек, так что ничего не остаётся без перевода без вашего ведома. Названия листов тоже не меняются, потому что формулы на других листах и в других книгах находят лист по имени.
Переводится всё, что читает человек: текст ячеек, ячейки с форматированным текстом, комментарии и примечания, фигуры и надписи, заголовки и подписи диаграмм. Числа, даты, коды и адреса остаются как есть, а текст, повторяющийся в тысячах ячеек, переводится один раз и поэтому везде звучит одинаково.
Насколько хорош машинный перевод — честно
Здесь используется перевод, который Mozilla создала для перевода страниц в Firefox: беглый, быстрый и лучше всего работающий между английским и распространёнными европейскими языками. Он отлично подходит, чтобы понять документ, подготовить черновой вариант для проверки и перевести повседневные материалы — письма, инструкции, прайс-листы, отчёты, — за которые никто не стал бы платить переводчику.
Но он не заменяет профессионала там, где формулировки имеют вес. Машинный перевод может выдать предложение, которое читается идеально, а говорит немного другое, и он никак не может знать терминологию вашей компании. Всё юридическое, медицинское, финансовое и то, что пойдёт в печать, пусть проверит человек, свободно владеющий языком. Короткий текст без контекста — столбец таблицы с названием «Net» или «Draw» — самый трудный случай для любого переводчика, поэтому бегло просмотрите заголовки.
Языки без прямой модели переводятся через английский. Это происходит автоматически и обычно работает хорошо, но оттенок смысла может потеряться дважды, поэтому точнее всего прямые пары с английским и на английский.
Языковые данные и почему первый запуск дольше
Когда вы впервые переводите на какой-то язык, загружаются его языковые данные — примерно от 15 до 70 MB в зависимости от языка, и страница показывает точный размер до начала. Потом они сохраняются, поэтому следующий документ на том же языке начинает переводиться за секунду-две, а удалить их можно на странице инструмента в любой момент.
Поэтому же вашему документу никуда не нужно уходить. Перевод выполняется здесь, над файлом, который вы перетащили, и передаются только языковые данные, одинаковые для всех.