Чем машинный перевод отличается от перевода в бюро
Машинный перевод закрывает объёмы, недоступные человеку по срокам: 8 000 страниц проходят за день, тогда как бюро назовёт за тот же объём недели. Качество удерживается не вычиткой каждого сегмента, а конструкцией процесса — глоссарием, памятью переводов и автоматическим контролем на выходе. Человек подключается там, где документ требует финальной сверки, а не на каждой странице; за счёт этого стоимость получается примерно втрое ниже классического перевода.
Сколько стоит машинный перевод
Стоимость машинного перевода (ИИ-перевода) зависит прежде всего от сценария обработки и требований к результату. При переводе через API стоимость обычно рассчитывается за миллион символов и начинается примерно от 4 000 рублей за 1 млн символов. Для перевода документов чаще используется стоимость за слово. В полностью автоматическом режиме ориентир может составлять от 0,1 рубля до 1,5 рубля за слово и выше в зависимости от сложности технологической цепочки.
В базовом сценарии документ может переводиться одной специализированной или дообученной моделью. В более сложном корпоративном сценарии ИИ-перевод представляет собой многоэтапный автоматизированный процесс: подстановка данных из памяти переводов, перевод специализированной моделью, ИИ-постредактура, проверка и обеспечение терминологической точности, контроль качества перевода, проверка тегов и плейсхолдеров и другие автоматические проверки. Такая цепочка может учитывать отраслевые требования, корпоративные инструкции, глоссарии, референсные материалы и контекст документа. Все этапы выполняются автоматически, но глубина обработки и количество проверок напрямую влияют на стоимость.
Поэтому корректный ориентир для автоматического ИИ-перевода документов сегодня — примерно от 0,1 рубля за слово для перевода одной моделью до 1,5 рубля за слово и выше для многоэтапного корпоративного процесса с комплексным контролем качества.
Почему цены на машинный перевод так сильно различаются
Первая причина в том, что под одним словом скрываются разные продукты: поток перевода через API и готовый документ с контролем качества — это разные производственные цепочки и разные единицы измерения, символы против слов. Вторая — в том, что «машинный перевод» сегодня означает не одну технологию, а сценарий из нескольких, и стоимость определяет его устройство. Разницу в цене создают четыре вещи: какие модели участвуют — одна дообученная NMT или связка NMT и LLM с несколькими проходами; насколько технологичен производственный процесс — есть ли память переводов, выравнивание терминологии, автоматическая постредактура и контроль качества; насколько инженер сумел настроить систему под конкретный контент; и какие требования к финальному качеству ставит заказчик. Дешёвый перевод одной моделью и выверенная цепочка — это разные продукты, и сравнивать их по цене за слово без учёта сценария бессмысленно.
Какое качество даёт машинный перевод и как его измерить
Точность отраслевой терминологии в наших проектах — 99% по внутренним замерам, и это измеримая величина, а не оценка на глаз. Качество замеряется несколькими способами: BLEU показывает совпадение с эталонным переводом на уровне слов; COMET — нейронная метрика, оценивающая близость по смыслу, а не по совпадению формулировок, и она точнее согласуется с оценкой человека; Edit Distance показывает, сколько правок внёс редактор; MQM даёт разбор ошибок по типам и весам. Замер делается до и после обучения движка, поэтому прирост качества виден в цифрах.
Нужно ли редактировать машинный перевод человеком
Зависит от назначения документа: для внутреннего понимания правка не нужна, для публикации и регуляторных подач — нужна. Международный стандарт ISO 18587 описывает, как эту работу выполняет человек, и разделяет два уровня: light post-editing исправляет только смысловые ошибки, full post-editing доводит текст до уровня человеческого перевода.
Мы решаем ту же задачу технологически. Постредактированием занимается цепочка агентов: каждый последовательно дорабатывает текст на своём участке — смысл, терминология, стиль, форматирование, — а решение о том, достигнуто ли требуемое качество, принимает отдельная модель в роли судьи, LLM-as-a-judge. Глубина доработки задаётся требованиями к документу, а не количеством часов редактора: агенты идут друг за другом до тех пор, пока результат не пройдёт оценку.
Человек из процесса не исчезает: он проверяет результат в нашей CAT-системе, где рядом видны сегменты, память переводов, глоссарий и результаты автоматических проверок. Но его работа — контроль и финальная сверка, а не построчная правка всего документа.
На сколько языков вы переводите
Более 100 языков, включая редкие пары. Для основных направлений используются собственные движки, дообученные под отрасль, для остальных — подобранные под задачу модели с глоссарием и контролем терминологии. Подбор движка под конкретную языковую пару делается на вашем материале, до начала работы.
Цены ориентировочные и приведены для понимания порядка величин. Они не являются публичной офертой; стоимость работ определяется в Условиях оказания услуг и договоре после оценки ваших материалов.