← Блог
Инженерия4 мин чтения

Почему озвучка в реальном времени идёт на несколько секунд позади

Ethan Hu
Делает DubTab
На этой странице
Человек в наушниках смотрит онлайн-лекцию; смещённые синяя и зелёная звуковые волны намекают на небольшую задержку переведённой речи

Минута живой озвучки — и почти все спрашивают одно и то же: почему голос позади? Субтитры держатся рядом с говорящим. Озвучка перевода доходит на несколько секунд позже.

Причин две, и ни одна не в медленном компьютере. Голосу нужно услышать фразу, прежде чем её сказать. А переведённую фразу обычно дольше произносить, чем исходную. Первое задаёт пол, ниже которого не опуститься. Второе решает, останутся ли эти несколько секунд несколькими секундами.

Сначала услышать, потом говорить

Предложение, которого ещё не слышал, перевести нельзя. У синхронистов то же правило. В исследованиях устного перевода расстояние между слухом и речью называют интервалом ухо–голос (ear-voice span); по обзору 2025 года у профессиональных синхронистов он в среднем от двух до пяти секунд. Это люди с годами практики, в кабине, с одним говорящим.

В некоторых языках ждать приходится дольше: слова, на которых держится смысл, приходят последними. В немецком главный глагол во многих предложениях стоит в конце. В японском и корейском — так устроено правило.

Почему голосу приходится ждатьНемецкий → русский
  1. Ich habe den Vertrag
    У меня есть договор.Звучит как готовая фраза. Это не так.
  2. Ich habe den Vertrag gestern
    Вчера … договорГлагола всё ещё нет
  3. Ich habe den Vertrag gestern nicht
    Вчера не … договорЕсть «не», но чего?
  4. Ich habe den Vertrag gestern nicht unterschrieben.
    Вчера я не подписал договор.Теперь это можно сказать
В немецком глагол — и здесь ещё «не» — часто стоит в конце. Пока не пришло последнее слово, по-русски нельзя сказать уверенно. Перевод, который начинает раньше, вынужден гадать — и эта догадка неверна.

Поэтому голос ждёт, пока фраза станет достаточно цельной, чтобы её сказать, переводит и начинает говорить. Он не тянет до конца длинного предложения, если естественный разрыв случился раньше. Но и раньше смысла стартовать нельзя. Голос, который угадывает и ошибается, хуже того, который чуть запаздывает.

Субтитры получают фору. Строка может появиться сразу, как фразу перевели; голос ещё нужно произнести вслух, в темпе, за которым можно следить. Когда важно держаться как можно ближе к говорящему, читайте субтитры, а голос пусть несёт остальное.

Как из нескольких секунд получается больше

Вторую причину легче не заметить. Переведённое предложение обычно длиннее исходного. С английского на испанский, французский, итальянский или португальский текст раздувается. Говорящий успевает сделать паузу между фразами. Голосу перевода — часто нет.

В естественном темпе голос ещё договаривает одну реплику, а говорящий уже на середине следующей. Следующая строка уже переведена и готова — и ждёт своей очереди. Каждая начинается чуть позже предыдущей, и за лекцию разрыв всё растёт.

Как ведёт себя отставание

Схема. Говорящий произносит шесть фраз, перевод звучит после каждой. Без автоускорения каждая переведённая фраза стартует чуть позже предыдущей, и когда говорящий умолкает, голос ещё на несколько фраз позади. С автоускорением отстающие фразы произносятся быстрее, и голос остаётся недалеко. При быстрой речи и длинном переводе даже ускоренный голос продолжает отставать.

Схема, не в масштабе. Переведённые фразы обычно дольше произносить, поэтому в естественном темпе каждая начинается чуть позже предыдущей. Автоускорение убыстряет голос, только когда он отстал, и удерживает разрыв — если только речь не слишком быстрая, а перевод не слишком длинный.

Вот здесь и выбор — и ни один вариант не обходится без потери.

Выберите два

Живая озвучка перевода может держаться близко к говорящему, говорить в естественном темпе и произносить каждую фразу. Когда перевод длиннее оригинала, все три сразу не сходятся.

Что оставляетеЧем платитеВ DubTab
Близко к говорящему, каждая фразаГолос говорит быстрее, когда отсталАвтоускорение включено (так по умолчанию)
Естественный темп, каждая фразаЗа длинную сессию голос уходит всё дальшеАвтоускорение выключено
Близко к говорящему, естественный темпЧасть сказанного обрезают или сжимаютНе предлагаем

Синхронисты часто берут третью строку. Они обобщают и отбрасывают то, без чего можно обойтись, и тот же обзор отмечает: в исследованиях перевода такие компромиссы считают лучше слишком быстрой речи. Это суждение человека в моменте, о речи, которую он понимает.

Мы не отдаём его программе. На лекции или в курсе фраза, которая звучит «можно пропустить», иногда как раз та, которая была нужна. Поэтому DubTab в обоих режимах произносит каждую переведённую строку, а выбор — между более быстрым голосом и более поздним.

Попробуйте на том, что уже смотрите
Озвучка перевода и субтитры на вашем языке — на видео или трансляции, которая сейчас играет. 15 минут, карта не нужна.
Попробовать DubTab

Что делает Автоускорение

Автоускорение ускоряет озвучку перевода только после того, как она отстала. Первая фраза идёт в естественном темпе, а когда голос догоняет, он снова смягчается. Видео и исходный звук никогда не ускоряются: они идут как обычно.

Как часто это слышно, зависит от языка, на который вы озвучиваете. В английский Автоускорению почти нечего делать. В языки, где перевод раздувается — испанский сильнее всех, — голос большую часть времени говорит ускоренно. Это слышно. Лучше сказать здесь, чем вы узнаете это сами.

Иногда и этого мало. Быстрый говорящий и длинный перевод обгоняют даже более быстрый голос. Разрыв снова растёт, уже медленнее, и сужается, когда говорящий замолкает. Это нижний ряд схемы выше.

Когда так выходит:

  • Читайте субтитры, если важен момент. Они в любом случае держатся близко к говорящему.
  • Выключите Автоускорение, если ускоренный голос раздражает сильнее, чем задержка. Каждая фраза всё равно прозвучит, в естественном темпе, дальше позади.
  • Настройку ищите в статье справки про задержку озвучки. В расширении и в приложении она называется по-разному.

Нулевая задержка бывает только у того, что сделали заранее

Живой озвучки без отставания не существует. Дорожка, которая совпадает с картинкой кадр в кадр, собрана заранее по всей записи — как озвучка, которую YouTube может сгенерировать при загрузке видео. Это другой продукт, и мы уже писали, чем они различаются. Если официальная озвучка на вашем языке есть — берите её.

Всё остальное — трансляция, курс, созвон — сначала нужно услышать. Нам подвластно то, что потом: не дать нескольким секундам превратиться в минуту, честно сказать, когда это не выходит, и никогда не решать за вас, какие слова говорящего вам были ни к чему.