Перейти к основному содержимому

Голосовое следование: телесуфлер с голосовым управлением

Голосовое следование прокручивает текст в темпе вашей речи. Какие браузеры его поддерживают, куда отправляется звук и что происходит при сбоях.

Что делает голосовое следование

Голосовое следование слушает вашу речь во время чтения и прокручивает текст вслед за ней. Замедлите темп — текст замедлится. Сделаете паузу, чтобы ответить на вопрос — суфлер остановится. Продолжите фразу — прокрутка возобновится с того же места.

При загрузке страницы функция выключена и остается неактивной, пока вы не нажмете кнопку с микрофоном на панели суфлера. До этого момента браузер ничего не слушает, и только при включении появляется системный запрос на доступ к микрофону. Никаких промежуточных окон с нашей стороны нет: нажатие кнопки уже означает ваше желание включить функцию.

Движением текста управляет распознавание слов, а не громкость звука. Алгоритм берет последние услышанные слова, ищет их среди фраз непосредственно перед строкой чтения и сдвигает текст точно к ним. Посторонние звуки и слова, которых нет в тексте, не сдвигают суфлер с места: кашель, реплика ассистенту или неуверенно распознанное слово не вызовут рывка. Текст просто подождет продолжения речи.

Куда идет ваш звук

Распознаванием речи занимается ваш браузер, а не наш сервер. В зависимости от браузера звук либо обрабатывается локально на вашем устройстве, либо передается компании-разработчику браузера для расшифровки. Пояснение рядом с кнопкой прямо сообщает, какой путь используется, еще до того, как вы что-либо включите.

При локальной обработке отображается:

Распознавание речи работает на вашем устройстве. Звук не отправляется на сервер.

При облачной обработке отображается:

Ваш браузер не может распознавать речь на устройстве. При включении звук отправляется поставщику браузера для расшифровки.

Если браузер поддерживает распознавание речи прямо на устройстве, сервис запрашивает именно этот режим. При первом включении может потребоваться скачивание языкового пакета; как только он установлен, распознавание происходит полностью на вашей машине. Если браузер этого не умеет (что на сегодняшний день относится к Safari и iOS), аудиозапись отправляется разработчику браузера для расшифровки на условиях его политики конфиденциальности.

Ни в том, ни в другом случае мы не получаем, не сохраняем и никуда не передаем ваш звук. Мы вообще не участвуем в цепочке передачи аудио. Микрофон общается с вашим браузером, а браузер отдает нам готовый распознанный текст.

Эта строка находится рядом с переключателем постоянно, потому что больше об этом не скажет никто. Стандартный системный диалог браузера спрашивает лишь, разрешить ли сайту доступ к микрофону. Он умалчивает, куда звук попадет потом, а официальные рекомендации Apple прямо возлагают обязанность предупредить пользователя на сам веб-сайт.

Мы принципиально не станем писать два утверждения, которые на некоторых платформах не соответствуют истине: распознавание не всегда происходит локально, и голосовое следование не всегда работает без интернета. Оба утверждения верны для локального режима после загрузки языкового пакета. Но ни одно из них не верно для облачного режима через поставщика браузера, где распознавание выполняется на удаленных серверах и требует постоянного интернет-соединения.

Какие браузеры поддерживают функцию

По состоянию на 27 августа 2026 г.:

  • Chrome (для компьютеров и Android) работает стабильно. Распознавание присутствует под префиксом еще с Chrome 25, а начиная с Chrome 139 оно может работать прямо на устройстве — и суфлер в первую очередь запрашивает именно этот путь.
  • Safari работает на Mac (начиная с macOS 14.1) и на iOS (начиная с iOS 14.5) по облачному пути поставщика браузера. Расшифровывает ли Apple речь на устройстве или на сервере в конкретный момент, зависит от модели устройства и настроек системы. Веб-сайт не может это определить, поэтому мы не беремся утверждать наверняка.
  • Edge поддерживает интерфейс распознавания, но работает нестабильно: часто происходит сбой в первую же секунду запуска, независимо от выбранного языка. В этом случае суфлер переходит на фиксированную скорость и выводит уведомление.
  • Firefox (на компьютерах и на Android) не предоставляет API распознавания веб-страницам. Функция отключена в нем еще с 22-й версии.
  • Opera не поддерживает этот механизм.
  • Samsung Internet поддерживает распознавание речи, начиная с версии 4.

Сервис caniuse оценивает глобальную поддержку Web Speech API примерно в 87.55% пользователей с учетом частичной поддержки. Но в оставшиеся проценты попадают две очень важные бреши: Firefox и капризный Edge.

Мы не станем уверять, будто распознавание работает в любом современном браузере. Один из крупнейших браузеров его попросту не поддерживает, и первый же пользователь с Firefox сразу это заметит.

Кроме того, облачный путь требует активного подключения к интернету. Только локальный режим на устройстве способен работать автономно, и только после загрузки языкового пакета.

Что происходит при невозможности работы

Возможны три состояния, а не два.

Все работает. Переключатель активен и выключен. Вы включаете его, браузер запрашивает доступ к микрофону, вы принимаете решение.

Функция недоступна в этом браузере. Кнопка остается на панели, но заблокирована, а подпись под ней поясняет, что данный браузер не умеет распознавать речь, и текст пойдет с фиксированной скоростью. Мы сознательно не прячем кнопку: сайт, описывающий функцию, которую затем невозможно найти в интерфейсе, оставляет ощущение обмана. Недоступная кнопка доступна с клавиатуры, получает рамку фокуса, а поясняющий текст жестко привязан к ней в разметке, поэтому программы чтения с экрана зачитывают причину вместе с элементом.

Произошел сбой во время работы. Распознавание может поддерживаться, но дать сбой в процессе чтения. Edge делает это регулярно, а сброс связи или отклонение микрофона вызовут сбой в любом браузере. В этом случае голосовое следование самостоятельно отключается, текст подхватывает движение с фиксированной скоростью, а панель суфлера сообщает, что режим изменен. Сообщение выводится явно, а не просто сменой цвета иконки, ведь в этот момент ваш взгляд прикован к строке чтения, а не к панели управления.

Это третье состояние — главная причина, почему одной лишь проверки поддержки API недостаточно. Edge рапортует, что всё готово, а затем падает при первом слове, поэтому ошибку необходимо перехватывать на месте и наглядно показывать пользователю.

На каком языке слушает суфлер

Голосовое следование запрашивает у распознавателя тот язык, на котором открыта текущая страница, и в момент включения проверяет у браузера, умеет ли он с ним работать. Мы не используем жестко зашитый список поддерживаемых языков. Chrome не публикует официального перечня для своего распознавателя, а набор языков с локальными моделями постоянно обновляется. Любая статическая таблица в коде устарела бы за пару месяцев и вводила бы в заблуждение.

Здесь часто путают два разных понятия: языки, на которые переведен интерфейс этого сайта, и языки, которые ваш браузер умеет распознавать на слух. Это совершенно разные списки, поступающие из разных источников, и один никак не гарантирует другой.

Нужно ли голосовое следование именно вам

В большинстве случаев оно не требуется. Базовый и самый надежный сценарий работы — это постоянная скорость, выставленная под ваше индивидуальное количество слов в минуту, и телесуфлер оптимизирован именно под него. Голосовое следование по-настоящему оправдывает себя там, где вы не можете контролировать темп: интервью, где собеседник может перебить, демонстрация софта с ожиданием сборки или сложный дубль, где приходится поправлять свет и начинать фразу заново.

За него приходится платить: нужен качественный микрофон, достаточно тихая комната и в большинстве браузеров стабильный интернет. Для фиксированной скорости ничего этого не нужно, и именно на нее опираются расчет времени в суфлере и таймер текста.

Кроме того, сама идея не нова. На 27 августа 2026 г. сервисы VoicePrompter и SolPrompter также предлагают бесплатное следование за голосом без регистрации. Особенность нашего суфлера в другом: функция выключена пока не попросишь, при малейшей возможности выбирается безопасный локальный режим на устройстве, сервис прямо предупреждает о передаче звука до включения и честно сообщает вслух, если произошел сбой.

Вопросы и ответы

Работает ли голосовое следование в Firefox? Нет. Firefox не поддерживает стандарт распознавания речи для сайтов. Суфлер при этом работает в обычном режиме с фиксированной скоростью.

Отправляется ли мой голос на сервер? Это зависит от браузера, и переключатель прямо сообщает об этом перед включением. В браузерах с локальным распознаванием звук остается на устройстве. В Safari и iOS он передается компании Apple для транскрипции. Мы к аудиозаписи доступа не имеем.

Обязательно ли разрешать доступ к микрофону? Да, иначе суфлер вас просто не услышит. Запрет микрофона — штатная ситуация: суфлер останется на привычной фиксированной скорости.

Записывает ли сервис звук или видео? Нет. Сервис не ведет запись звука или видео. Модуль распознавания переводит речь в текст, а текст управляет прокруткой.

Что произойдет, если распознавание прервется посреди дубля? Текст автоматически продолжит движение с заранее заданной скоростью, а на панели появится уведомление.