# Сценарий для короткого видео: пишем для уха и считаем секунды

Сценарий ролика на минуту - это бюджет секунд. На своём сценарии из 135 слов показываю, почему счёт слов врёт и как проверить текст голосом до камеры.

URL: https://posts.danashkin.ru/guides/scenariy-dlya-korotkogo-video
Обновлено: 2026-09-24

---

## Коротко

**Главное**

- Сценарий короткого ролика пишется для уха: одна мысль на реплику, реплика на один выдох, числа в той форме, в какой их произнесёшь.
- Счёт слов даёт только прикидку. Мой сценарий из 135 слов по оценке занимал 55 секунд, черновая озвучка показала почти 58, а реплики одинаковой длины звучали от 4,3 до 6,4 секунды.
- Скелет чужого залетевшего ролика переносится долями длины, секунды оригинала тебе не подходят. Текст при этом всегда твой.
- Мерить сценарий надо до камеры. Не влезает - сокращай самую длинную реплику, ускорять речь бесполезно.

## Почему сценарий короткого ролика пишут для уха?

**Главное**

Потому что зритель слышит фразу один раз и в темпе автора, перечитать её нельзя. Письменный текст держится на длинных предложениях, скобках и цифрах, которые глаз схватывает сразу. Уху нужны короткие реплики, одна мысль в каждой и числа в той форме, в какой они звучат.

Сценарий для короткого видео - это текст, который произносят вслух. Пост в канале можно пробежать глазами, вернуться на строчку выше, задержаться на таблице. Ролик идёт со скоростью говорящего, и всё, что зритель не расслышал с первого раза, для него потеряно.

Поэтому единица сценария - реплика: одна мысль, которую можно сказать на одном выдохе. Я собрал сценарий ролика-объяснения для своего сервиса, где за кадром говорит диктор: 13 реплик, 135 слов. Самая короткая реплика - шесть слов, самые длинные - по четырнадцать.

Что отличает текст для уха от текста для глаза:

- **Одна мысль на реплику.** Две мысли в одной фразе на слух путаются: вернуться и разделить их зритель не может.
- **Реплика на один выдох.** Если на середине фразы хочется вдохнуть, её пора резать на две.
- **Числа так, как их скажешь.** На бумаге «51%» - один знак, вслух - три слова: «пятьдесят один процент».
- **Термин сразу с переводом.** Останавливать ролик и искать значение зритель не будет, поэтому непонятное слово просто выпадает из смысла.

Самый быстрый способ получить такой текст - надиктовать мысль голосом, а потом сократить. Надиктованное уже звучит как речь. Почему голосом получается лучше, чем печатью, разбирал в материале [голосом быстрее, чем руками](/guides/golosom-bystree-chem-rukami).

## Сколько слов влезает в минуту ролика?

**Главное**

Мой ролик почти на минуту вместил 135 слов вместе с паузами, около 140 в пересчёте на ровную минуту. Это темп машинного черновика, у живого голоса он свой. Справочные 150-160 слов в минуту даны для английской речи, а русские слова длиннее примерно на 20-30%.

Прикидку по числу слов делают все, и я не исключение. Мой конвейер сначала считает длительность по словам: 2,6 слова в секунду плюс паузы между репликами. По этой формуле 135 слов дали 55,1 секунды, а черновая машинная озвучка прочитала тот же текст за 57,8.

Разница в 2,7 секунды выглядит мелочью. При рамке 45-60 секунд это разница между «влез» и «придётся резать»: у готового черновика запас остался всего две секунды.

Справочники дают ориентиры для английской речи: 150-160 слов в минуту для аудиокниг и 100-125 для выступления со слайдами. У русского языка темп в словах ниже, потому что слова у нас длиннее. Темп сдвигает и волнение, так что замер за столом и замер перед камерой могут не совпасть.

Отсюда практическое правило: свой бюджет слов узнают замером. Возьми любой абзац на сто слов, прочитай вслух в том темпе, в котором говоришь в роликах, и засеки время. Получишь свой темп в словах в секунду, на него и умножай длину ролика.

## Где счёт слов ошибается сильнее всего?

**Главное**

В отдельных репликах. По сумме ошибки частично гасят друг друга, а внутри ролика реплика из 14 слов звучит и четыре с небольшим секунды, и больше шести. Медленнее всего идут числа, проценты, термины и длинные слова, быстрее всего короткие связки.

Самое полезное в замере - разброс по репликам. Одна и та же машинная озвучка читала мои реплики со скоростью от двух до трёх с лишним слов в секунду. Разница больше чем в полтора раза при одном голосе и одном сценарии.

| Что мерили | Оценка по словам | Черновая озвучка |
|---|---|---|
| Весь сценарий: 135 слов с паузами | 55,1 с | 57,8 с |
| 14 слов, процент и термин | 5,4 с | 6,4 с |
| 14 слов и процент | 5,4 с | 5,7 с |
| 14 слов, в основном коротких | 5,4 с | 4,3 с |
| 10 слов, в основном длинных | 3,8 с | 5,0 с |

Причина видна по составу реплик. Процент в счёте слов занимает одно место, а вслух превращается в три слова. Длинные слова вроде «нейросетям» и «покупателя» тоже тянутся, а короткие «ни», «и», «об этом» пролетают почти незаметно.

Для сценария отсюда следует простая вещь: мерить надо каждую реплику и складывать итог из замеров. Самая длинная реплика - первый кандидат на сокращение. У меня это оказалась реплика с процентом и термином, 6,4 секунды.

**Числа пиши словами**

Если в реплике есть число, запиши его так, как произнесёшь: «пятьдесят один процент». Счёт слов станет честнее, а на суфлёре не придётся на ходу переводить цифры в слова.

## Скелет чужого ролика переносится долями

**Главное**

Сцена залетевшего ролика описывается долей его длины: крючок занял первую десятую часть, демонстрация - середину. На тех же долях в твоём сценарии должны стоять твои предложения. Секунды оригинала не переносятся, потому что ты говоришь в другом темпе и другими словами.

Когда сценарий пишется по чужому залетевшему ролику, первым хочется перенести тайминг: у автора крючок закончился на третьей секунде, значит, и у меня. Это ломается сразу, как только твой ролик длиннее или короче оригинала.

В собственном инструменте для коротких видео я связал два ролика пропорцией. Сцена оригинала описана долей его длины, и подсказка о смене кадра ложится на то предложение твоего сценария, которое стоит на той же доле. Текста оригинала в этой связке нет вовсе: ни расшифровки, ни надписей, ни описания кадров.

Пример на цифрах. В оригинале на 30 секунд крючок длится три секунды, это десятая часть ролика. В твоём ролике на 50 секунд десятая часть - пять секунд, и в них должна уложиться твоя фраза-крючок. Поворот, который у автора стоит ровно посередине, у тебя тоже встаёт на середину.

Граница между приёмом и копией та же, что при разборе: от оригинала берутся доли и типы сцен, текст пишешь сам. Если совпадение с текстом оригинала выше 30%, мой инструмент предупреждает об этом перед скачиванием ролика. Какой ролик брать за образец, подскажет то, что сейчас обгоняет норму авторов в твоей нише. Как такие ролики находить, разбирал в материале о том, [как искать тренды коротких видео](/guides/kak-iskat-trendy-korotkih-video).

## Крючок: несколько вариантов и секундомер

**Главное**

Лучший крючок выбирают вслух из нескольких вариантов. Он должен закончиться в первые секунды ролика, и это тоже проверяется замером: фраза, которая на бумаге выглядит короткой, вслух легко растягивается на лишние полторы секунды.

Крючок - первая фраза, ради которой зритель не листает дальше. У каждого сценария в моём инструменте хранится несколько вариантов крючка, и перед съёмкой выбирается один. Привычка полезна и без инструмента: напиши три варианта - вопрос, готовый результат и спорное утверждение - и прочитай вслух каждый.

Мой крючок в том самом ролике занял две реплики: «Твой покупатель спросил нейросеть, что ему купить. Она назвала три марки. Твоей среди них нет».

Я закладывал, что проблема прозвучит за пять секунд. Черновая озвучка дотянула её до шести с половиной. Полторы лишние секунды на старте - это много, ведь именно в первые секунды зритель решает, смотреть ли дальше. Лечится это сокращением первой реплики, скороговорка тут не спасает.

Крючок держится не только на голосе. Картинка первого кадра и надпись на экране работают вместе с фразой, и про три слоя крючка подробно написано в материале о том, [как разобрать залетевший ролик](/guides/razbor-zaletevshego-rolika).

## Как проверить сценарий до камеры?

**Главное**

Разбить текст на реплики, замерить каждую вслух или бесплатным синтезом речи, сложить замеры с паузами и сравнить с рамкой ролика. Не влезает - сокращать самую длинную реплику. Подачу проверять на одной фразе, прежде чем снимать весь ролик.

Проверка занимает меньше времени, чем одна пересъёмка. Порядок такой:

1. **Разбей текст на реплики**

   Одна мысль, один выдох, одна строка. У меня 13 реплик заняли почти 58 секунд, в среднем около четырёх с половиной секунд на реплику вместе с паузой. Реплика дольше шести секунд у меня первая на очереди к сокращению.

2. **Замерь каждую реплику**

   Прочитай вслух с секундомером в телефоне. Второй способ - прогнать текст через любой бесплатный синтез речи и посмотреть длительность. Я делаю именно так: черновая машинная озвучка ничего не стоит, и для тайминга её хватает.

3. **Сложи замеры и паузы**

   Между репликами нужны паузы. У меня они от 0,2 до 0,5 секунды и в сумме дали 3,2 секунды на ролик. Сумму сравни с рамкой и оставь запас, темп в день съёмки может отличаться от темпа за столом.

4. **Сократи самую длинную реплику**

   Если не влезаешь, сокращай текст. Быстрая речь съедает разборчивость, а зритель, который смотрит без звука, не успевает читать субтитры.

5. **Проверь подачу на одной фразе**

   Тон, тембр и темп проверяются на одной реплике, прежде чем снимать ролик целиком. В своём конвейере озвучки я так и устроил выбор голоса: одна фраза звучит шестью голосами ещё до оплаты, потому что переозвучивать весь ролик из-за тембра значит платить дважды.

## Суфлёр: скорость под свой темп

**Главное**

Экран суфлёра держит твой взгляд в камере, пока ты читаешь текст. Прокрутка идёт либо по таймеру, либо вслед за голосом через распознавание речи. При записи на тот же телефон надёжнее таймер, а его скорость выставляется по твоему замеренному темпу.

Телесуфлёр - экран, который показывает текст перед объективом. Говорящий читает и при этом смотрит в камеру, а у зрителя остаётся ощущение живой речи. В студии прокруткой управляет оператор или сам ведущий, на телефоне - приложение.

Приложения двигают текст двумя способами: с постоянной скоростью или вслед за голосом. Второй способ опирается на распознавание речи в браузере или телефоне и подстраивается под паузы. Суфлёр в моём инструменте умеет идти за голосом.

Но когда я проектировал запись ролика прямо в суфлёре, для самой записи пришлось заложить прокрутку по таймеру. На айфоне распознавание голоса и запись видео спорят за один микрофон. Значит, скорость прокрутки выставляется руками, и тут пригодится твой темп в словах в секунду.

Текст на суфлёре раскладывай теми же репликами, по одной на строку. Паузы между строками заодно помогают автомонтажу: машина режет по тишине, и чистая пауза между фразами даёт ей ровный рез. Как снимать под автомонтаж и что машина делает с дублями, разбирал в материале про [монтаж коротких роликов нейросетью](/guides/montazh-korotkih-video-neyrosetyu).

## Частые вопросы

**Главное**

Что спрашивают чаще всего: сколько слов нужно на полминуты, какой длины делать ролик, можно ли отдать сценарий нейросети и нужно ли учить текст наизусть.

### Частые вопросы

**Сколько слов нужно на ролик в 30 секунд?**

В темпе моей черновой машинной озвучки - около 70 слов вместе с паузами. Живой голос у каждого свой, а волнение его сдвигает, поэтому надёжнее один раз замерить себя.

**Какой длины делать короткий ролик?**

Площадки разрешают больше минуты: YouTube с 15 октября 2024 года принимает Shorts длиной до трёх минут. Для ролика с одной мыслью я ставлю рамку 45-60 секунд.

**Можно ли доверить сценарий нейросети?**

Черновик можно: [ИИ-агент](/concepts/ai-agent) быстро разложит мысль на реплики и предложит варианты крючка. Дальше текст читается вслух и переписывается твоими словами, а каждое число сверяется с источником: в ролике нет сносок, и ошибку зритель запомнит вместе с твоим лицом.

**Нужно ли учить текст наизусть?**

Нет. Хватит суфлёра или съёмки фразами: неудачную реплику повторяешь целиком, а при монтаже остаётся последняя удачная попытка.

## Главный вывод

**Главное**

Сценарий короткого ролика - это бюджет секунд. Его пишут для уха, раскладывают по долям чужого скелета и меряют голосом до камеры: реплики одинаковой длины у меня звучали от 4,3 до 6,4 секунды.

Хороший текст для ролика узнаётся на слух: каждая реплика говорится на одном выдохе, числа звучат так, как записаны, а крючок заканчивается раньше, чем палец успеет долистать.

Практический минимум на сегодня: возьми сценарий следующего ролика, разбей его на реплики и замерь каждую. Самую длинную сократи до того, как включишь камеру.

А ты пишешь сценарий заранее или говоришь в камеру от себя?

### Источники

- [Темп речи - от чего зависит скорость речи и почему в русском языке темп в словах ниже, Википедия](https://ru.wikipedia.org/wiki/Темп_речи)
- [Words per minute - темп речи в словах в минуту для аудиокниг и выступлений, Википедия](https://en.wikipedia.org/wiki/Words_per_minute)
- [Телесуфлёр - устройство и назначение суфлёра, Википедия](https://ru.wikipedia.org/wiki/Телесуфлёр)
- [Web Speech API - распознавание и синтез речи в браузере, MDN](https://developer.mozilla.org/en-US/docs/Web/API/Web_Speech_API)
- [Tall updates coming to Shorts - Shorts длиной до трёх минут, YouTube Blog](https://blog.youtube/news-and-events/tall-updates-coming-to-shorts/)
