Я не переснимал выступление: изменил монтажную подачу того же исходного материала. В новой версии средняя длительность просмотра оказалась 5:01 против 3:41 в старой.

Одно и то же видео, разный монтаж: что показало удержание

Я взял одну и ту же исходную запись и сделал из нее две версии почти одинаковой длины.
Старая версия была снята онлайн с одного дубля с презентацией.
Новая, перемонтированная через мой ИИ-сервис. Само видео со мной с камеры не менялось и было одно.

Средняя длительность просмотра у старой версии
была 3:41,
а у новой - 5:01.

Средний процент просмотра - 23,3% против 31,8%.

Разница между версиями составила:

  • +1 минуту 20 секунд средней длительности просмотра;
  • +8,5 процентного пункта среднего процента просмотра;
  • примерно +36% относительной разницы по обеим метрикам.

Сразу важное ограничение. Я не могу честно написать, что ИИ-монтаж “повысил удержание на 36%”. Это не контролируемый A/B-тест. Но после такого сравнения монтаж для меня перестал быть только вопросом внешнего вида ролика и экономии времени. Появилась отдельная продуктовая гипотеза: может ли монтаж быть связан с тем, сколько реального видео человек в итоге смотрит.

Я не переснимал себя заново

Для сравнения я не стал снимать новое выступление. Если записать себя еще раз, отличия можно объяснять уже не только монтажом: меняется темп речи, паузы, сама подача и условия съемки. Поэтому я взял тот же исходный материал, который использовался в старой версии. Старая версия была построена вокруг презентации. В новой я убрал этот подход и перемонтировал тот же материал через наш ИИ-сервис, над которым до этого провел больше 60 часов исследований и разработки.

Зритель решил, что изменился я

Старую версию раньше довольно жестко критиковал один человек. По моей записи этой обратной связи, ему не нравилась сама подача: видео казалось длинным, скучным и устаревшим по формату. Когда новая версия была готова, я отправил ее тому же человеку. Он отреагировал так, будто я сам в новом видео стал активнее и живее.
При этом нового выступления не было.
Это была та же запись.
Изменилась монтажная подача.
Это реакция одного человека, поэтому я не считаю ее доказательством какого-то универсального психологического эффекта.

Но она показала интересную вещь: в этом кейсе монтаж изменил не только внешний вид ролика, но и восприятие человека внутри него. Обратная связь при этом не была только положительной. Новое видео все еще показалось зрителю длинноватым. Он также попросил больше настоящих видеовставок, а не только статичных изображений. Эти два замечания я перенес в следующий эксперимент.

По цифрам разница оказалась еще сильнее

После субъективной реакции я посмотрел YouTube Analytics. Старая версия:

  • средняя длительность просмотра - 3:41;
  • средний процент просмотра - 23,3%.

YouTube Analytics старой версии с презентацией: средняя длительность просмотра 3:41 и средний процент просмотра 23,3%

Новая версия:

  • средняя длительность просмотра - 5:01;
  • средний процент просмотра - 31,8%.

YouTube Analytics версии с ИИ-монтажом: средняя длительность просмотра 5:01 и средний процент просмотра 31,8%

В компактном виде:

МетрикаСтарая версияНовая версияРазница
Средняя длительность просмотра3:415:01+1:20
Средний процент просмотра23,3%31,8%+8,5 п.п.

Если считать относительную разницу, средняя длительность просмотра у новой версии выше примерно на 36,2%, а средний процент просмотра - примерно на 36,5% относительно старой версии. Это уже не только ощущение в духе “новый монтаж смотрится бодрее”. Это измеримое отличие в том, сколько видео в среднем смотрели зрители.

Моя реакция на эти цифры была такой:

Если честно, я в шоке. Я в приятном шоке.

Но именно здесь особенно важно не сделать вывод сильнее данных.

Но это не значит, что монтаж дал мне +36%

Я еще не подтвердил эквивалентность:

  • числа просмотров;
  • источников трафика;
  • доли новых и возвращающихся зрителей;
  • времени и контекста публикации;
  • пересечения аудитории;
  • показов;
  • CTR.

Кроме того есть разные окна наблюдения после публикации.
Старая версия показана за период с 23 сентября по 6 октября 2026 года.
Новая - с 4 по 6 октября 2026 года.

Поэтому корректная формулировка для меня такая:

В этом сравнении версия с ИИ-монтажом показала существенно более высокие метрики просмотра.

А вот так писать уже нельзя:

ИИ-монтаж повысил удержание на 36%.

В первой формулировке есть наблюдение.
Во второй уже заявлена причина.
Причину этот эксперимент пока не доказал.

Этого недостаточно для вывода, но достаточно для следующего теста

Здесь не нужен выбор между двумя крайностями: объявить победу или признать эксперимент бесполезным. У меня нет доказанного универсального эффекта монтажа. Но несколько наблюдений сошлись в одну сторону:

  • тот же исходный материал;
  • один человек воспринял самого спикера иначе;
  • средняя длительность просмотра заметно выше;
  • средний процент просмотра тоже заметно выше.

Для меня этого достаточно не для победного вывода, а для следующего вложения времени в гипотезу.
Не “мы нашли способ поднимать удержание на 36%”.
А: сигнал достаточно сильный, чтобы повторить тест на следующем видео и сделать проверку лучше.

По такой формулировке уже можно принимать следующее продуктовое решение.

Три минуты рендера здесь не главный результат

На разработку и исследование всей системы я потратил больше 60 часов.
Финальный рендер этой примерно 15-минутной версии в одном из прогонов занял около 3 минут.

Это хороший технический результат, но его легко неправильно прочитать.
3 минуты - не время создания системы с нуля.
И не полное время производства ролика от идеи до публикации.
Это время финального рендера в конкретном прогоне уже существующего процесса.
Поэтому сейчас для меня важнее не сама скорость рендера.

Если похожий результат по просмотру повторится, ценность продукта нужно будет оценивать не только через вопрос “сколько часов монтажера удалось сэкономить”. Появится второй вопрос: что происходит с результатом самого видео. Пока это гипотеза, а не доказанный эффект.

Следующий тест я уже делаю по-другому

Текущая версия проверяла в основном постобработку уже записанного материала. ИИ-помощь со сценарием в этом эксперименте не использовалась. Следующий тест хочу сделать шире.

Во-первых, видео будет заметно короче.
Мой текущий предел для следующего эксперимента - меньше 7 минут.
Рабочий ориентир - примерно 5 минут.
Это не универсальная рекомендация для YouTube. Это локальное решение для следующего теста после обратной связи по текущему 15-минутному ролику.

Во-вторых, хочу добавить ИИ еще до съемки - использовать его для сценария и предварительного проектирования материала.

В-третьих, хочу увеличить долю настоящих видеовставок. Не только статичные изображения, но и больше движущегося визуального материала там, где он помогает мысли.

Следующий эксперимент уже не будет изолировать один только монтаж. Он будет проверять более широкую систему: сценарий до съемки -> более короткая запись -> ИИ-монтаж -> больше видеовставок -> снова метрики просмотра. Это ограничение тоже придется учитывать, когда появятся новые цифры.

Теперь нужно понять, сколько стоит такой результат

Если похожий сигнал повторится, останется еще один вопрос. Экономика. Сейчас я знаю, что технически могу сделать такую обработку. Есть первый кейс, где другая монтажная подача совпала с существенно более высокими метриками просмотра.

Но я пока не знаю нормальную рыночную цену такой работы. Не цену “монтажа вообще”. А цену конкретной работы: взять примерно 10-15 минут экспертного исходника и превратить его в современное готовое YouTube-видео с визуальными вставками, графикой, сменой крупности и нормальным темпом.

Поэтому параллельно я запустил отдельную проверку. Нужно собрать минимум 10 реальных предложений от монтажеров по одному и тому же референсу и максимально одинаковому заданию.

Для каждого предложения нужны:

  • цена за весь ролик;
  • цена за готовую минуту;
  • срок;
  • что входит в работу;
  • число правок;
  • отдельно оплачиваемая графика, дополнительные вставки, анимация, музыка;
  • примеры похожих работ.

Пока этих данных у меня нет. Поэтому никаких “рыночных 500 рублей за минуту” или “монтажер стоит в десять раз дороже ИИ” я сейчас писать не буду. Сначала нужны реальные предложения. Только после этого можно будет нормально сравнивать: стоимость одной минуты работы живого монтажера и одной минуты внутри моего ИИ-процесса.

Что я считаю результатом этого эксперимента

Я взял одно и то же исходное выступление.
Но версия с другой монтажной подачей в этом сравнении показала:

  • 5:01 вместо 3:41 средней длительности просмотра;
  • 31,8% вместо 23,3% среднего процента просмотра.

Один человек при этом воспринял меня самого иначе, хотя запись была той же.
Это сильный сигнал. Но не доказательство причинного эффекта.

Поэтому следующий шаг - не “масштабировать найденный +36%”.
Следующий шаг - повторить эксперимент, сделать видео короче, добавить ИИ-помощь со сценарием, усилить видеовставки и снова посмотреть на поведение зрителей.

Параллельно нужно понять реальную цену такой работы на рынке. Если сигнал повторится и экономика сойдется, вопрос будет уже не в том, умеет ли ИИ монтировать видео.
Вопрос будет в другом: какую измеримую ценность дает этот монтаж и сколько она стоит.