Эта статья не про новый телесуфлёр как продукт. Она про то, почему автоматизация монтажа заставила меня вернуть подготовленный сценарий и пересобрать сам момент записи.

Почему после автоматизации монтажа я вернулся к суфлёру

После экспериментов с ИИ-монтажом я вернулся к вещи, от которой отказался много лет назад - к подготовленному тексту и суфлёру. До этого я годами снимал иначе. Формулировал мысль, включал камеру и старался записать всё с первого дубля. Это был не принцип и не убеждение, что подготовка не нужна. Так было быстрее.

Когда я только начинал записывать видео, я пробовал снимать по заранее подготовленному тексту. В нескольких первых роликах использовал простой суфлёр. Но весь процесс получался слишком тяжёлым: сначала написать текст, потом снять, потом смонтировать, потом проверить результат.

В какой-то момент я просто убрал часть шагов. И много лет это работало. Парадокс в том, что обратно к подготовке меня привёл именно ИИ-монтаж. Чем больше работы после съёмки удавалось автоматизировать, тем заметнее становилось качество того, что попало в исходник. Из этого у меня появился довольно простой вывод:

Локальная оптимизация может перестать быть оптимальной, когда меняется другой этап процесса.

Раньше я экономил время до камеры. Теперь часть работы после камеры стала проще, и подготовленный исходник снова стал для меня ценнее. Оставался другой вопрос: как вернуть сценарий, но не вернуть вместе с ним старую тяжесть съёмки?

Первый дубль был нормальной оптимизацией

Когда я отказался от суфлёра, я не считал, что нашёл какой-то более правильный способ записывать видео. Я просто сокращал производство.
Подготовить текст.
Отладить его.
Снять.
Смонтировать.

Для меня вся эта цепочка занимала слишком много времени. Поэтому я перешёл к более простому правилу: включать камеру и стараться записывать видео с первого дубля. Так было быстрее. Именно поэтому первый дубль оставался моим рабочим способом годами. Я не хочу сейчас переписывать эту историю так, будто раньше всё делал неправильно. При тех ограничениях это было нормальное решение: я убрал дорогой для себя этап и получил более быстрый процесс.

Потом изменился сам процесс

В последние эксперименты я много времени вкладывал в автоматизацию монтажа. В моих экспериментах часть работы после записи уже получалось передавать системе: расшифровку речи, поиск пауз, подготовку отдельных визуальных элементов и черновую сборку.

И здесь я столкнулся с ограничением.
Монтаж может переставить уже записанные фрагменты.
Может что-то сократить.
Может добавить визуал.
Но он всё равно работает с тем, что я реально сказал перед камерой. Если я собирался раскрыть мысль в одной последовательности, а во время записи ушёл в другую, дальше приходится уже компенсировать это на монтаже. В предыдущей статье я как раз дошёл до вывода, что часть решений о качестве видео вообще нужно принимать раньше.

Когда я применил этот вывод к своей съёмке, сценарий перестал выглядеть лишней подготовкой. Наоборот, он стал способом дать следующему этапу более хороший исходник.

Не потому, что ИИ ничего не умеет исправлять. И не потому, что любое видео нужно читать слово в слово. В моём процессе изменилось другое:

Чем легче становилась работа после съёмки, тем важнее становилось то, с чем эта работа начинается.

Поэтому я снова стал готовить текст заранее.

Сценарий вернулся, а вместе с ним вернулась старая механика

На этом можно было бы закончить: пишем сценарий, открываем его перед камерой и снимаем. Но именно здесь быстро вернулась проблема, из-за которой такой способ когда-то был неудобным.

Я открывал текст в Google Docs.
Дальше во время записи его нужно было двигать.
Прокручивать мышкой.
Нажимать на кликер.
Следить, где находится следующий фрагмент.
Если остановился или переформулировал предложение - снова искать нужное место.

Для меня это оказалось лишней механикой прямо в момент, когда нужно думать о том, как говоришь. Кроме того, мышка или кликер были видны в кадре, а мне это не нравилось. Мне хотелось, чтобы текст подстраивался под мой ритм и скорость, а не требовал от меня постоянно управлять прокруткой.

Не я должен следовать за текстом. Текст должен следовать за тем, что я говорю.

Вот это оказалось намного более точной задачей для автоматизации.

Я сделал суфлёр, который слушает речь

В итоге я собрал для себя свой суфлёр. Без ИИ, но с алгоритмами расширофки и анализа речи.
Я загружаю подготовленный текст и начинаю говорить.
Микрофон слушает речь.
Система распознаёт небольшой текущий фрагмент, понимает примерно, где я нахожусь в сценарии, и двигает текст дальше.
Если я остановился или система потеряла место, можно быстро вмешаться вручную и перейти дальше.
Прокрутку можно подстроить под себя.
Сам текст можно быстро поправить или переставить.

Для этой статьи мне даже не так важно, как именно всё это устроено внутри. Гораздо важнее изменение самого взаимодействия.

Раньше во время записи у меня было две работы:
говорить и управлять документом.

Теперь я стараюсь оставить себе одну:
говорить, пока документ следует за моей речью.

То есть я не автоматизировал подготовку мысли. Я автоматизировал механику, которая мешала эту мысль нормально проговорить. С этим суфлёром я уже записал реальное видео.
Он пока ошибается. Иногда приходится поправлять его вручную.
Какие-то детали поведения я ещё хочу менять. Но для меня это уже рабочий инструмент, а не просто демонстрация идеи.

Я не вернулся к старому процессу

Если посмотреть только на отдельные действия, может показаться, что я просто сделал круг.
Сначала снимал по тексту. Потом отказался от текста и начал снимать с первого дубля.
Теперь снова пишу сценарий и использую суфлёр. Но весь процесс уже другой.

Когда-то он выглядел примерно так:
подготовить текст -> снять -> много работать после съёмки

Потом я упростил его:
быстро сформулировать -> снять с первого дубля -> разбираться с результатом дальше

Сейчас у меня получается новая схема:
идея и исследование -> подготовленный сценарий -> запись с суфлёром, который следует за речью -> автоматизированная обработка -> проверка результата

Я вернул не старый процесс целиком. Я вернул только ту часть, которая снова стала полезной.
Подготовка мысли остаётся на мне.
Механику движения по тексту во время записи я стараюсь передать системе.
Часть работы после записи тоже передаю автоматизации.
А себе оставляю решения и проверку результата. Для меня это намного интереснее идеи “автоматизировать как можно больше”.

Правильный вопрос оказался другим:

Где человеческая работа действительно добавляет ценность, а где вокруг неё просто накопилась механика, которую уже можно убрать?

Для меня инструмент уже полезен. Дальше вопрос не про меня

Из этой истории не следует, что всем нужно снимать по сценарию.
Не следует, что всем нужен такой суфлёр.
И точно не следует, что я уже нашёл новый продукт.

У меня есть более узкий результат.
Раньше я убрал подготовку ради скорости.
Потом автоматизация монтажа изменила баланс всего процесса.
Я вернул сценарий.
Увидел новое трение - ручное управление текстом.
И автоматизировал именно это трение.

Поэтому мой текущий вывод такой:

После автоматизации одного этапа стоит заново посмотреть на весь процесс. Возможно, шаг, который раньше пришлось убрать ради скорости, теперь имеет смысл вернуть - если автоматизировать не ценную работу, а механику вокруг неё.

Для себя я эту часть уже решил достаточно хорошо, чтобы пользоваться инструментом дальше. Нужен ли такой способ другим людям, какие решения уже существуют и есть ли здесь отдельный продукт - это я проверяю отдельно.