Запись №001 Проверили Чтение: 6 минут Эксперимент провален

Два дня монтировал видео с ИИ. Проблема оказалась не в ИИ

Вопрос
Можно ли смонтировать видео с ИИ-агентом, если сам почти ничего не понимаешь в монтаже?
Что сделали
Двое суток монтировали видео для YouTube вместе с Claude: субтитры, переходы, вставки, смена планов. Десятки итераций.
Вывод
Не получилось. Агент выполняет описание, а не ощущение. С автоматизацией бизнеса ровно то же самое.

С помощью AI-агентов я собираю довольно сложные системы. А тут не смог смонтировать одно видео. Двое суток, десятки итераций, ноль результата. И в процессе выяснилось, что проблема не в агенте, а во мне. Точнее, в том, что я не мог описать, чего хочу.

Как это выглядело

Я снял большое видео для YouTube. Дальше его нужно было смонтировать. Есть только одна небольшая проблема: в монтаже я не понимаю практически ничего.

Но сейчас же есть AI-агенты. Я с их помощью пишу код, собираю целые системы. Казалось бы, ну видео-то мы как-нибудь смонтируем.

Не смонтировали.

Двое суток мы с Claude гоняли видео туда-сюда. Сначала мне казалось, что надо просто добавить всякие красивые штуки на экран. Добавили. Смотрю: теперь у нас комиксы. Убрали. Потом появились какие-то странные ракурсы. Смотрю: «Только у меня вопрос: зачем нам вообще этот стул в видео?» Переделали. Потом очередная «финальная версия». Смотрю: опять всё не то.

И так два дня. Субтитры, переходы, вставки, смена планов, акценты. Добавили. Убрали. Вернули. Переделали.

И в какой-то момент до меня дошло, что проблема вообще не в Claude.

Я просто не мог нормально объяснить, что мне нужно

Я не понимаю монтаж настолько, чтобы сказать: вот здесь должен быть такой переход, здесь меняем план, здесь нужна вставка, она должна длиться столько-то, здесь оставляем меня в кадре, а здесь вообще ничего трогать не надо. У меня нет этой картинки в голове.

Я могу посмотреть на результат и сказать: «Не то».

Но «не то» — это не инструкция.

И вот здесь начинается самое интересное. Агент работает не с моим ощущением «мне не нравится». Он работает с тем, что я смог ему описать. Если нормального описания нет, дальше начинаются догадки.

И мы два дня примерно этим и занимались: сделай → не то → переделай → опять не то → попробуем вот так → стало ещё хуже → возвращаем обратно. Можно было продолжать ещё неделю.

Почему с кодом у меня получается, а с монтажом нет

Сначала я подумал: странно. С помощью тех же AI-инструментов я могу собирать довольно сложные системы. А тут не смог нормально смонтировать одно видео.

Но разница довольно простая. В автоматизациях я понимаю, что собираю. Я вижу бизнес-логику. Знаю, как должен работать процесс, какие данные откуда получать, что должно произойти при определённом событии и какую конкретную проблему должна решить функция.

В коде я вижу структуру: вход, действие, выход, ошибка. Если что-то работает неправильно, я могу не просто сказать «мне не нравится». Я могу объяснить, что именно работает неправильно и каким должен быть результат.

Не потому что агент в коде умнее. А потому что я лучше понимаю предметную область и могу дать ему нормальные инструкции.

В монтаже у меня этого понимания нет. Я вижу только: нравится или не нравится. А этого оказалось недостаточно.

И тут я вспомнил, сколько раз видел то же самое в бизнесе

Только там вместо видео автоматизация.

«Хотим агента, который делает документы»

Хорошо. А откуда он должен брать данные для этих документов? В какой системе они лежат? В каком виде? Кто их туда заносит? Что делать, если части данных нет? Кто проверяет готовый документ? В какой момент агент должен остановиться и позвать человека? Ответов нет. Но агента хотим.

«Хотим AI-агента в отдел продаж»

Хорошо. Что конкретно он должен делать? Что остаётся менеджеру? Где между ними граница? В какой момент агент должен передать клиента человеку? Что считается хорошим результатом его работы? Что считается ошибкой? Опять непонятно.

«Надо автоматизировать квалификацию лидов»

Хорошо. А что такое квалифицированный лид конкретно в вашем бизнесе? Чем он отличается от неквалифицированного? Какие признаки это определяют? Это вообще можно описать правилом или пока существует только ощущение менеджера: «ну я поговорю и пойму»?

И вот здесь проблема становится очень похожа на мой монтаж. «Хотим хорошее видео» — не инструкция для монтажного агента. «Хотим хороших лидов» — тоже не инструкция для агента по продажам или маркетингу.

Что нужно описать до того, как собирать агента

После этой истории я ещё раз поймал себя на том, что перед запуском любого агента мне нужны ответы хотя бы на пять вопросов:

  1. Какую конкретную проблему он должен решить?
  2. Как процесс должен работать в норме?
  3. Откуда агент получает данные и в каком они виде?
  4. Что считается правильным результатом, а что ошибкой?
  5. В какой момент агент должен остановиться и передать задачу человеку?

Если на эти вопросы нет ответа, обсуждать модель, интеграции и архитектуру, мне кажется, ещё рано. Потому что мы пока сами не описали, что хотим автоматизировать. И задача в процессе такого разбора вполне может оказаться вообще не той, с которой начинали.

AI поменял само узкое место

И вот это мне кажется намного интереснее моего неудавшегося монтажа.

Раньше одним из главных ограничений была сама реализация. Нужен разработчик, время, бюджет, ТЗ, согласования. От идеи до работающей системы был довольно длинный путь.

Сейчас этот путь сильно сократился. Код можно написать быстрее. Прототип собрать быстрее. Агента подключить быстрее. Интеграцию проверить быстрее. В некоторых случаях код уже можно написать быстрее, чем нормально сформулировать задачу.

И поэтому узким местом всё чаще становится не сама реализация, а понимание процесса. Что именно у нас не работает? Как должно работать? Что конкретно мы хотим изменить? Как поймём, что получилось? И что именно должен делать агент?

AI сильно ускорил реализацию идеи. Но сама идея от этого правильнее не стала.

А видео я в итоге так и не смонтировал как хотел

Спустя двое суток я так и не получил тот монтаж, который представлял. Если быть совсем точным, я даже не уверен, что мог нормально представить, что именно хотел получить. В какой-то момент просто психанул и выложил как есть.

И это оказалось довольно хорошей демонстрацией того, как работают агенты. Неважно, что агент делает: пишет код, квалифицирует лидов, собирает документы, автоматизирует бизнес-процесс или монтирует видео. Если вы понимаете процесс, можете описать правила и знаете, каким должен быть результат, агенту есть что выполнять. А если вы сами не можете объяснить, как должно быть, не стоит ждать, что агент магическим образом догадается за вас.

Иначе получится примерно как у меня. Смотрю: опять не то. А что именно должно быть? Вот тут уже вопрос.

Частые вопросы

Может ли ИИ-агент смонтировать видео?

Технически да: он умеет резать, добавлять субтитры, переходы и вставки. Но он выполняет описание, а не ощущение. Если человек не может объяснить, где менять план, какая нужна вставка и что оставить как есть, получаются бесконечные итерации «не то».

Почему ИИ-агент не понимает, что от него нужно?

Агент работает с тем, что ему описали. Оценка «мне не нравится» не является инструкцией. Когда нет описания правильного результата, агент начинает угадывать, и каждая правка может сделать хуже.

Что нужно описать перед внедрением ИИ-агента в бизнес?

Минимум пять вещей: какую конкретную проблему решает агент, как процесс работает в норме, откуда агент берёт данные и в каком виде, что считается правильным результатом и ошибкой, в какой момент агент останавливается и передаёт задачу человеку.

Что сейчас главное узкое место во внедрении ИИ?

Всё чаще не реализация, а понимание процесса. Код, прототип и интеграцию сейчас можно собрать быстро. Но если компания сама не описала, что не работает и каким должен быть результат, агент ускорит только движение в неверную сторону.

Новые записи раньше выходят в «ИИ на коленке» ↗

Прежде чем собирать агента, опишем процесс

90 минут на одном реальном процессе. Ответим на пять вопросов из этой записи вместе с вами и поймём, что автоматизировать, а что нет.

Записаться на диагностику ↗