Я пишу код. Видео я не делаю, и ещё пару недель назад не сгенерировал ни одного кадра нейросетью. А потом Duskroom понадобились восемь коротких атмосферных лупов, и я обнаружил себя сравнивающим HappyHorse, Kling, Higgsfield, LTX 2.3 и Gemini Omni, не имея вообще никакой точки отсчёта, что здесь считается хорошим результатом. Вот как всё прошло на самом деле: что дал каждый, кому достались мои $5 и почему на третьей сцене я уже застрял.
TL;DR
- Я протестировал пять нейросетей для видео, не заплатив сначала ни одной - только бесплатные версии, карту достал уже тогда, когда что-то заработало.
- Higgsfield оказался лучшим из всех, и я всё равно ушёл - его тариф рассчитан на того, кто генерирует каждый день, а я так не делаю.
- Мои $5 забрал Gemini Omni на три месяца, даёт крепкие 7.5 из 10 и идёт с таким лимитом, что я на третьей сцене из восьми, да ещё и водяной знак снимаю руками.
Разработчик, которому внезапно понадобилось видео
Duskroom - штука, которую я собираю: атмосферные звуковые комнаты, которые оставляешь открытыми, пока работаешь или засыпаешь. Восемь сцен. Под каждой нужен короткий видео-луп - что-то достаточно спокойное, чтобы двадцать минут висеть на периферии зрения и ничего от тебя не требовать.
А я в жизни не сделал ни одного видео. Ни камерой, ни в After Effects, ни нейросетью. То есть стартовая позиция была такая: я точно знаю, какое ощущение мне нужно, и вообще не знаю, как до него добраться. Знать, чего хочешь, и знать, как этого добиться, - две очень разные задачи, и у меня была только первая.
Правило, которое я придумал, чтобы не слить деньги
В теме ИИ-видео сейчас очень шумно. Каждое видео на ютубе называет лучшим свой инструмент, и половина из них - партнёрские ссылки, переодетые в обзор. Через пару часов такого я перестал пытаться найти ответ снаружи и просто придумал себе одно правило:
Пробуй бесплатно. Плати, только если бесплатный результат уже можно ставить в продукт.
Всё. Никаких сравнительных таблиц, никакого бюджета на пробы и ошибки, никакого "подпишусь на месяц просто посмотреть". У каждого из этих сервисов есть бесплатный тариф или триал, и триал и есть обзор. Что там получил незнакомый человек на ютубе, ничего не говорит о том, что получу я, - он умеет писать промпты под видео, а я нет.
HappyHorse и Kling потеряли меня примерно за час
Честно скажу, насколько поверхностным был тест: я не сидел с ними днями. По часу примерно на каждый, генераций пять-шесть. Человек, который правда разбирается в видео, наверняка выжал бы из них больше, чем я, и я бы ему поверил.
Но вот что меня добило. Оба стабильно теряли куски prompt’а. Описываю сцену с тремя вещами - тёплый свет, медленный проезд камеры, конкретное настроение - получаю одну из трёх. Переписываю, упрощаю, пробую снова - получаю другую одну из трёх.
Prompt’ы тут ни при чём - я их заранее прогнал через Claude, одна мысль на одну часть, ничего не перепутано. И если модель возвращает одно из трёх запрошенного, это её потолок, а не мой текст. Плюс тарифы, рассчитанные на то, что я тут буду каждый день. Я закрыл обе вкладки. Это не глубокая оценка. Это быстрое "нет" от человека, который не может позволить себе медленное.
Инструмент, который понравился больше всех, я не купил
Higgsfield был реально самой приятной штукой за весь этот поиск. Десятки моделей от разных провайдеров, все за одним интерфейсом. Для человека, который не понимает, что делает, это подарок: можно прогнать один и тот же промпт по нескольким моделям, не заводя пять аккаунтов и не изучая пять интерфейсов.
Я хотел за него заплатить. Вот это честная часть. Вкладка со страницей тарифов повисела у меня открытой прилично.
А потом я задал себе вопрос, от которого до этого уходил: сколько видео я вообще сделаю за этот год? Ответ - восемь. Ну шестнадцать, если что-то буду переделывать. Duskroom не запущен. Он может вырасти во что-то настоящее, а может тихо умереть у меня на диске, и знать это заранее мне никто не даст. Подписке на эту неопределённость всё равно. Она просто списывает.
Higgsfield стоит своих денег для того, кто открывает его каждое утро. Я бы открыл его один раз и пропал на месяцы. Инструмент не был неправ. Просто я был не тем покупателем.
LTX 2.3 бесплатный, и бесплатно тут честная цена
LTX 2.3 22B не стоит ничего, без регистрации, я гонял его через бесплатный генератор на upsampler.com. Делал он ровно то же, что HappyHorse и Kling: брал первую половину prompt’а и ронял остальное. Каждый раз, очень стабильно.
Вот эта стабильность и полезна. Один и тот же структурированный prompt, один и тот же обрыв, ровно в том же месте. Когда вход у тебя под контролем, разница между пятью инструментами - это разница инструментов. Собственно, ради этого я и собираю prompt заранее: расплывчатое "вот этот как-то хуже" превращается в то, на что можно пальцем показать. У LTX маленькое контекстное окно. Красиво он на этом не ломается. Просто берёт, что помещается, и едет дальше.
К продукту его результат я бы не подпустил. Но вечер на него убить до того, как тратить деньги, всё равно советую: узнать, как выглядит "не хватило контекста", тут стоит ноль.
То, что я знал ещё до старта
В видео я пришёл зелёным, а вот в разговорах с моделями - нет. Я строю с ИИ достаточно давно, чтобы понимать: prompt - это и есть большая часть результата. Поэтому в видео-инструмент я ни разу не писал напрямую. Ни на первом триале, ни потом.
Схема с первого дня: нахожу референсы - картинки и видео нужного настроения, - отдаю их вместе со своим описанием Claude и получаю обратно структурированный prompt: одна мысль на одну часть, ничего не перепутано, сформулировано под модель, а не под человека.
Причина скучная и финансовая: слабый prompt сжигает ровно такую же генерацию, как сильный. На маленьком лимите пересдача не бесплатна - это сцена, которую ты в этом месяце уже не сделаешь. Та же логика, что и в связке Claude Code с Obsidian для заметок: структурируешь один раз, заранее, чтобы дальше никому не приходилось догадываться.
Использовать ИИ, чтобы писать для ИИ, до сих пор ощущается слегка нелепо. И до сих пор работает, так что я перестал спорить.
Что мне дали $5 и где я застрял
Остановился я на Gemini Omni через промо Google AI Plus: $5 за первые три месяца. Мне и раньше нравилось, что Gemini делает с картинками, так что это была не слепая ставка, а форумные треды подтвердили, что цена настоящая, а не приманка.
Результат - 7.5 из 10 под мою задачу. Короткие атмосферные лупы, не кино. Ахнуть не заставляет. Уходит в приложение почти без доработки, а мне ровно это и нужно.
Но недостающие 2.5 стоит назвать. Ролики спокойные и зацикливаются чисто, а это и было требованием. И при этом они чуть более обезличенные, чем то, что было у меня в голове. Настроение передалось. Конкретная деталь - не до конца. Вот этот зазор и есть честная цена того, что я не умею арт-директить модель, и никакой бюджет его не закрывает. Только практика.
Дальше две вещи, которых я не ждал.
Лимит маленький. Сильно меньше, чем я предположил, увидев цену. Из восьми сцен Duskroom прямо сейчас существуют три, и не потому что я перестал работать, а потому что он кончился. Если ты считаешь бюджет под реальный проект: $5 покупают доступ, а не объём.
И водяной знак никуда не делся. На каждом ролике, платный тариф или нет. Gemini выкатил в настройках переключатель "Media Watermark", сделанный ровно для того, чтобы его выключить. Я выключил. Ничего не изменилось. Переключатель появился только в середине августа 2026-го и, по имеющейся информации, раскатывается постепенно - не на все тарифы и регионы сразу. Так что списываю на релиз в движении, а не на враньё. Пока каждый клип идёт через отдельный сервис удаления знаков, прежде чем попасть в Duskroom.
Пять сцен впереди, лимит, который говорит "не в этом месяце", и переключатель, который я всё проверяю, будто он мог тихо заработать.
Когда вход под контролем, разница между пятью инструментами - это разница инструментов. Ради этого prompt и собирают заранее.
Октай Искендеров
Дизайнер и фулстек-разработчик, веду klauzzdcode - студию одного человека в Баку. На фрилансе с 2023 года: выкатываю продукты от Figma до деплоя и записываю то, что переживает контакт с продакшеном.