Видео по тексту

Ролик собирается из одного текста: ни камеры, ни актёров, ни исходной картинки не требуется. Достаточно описать сцену. Нейросеть для создания видео по тексту работает онлайн: страница открывается в браузере, а считается ролик на нашей стороне.

Сделать видео по тексту

Опишите сцену и запустите генератор видео из текста. Соседние модели — в каталоге.

Что делает нейросеть для видео по тексту

Нейросеть для генерации видео по тексту читает написанное вами описание и сама рисует каждый кадр будущего ролика.

Снимать при этом нечего: чтобы создать видео из текста с помощью нейросети, хватает одного предложения и нажатия на запуск.

Ролик выходит коротким, а длительность и разрешение выбираются в форме выше — от них зависит и сумма запуска.

Как сделать видео по тексту: по шагам

  1. Опишите одну сцену. Назовите, кто в кадре, что он делает и где это происходит. Смену места и времени оставьте следующему ролику.
  2. Скажите, что делает камера. Камера стоит, наезжает, едет вбок или поднимается. Без этого указания движение модель выберет сама.
  3. Выберите длительность и разрешение. От них зависит стоимость запуска, и она показана в форме до нажатия.
  4. Войдите и запустите. Ролик считается с вашего счёта, поэтому сначала вход: через Яндекс или по ссылке из письма.
  5. Сравните с задуманным. Смотрите на движение и на лица: расхождения заметны раньше всего там. Если вышло не то, следующий запуск делайте короче.

Как описать сцену для видео по тексту

Назовите одно действие и одну точку съёмки. Ролик короткий, и уместить в него смену места, времени и нескольких событий не получится.

Скажите, что происходит, кто это делает, откуда смотрит камера и какое освещение вокруг, — этого достаточно.

Называйте предметы и действия обычными словами. Отвлечённые формулировки вроде «ощущение тревоги» модель переводит в случайное движение, а не в настроение кадра.

Толпу в кадре лучше не просить: люди позади либо делают одно движение разом, либо сливаются в общее пятно. Один человек и молчащие прохожие вокруг выглядят убедительнее.

Надписи, цифры и вывески выходят нечитаемыми почти всегда. Текст поэтому накладывают поверх готового ролика в монтажном редакторе.

Как описать движение камеры

Скажите, что делает камера: стоит на месте, медленно наезжает, едет вбок, поднимается. Это самая заметная часть ролика, и без указания модель выбирает движение сама.

Второе — темп. «Медленно» и «резко» меняют кадр сильнее, чем любое уточнение обстановки.

Что нужно в кадреКак сказать
Кадр не двигается«Камера стоит на месте, план не меняется»
Приблизиться к герою«Камера медленно наезжает на лицо человека»
Показать всё место«Камера отъезжает назад и открывает всю комнату»
Идти за героем«Камера едет за человеком сзади на его скорости»
Обойти предмет«Камера облетает предмет по кругу, сам предмет неподвижен»
Подняться над сценой«Камера поднимается вверх и смотрит на сцену сверху»

Просьба к камере срабатывает надёжнее, когда сказано, к чему она движется. «Камера наезжает» и «камера наезжает на глаза человека» дают разный результат: во втором случае человек ещё и повернётся.

Просьба держать кадр неподвижным выходит не с первой попытки: иногда картинка всё равно слегка плывёт, и запуск повторяют теми же словами.

Сколько стоит один ролик

Плата берётся за секунды, поэтому короткий ролик обходится недорого. Сумма видна до запуска и зависит от длительности и разрешения.

Начать можно без вложений: новому счёту при первом входе начисляют 50 приветственных кредитов.

Генератор видео из текста работает у нас за рубли: счёт пополняется картой российского банка, зарубежная не нужна.

МодельДлительностьРазрешениеСекунда в 720p
Kling 3.0 Turbo3–15 секунд720p, 1080p10,08 ₽
Kling 3.03–15 секунд720p, 1080p, 4K7,56 ₽ без звука
Wan 2.72–15 секунд720p, 1080p9 ₽
Seedance 2.04–15 секундот 480p до 4K27,22 ₽

В форме выше стоит Kling 3.0 Turbo: описание она принимает длиной до 2 500 знаков, а форму кадра выбирают из трёх — квадрат, вертикаль и горизонталь.

Wan 2.7 берёт описание до 5 000 знаков и отдельное поле «чего не надо». У Seedance 2.0 выше и потолок разрешения, и цена секунды.

Что чаще всего не выходит в ролике по описанию

Просьба улыбнуться или сменить выражение лица нередко перерисовывает человека целиком. Помогает назвать в том же описании то, что должно остаться: одежду, грим, цвет волос.

Цвет к концу ролика иногда уходит: кадр становится ярче, чем был вначале. Прямая просьба держать цвета приглушёнными и не менять их по ходу выравнивает картинку.

Резкая смена плана внутри одного ролика ломает стиль: снятый вживую кадр может продолжиться рисованным. Второй план стоит держать похожим на первый.

Часть требований длинного описания модель молча пропускает. Поэтому главное ставят в первые фразы, а остальное добавляют следующей попыткой.

Меняйте по одному условию за раз. Если после правки описания изменилось сразу многое, понять, что именно помогло, уже не получится.

Как задать порядок событий внутри ролика

Ролик разбивают на отрезки прямо в описании: что происходит в первые секунды, что дальше и чем всё заканчивается.

Тем же способом задают смену плана: «крупный план лица, затем общий план комнаты». Модель разложит ролик на две части сама.

Работает это, пока части похожи между собой. Совсем разные сцены надёжнее снять отдельными роликами и соединить в монтаже.

Сколько длится ролик и какой формы бывает кадр

Ролик по тексту выходит коротким: в форме выбирают от трёх до пятнадцати секунд, и это предел одного запуска.

Форму кадра задают заранее: горизонтальную для экрана компьютера, вертикальную для телефона, квадратную для ленты.

Разрешение выбирается из двух — 720p и 1080p. Более высокое стоит дороже за ту же секунду и считается дольше.

Пятнадцать секунд — общий потолок у всех четырёх моделей из таблицы выше, поэтому длинное видео собирают из нескольких запусков.

Как получить ролик со звуком

Звук задаётся выбором модели. У Kling 3.0 есть отдельный режим со звуком, и секунда в нём стоит дороже обычной.

Wan 2.7 принимает готовую звуковую дорожку: тогда происходящее в кадре подстраивается под то, что уже записано.

Обе модели стоят в каталоге рядом, и переключение на них идёт с того же счёта.

Какая нейросеть лучше для видео по тексту

Лучшей нейросети для генерации видео по тексту одной на всех нет. У моделей разная цена секунды, разная предельная длительность и разный набор разрешений.

Выбирают сравнением: запустите одно описание на двух моделях и посмотрите, чей кадр ближе к задуманному. Все видеомодели со ставками собраны в каталоге.

Частые вопросы

Бывает ли бесплатно и нужна ли регистрация

Новому счёту сразу после входа начисляют 50 приветственных кредитов.

Регистрация здесь короткая: анкеты нет, вход идёт через Яндекс или по ссылке из письма, а счёт создаётся сам при первом входе.

Дальше расчёт идёт по факту: списывается стоимость секунд полученного ролика, а за неудавшуюся задачу деньги не берут.

Бесплатный запуск без входа открыт у картинок и у чата — один в сутки: там он дешевле ролика, это картинка или короткий ответ.

Когда лучше начинать не с текста, а с картинки

Если внешний вид героя или предмета важен, надёжнее оживить готовый снимок: по одному тексту модель нарисует своё лицо и свою обстановку.

На каком языке писать сцену

Видео по тексту на русском здесь означает вот что: страница, форма запуска, оплата и поддержка — русские, и описание вы вводите по-русски.

Списка языков, на которых модели принимают описание, их разработчики не публикуют. Если кадр вышел не тем, повторите то же описание по-английски и сравните.

Для потоковой сборки роликов — API генерации видео.