Хочется сделать AI-видео, но непонятно, с чего начать: писать промпт, загружать фото, выбирать модель или сразу собирать ролик. Начни с одной понятной сцены — остальное приложится.
Короткий ответ: начни с одной сцены на 5–10 секунд. В Givon AI ты описываешь кадр в промпт-баре или ставишь фото стартовым кадром, выбираешь модель, получаешь несколько вариантов — и дальше собираешь ролик по сценам в том же редакторе.
Если у тебя уже есть фото товара, персонажа или референс, возьми его как отправную точку — это сценарий видео из картинки. Если исходников нет, начни с текста: кто в кадре, что происходит, какая камера, стиль и настроение. Стоимость генерации в токенах видна до запуска.
Что понадобится
- Короткая идея ролика: реклама, Reels, демонстрация товара, объясняющий кадр или визуальный тест.
- Текстовое описание сцены или исходный материал: фото, видео, персонаж, товар или референс.
Пошагово
- 1
Определи задачу ролика
Запиши, что должно получиться: реклама товара, Reels, объясняющий фрагмент, персонаж в движении или визуальный концепт.
- 2
Выбери основу
Текст — для поиска идеи. Фото или референс — когда важна точность объекта: товар, лицо, стиль.
- 3
Выбери модель и параметры
В промпт-баре выбери модель, длительность, формат кадра и звук. Стоимость в токенах видна до запуска.
- 4
Опиши сцену
Укажи героя, действие, локацию, свет, камеру и настроение. Одно главное действие на сцену.
- 5
Сгенерируй несколько вариантов
Сравни варианты по движению, стабильности объекта, композиции и пригодности для публикации.
- 6
Добавь голос, субтитры или следующую сцену
Озвучка генерируется из текста или записывается с микрофона, субтитры собираются автоматически — см. гайд по озвучке и субтитрам.
- 7
Экспортируй и проверь под площадку
Сравни результат с требованиями Reels, TikTok, Shorts, рекламы или клиентской презентации.
С какой модели начать
Современные модели генерируют видео сразу со звуком: Seedance 2.5, Wan 3.0, MiniMax H3, Gemini Omni и Veo 3.1 выдают сцену с нативным синхронизированным аудио — речью, шумами и атмосферой. Отдельно накладывать звук для черновика не нужно.
В каталоге Givon AI десятки видеомоделей, сгруппированных по провайдерам. Для первого видео хватит четырёх ориентиров — у всех нативный звук. Полная разбивка по задачам — в гайде по выбору нейросети для видео.
- seedance-2.5Главный выбор Givon для качества: сцены до 30 секунд по тексту, кадрам и референсам изображений, видео и аудио.
- wan-3.0Первый и последний кадр, референсы изображений, видео и аудио, сцены 2–30 секунд. Звук можно выключить.
- minimax-h3Первое место в image-to-video рейтинга Arena (сентябрь 2026): стереозвук, 2K, до 15 секунд — сильный выбор, если сцена начинается с фото.
- minimax-h3-max-turboСамая быстрая версия H3 Max: черновые дубли со звуком из текста или кадра, 5–15 секунд.
Каким может быть результат
Пример промпта
Промпт описывает содержание одной сцены: объект, действие, камеру, свет и стиль. Длительность, формат кадра, разрешение и звук — это настройки в промпт-баре: их не нужно писать в тексте.
Плохо
Сделай красивое вертикальное видео про мой продукт на 5 секунд.
Лучше
На столе стоит матовая упаковка косметики, камера медленно приближается, мягкий утренний свет, фон слегка размыт, продукт остаётся стабильным, рекламный стиль.
Когда не стоит делать так
Видео нейросетью лучше делать как управляемый процесс, а не как один длинный запрос. Одна сцена быстро показывает, подходит ли модель, промпт и визуальная подача именно твоей задаче — и стоит это дешевле, чем пересборка целого ролика.
Не пытайся собрать весь ролик одним запросом, если в нём несколько сцен, разные герои, смена локаций или сложный сюжет. Двигайся по сценам: получи стабильный первый вариант, сохрани его и переходи к следующему эпизоду — один слабый фрагмент не сломает весь результат.
Частые ошибки
Слишком общий промпт
Фраза «сделай красивое видео» не даёт модели понятной сцены. Нужны объект, действие, камера, свет и стиль — а длительность и формат кадра задаются настройками, не текстом.
Весь ролик одним запросом
Если в ролике несколько смыслов, разбей его на сцены — каждую можно докрутить отдельно.
Нет референса, когда важен объект
Если нужно сохранить товар, лицо или стиль, загрузи свои материалы стартовым кадром или референсом вместо генерации с нуля.
Ожидание идеала с первого дубля
Видеогенерация — это несколько вариантов и выбор лучшего. Закладывай 2–3 попытки на сцену.


