Minimax H3 — киноистории из нескольких планов в одной генерации
Новое поколение видеомодели MiniMax: длинные истории из связанных планов с единым визуальным стилем, операторской работой профессионального уровня, чёткой картинкой до 2K и звуком, синхронизированным с изображением. Достаточно одного текстового запроса или референсного кадра. Minimax H3 уже доступна на Yolly AI — начните создавать прямо на этой странице.
Генератор видео
Пожалуйста, введите запрос
Генерация видео
Loading video...
Loading video...
Loading video...
Loading video...
Loading video...
Вопросы и ответы
Разбираем возможности Minimax H3 по пунктам
Можно ли уже пользоваться Minimax H3 на Yolly AI?
Да — Minimax H3 уже доступна на Yolly AI. Просто введите запрос или загрузите референсное изображение на этой странице, чтобы начать генерацию.
Что представляет собой Minimax H3?
Это новейшая видеомодель MiniMax, созданная для длинных повествований из нескольких планов. Она генерирует ролики в разрешении до 2K, работает в режимах «текст в видео» и «изображение в видео», удерживает облик героев по референсному кадру и сразу выдаёт синхронизированную аудиодорожку.
Что нового в Minimax H3?
Главные новшества: планы стало можно сцеплять в длинные истории; персонажи, товары и брендинг держатся стабильнее между кадрами; появилось режиссёрское управление камерой; физика стала достовернее, мерцания и искажений меньше; разрешение выросло до 2K, а липсинк работает с точностью до фонемы.
Какое разрешение и какая длительность доступны?
Максимальное разрешение — 2K. Многоплановые последовательности связываются между собой, позволяя выстраивать продолжительные истории. Поддерживаются разные соотношения сторон — и горизонтальные, и вертикальные.
Как задаётся управление камерой?
Операторский язык пишется прямо в текстовом запросе: наезд, движение на тележке, ручная камера, следящий кадр, воздушная панорама. Модель воспроизводит приём с осмысленным кадрированием в каждом плане.
Не «поплывёт» ли внешность героя между планами?
Нет — удержание идентичности заложено в архитектуру модели. Референсные изображения и усиленная межплановая согласованность сохраняют персонажей, продукты и элементы бренда неизменными по всему ролику, что критично для рекламы и e-commerce.
Как устроены звук и липсинк?
Аудио генерируется одновременно с видео: реплики, эффекты и музыка совпадают с происходящим в кадре, а артикуляция синхронизируется на уровне фонем. Совет: берите реплики героев в двойные кавычки в запросе — синхронизация губ будет точнее.