Все обновления
Новости

MiniMax H3 на Syntasy

На платформе появилась MiniMax H3, новая видеомодель от MiniMax на замену Hailuo 2.3. Модель собирает картинку и звук в одном запросе.

10 августа 2026 г.7 мин чтения

Что это за модель

MiniMax H3, он же Hailuo 03, это модель для генерации видео, которая работает сразу с текстом, картинками, видео и звуком в одном запросе. Можно смешивать разные типы данных и получать на выходе связный ролик. Модель делает видео от 5 до 15 секунд, разрешение до 2K, звук встроен сразу, без отдельной озвучки. При этом H3 учитывает кучу деталей одновременно: кто в кадре, что происходит, как двигается камера, какая композиция, в каком стиле снято, что говорят персонажи, какая музыка играет, какие звуковые эффекты нужны, какой текст должен читаться на экране и как вписать элементы бренда. Модель понимает все форматы вместе, поэтому с ней можно работать по референсам: задать образец и получить видео в похожей стилистике, перенести характер звука или изображения с одного материала на другой, точно смонтировать ролик под рекламные задачи.

Пример генерации по текстовому промту в MiniMax H3

Режимы работы

Текст в видео: собираем сцену из описания

Режим «текст в видео» строит целый аудиовизуальный ролик прямо из текстового запроса, без картинок и видео на входе. В одном описании можно задать место действия, персонажей, их действия, движение камеры, порядок кадров, визуальный стиль, реплики, музыку и фоновые звуки. Подходит для рекламных роликов, коротких кинематографичных сцен, анимации, моушн-графики, контента для соцсетей и показа продукта, когда под рукой нет ничего, кроме идеи и текста.

Изображение в видео

Здесь можно загрузить одну картинку или сразу две: начальный и конечный кадр. Одно изображение задает точку старта: дальше модель сама придумывает, как двигаться персонажу, что происходит вокруг и как ведет себя камера. А если дать первый и последний кадр, появляется контроль над тем, с чего сцена начинается, как разворачивается и чем заканчивается. Хорошо работает для анимированных постеров, показа продукта, демонстрации интерфейса, сцен с персонажами и переходов между статичными изображениями.

Эталонное видео: собираем ролик из разных материалов

Этот режим совмещает текстовое описание с референсными картинками, видеофрагментами и аудио в одном запросе. Каждому материалу можно назначить свою роль: один задает внешность персонажа, другой показывает вид продукта, третий передает движение, ракурсы камеры или темп монтажа, а аудио отвечает за голос или звук. Тут же можно заменить объект в кадре, перенести движение с одного видео на другое, поменять фон, свет, реплики или голос, обновить одежду или сам продукт, а также локально подправить монтаж, не трогая остальную часть исходного ролика.

Как сгенерировать ролик на Syntasy

  • Открыть вкладку Видео в верхнем меню
  • Выбрать модель MiniMax в нижней панели настроек
  • Настроить параметры: длительность (10s/15s), соотношение сторон (от 21:9 до 9:16
  • Описать сцену в поле промта: движение камеры, свет, действие, реплики персонажей
  • При необходимости прикрепить референс, изображение или сториборд, через кнопку з
  • Отправить запрос и дождаться генерации

Промпт лучше писать на английском, модель точнее считывает детали камеры и звука.

Пример генерации по текстовому промту в MiniMax H3

Что еще доступно в настройках

На панели камеры есть готовые пресеты движения, их можно выбрать вместо описания в промте:

  • Статичный кадр
  • Панорамирование вправо и влево
  • Резкая панорама вправо и влево
  • Наклон вверх и вниз
  • Медленное приближение
  • Любительская съёмка

Всего, на платформе больше 30 пресетов для видео. Каждый ролик считается в токенах, стоимость видна перед отправкой запроса. Можно задать количество вариантов генерации за один запуск и зафиксировать промт, чтобы он не менялся при повторной генерации. 3 августа веса модели открыли в публичный доступ. На релизе H3 заняла первое место в лидерборде Artificial Analysis по видео-редактированию.

Чем MiniMax H3 отличается от других моделей генерации видео

MiniMax H3 понимает текст, изображения, видеоклипы и аудио в рамках одного запроса. У каждого входного элемента своя задача: один задает внешность персонажа, другой направляет движение, третий определяет ракурсы камеры, четвертый подсказывает визуальный стиль, а голос и звук берутся из аудиодорожки. Благодаря этому все творческие элементы не расходятся между собой, а складываются в цельное видео.

2K и стерео

H3 выдает видео в разрешении до 2K сразу со стереозвуком, без отдельного этапа озвучки. Действия в кадре, реплики, музыка и звуковые эффекты задаются в одном запросе, поэтому картинка и звук получаются согласованными: то, что видно на экране, совпадает с тем, что слышно.

Работа с несколькими референсами

Модель умеет объединять сразу несколько изображений, видео и аудиофайлов в одной генерации. Кто есть кто, берется из картинок, движение и работа камеры считываются с видео, а голос и звуковой характер задает аудио. Обычным текстом можно объяснить, как именно каждый материал должен повлиять на результат, и тогда референсы не конфликтуют друг с другом.

Точность в деталях и читаемый текст

H3 четко следует инструкциям: порядок кадров, тайминг, переходы, движение камеры, поведение персонажей, звук и то, что должно остаться без изменений. Отдельно модель хорошо справляется с текстом в кадре: заголовки, элементы интерфейса, вывески и брендинг отображаются разборчиво, и модель одинаково хорошо реагирует и на прямые указания, и на ограничения "не трогать".

Чем H3 отличается от Seedance 2.0 и PixVerse V6

Все три модели решают похожие творческие задачи, но по-разному расставляют акценты.

Пример генерации по текстовому промту в MiniMax H3
  • В рекламе продукта H3 держит больше ракурсов, крупных планов и технических детал
  • В моушн-дизайне H3 собирает более плотный монтаж: сетки, объёмные формы, смелая
  • В кинематографичных сценах H3 склоняется к коммерческому реализму: контролируемы
Пример генерации по текстовому промту в Seedance 2.0

При анимации интерфейсов H3 сохраняет исходную структуру страницы: типографику, элементы управления, текстуры. Seedance 2.0 обычно пересобирает материал в отдельную презентацию с новым фоном и рекламным текстом. PixVerse V6 для таких задач подходит меньше: модель заточена под операторскую работу и многоплановые сцены, а не под сохранение исходной вёрстки.

Пример генерации по текстовому промту в PixVerse V6

Как писать промты для MiniMax H3

Хороший результат зависит не только от того, что описано на экране. Промпт должен задавать визуальный замысел, роли персонажей, тайминг, движение камеры, звук и то, что нужно сохранить неизменным, чтобы все этапы генерации шли по одному сценарию.

1. Дайте каждому референсу свою роль

Если в запросе сразу несколько изображений, видео или аудиофайлов, пропишите, за что отвечает каждый из них. Один может задавать личность персонажа, другой внешний вид продукта, третий движение, четвертый ракурсы камеры, пятый ритм монтажа, стиль, голос или звук. Так референсы не будут спорить друг с другом.

2. Разбивайте длинные сцены на этапы

Если идея состоит из нескольких кадров, распишите ее по порядку: что происходит сначала, что дальше, где переход. Так H3 держит темп на протяжении всего ролика, а не сжимает все события в первые секунды и не собирает сцену рвано.

3.Описывайте звук вместе с картинкой

Реплики, музыку, атмосферу и звуковые эффекты стоит прописывать не отдельно, а вместе с композицией и движением в кадре. Если звуковые акценты, эмоциональный тон и тайминг идут в одном описании с визуальной последовательностью, звук и картинка получаются согласованными.

4. Фиксируйте детали, которые нельзя менять

Перечислите черты лица, одежду, реквизит, материалы, цвета, шрифты или детали продукта, которые должны остаться прежними. Такой список помогает H3 сохранять узнаваемость персонажей и объектов даже при смене ракурса или сцены.

5. Прописывайте работу камеры отдельно

Опишите кадрирование, поведение объектива, движение камеры, смену фокуса, экспозицию, общую обработку картинки. Конкретика по операторской работе помогает получить осмысленное повествование, а не шаблонные проезды камеры и однотипные композиции.

6. Указывайте, чего быть не должно

Пропишите, каких элементов, переходов, стилей или визуальных ошибок нужно избежать. Такие ограничения особенно полезны, когда в кадре есть текст, узнаваемые персонажи, интерфейсы, реалистичная съемка или сильно стилизованная картинка.

7. При монтаже разделяйте, что меняется, а что нет

Если нужно отредактировать готовое видео, отдельно опишите каждое изменение и отдельно то, что должно остаться как есть. Так замены, удаления, смена света, реплик или фона проходят как локальные правки, а тайминг, композиция, движение и остальные детали сцены не сбиваются.

Когда использовать MiniMax H3

H3 подходит для рекламных роликов, карточек товара с озвучкой, превизуализации к съёмкам, игровых роликов с одним персонажем в разных сценах, анимированных постеров. Хорошо работает со сценариями, где есть диалог в кадре: липсинк и звук собираются моделью сразу.

Открыть обновления
11 сентября 2026 г.

Suno представила семейство моделей v6

9 сентября 2026 года Suno официально анонсировала v6 - новое поколение моделей для генерации музыки, разработанное совместно с музыкальной индустрией, включая Warner Music Group, BMG и Believe. Релиз завершает долгое ожидание: предыдущая модель, v5.5, оставалась основной с марта 2026 года, а сама Suno на протяжении лета говорила о «следующем поколении моделей» лишь в общих формулировках, не называя дату.

10 сентября 2026 г.

GPT-6 Astra на Syntasy.pro

OpenAI выпустила GPT-6 Astra - новое поколение своей флагманской модели, и она уже доступна на Syntasy.pro без VPN, как и остальные 20+ моделей платформы. Разбираемся, что умеет Astra и в каких задачах она реально пригодится.

19 августа 2026 г.

Grok Imagine 2.0: точечное редактирование от SpaceXAI теперь на Syntasy

На платформе появилась Grok Imagine 2.0 (официально Grok Imagine Image 2.0), новая модель генерации и редактирования изображений от SpaceXAI. Можно изменить одну область фото, без общего изменения картинки.