Что это за модель
Kuaishou представила Kling 3.0 5 февраля 2026 года: сразу четыре модели: Video 3.0, Video 3.0 Omni (она же O3), Image 3.0 и Image 3.0 Omni. Video 3.0 Omni выросла из прошлогодней Kling O1 (Omni One), первой унифицированной модели Kling. O1 работала с семью типами задач, от генерации по тексту до удаления объектов, но ограничивалась роликами по 3-10 секунд и слабее держала персонажа при смене ракурса.
O3 сохранила идею одного движка на всё, но добавила то, чего не хватало O1: планирование по кадрам (Director Mode), консистентность персонажа через референс-элементы и родной звук с липсинком сразу на нескольких языках. Максимальная длина ролика выросла до 15 секунд. А мультишотовая генерация даёт до шести планов в одном запросе, и они выходят уже смонтированными, без дополнительной склейки.
Разрешение на выходе, до 1080p. Часть обзоров после релиза Kling 3.0 говорит о нативном 4K для всей линейки, но это в первую очередь относится к Image 3.0 и Image 3.0 Omni: там 4K действительно родное, без апскейла. У видеомодели O3 потолок 1080p. Если для проекта нужна картинка выше этого разрешения, её лучше готовить отдельно, в модели с нативным 4K.
Режимы работы
Текст в видео
Модель строит сцену из текстового промта: локацию, персонажей, их действия, движение камеры. Внутри одного запроса можно включить мультишот, тогда O3 сама расставляет смену планов и монтажные переходы по смыслу промта.
Изображение в видео
Загружается опорный кадр, O3 достраивает движение и развитие сцены. Можно задать сразу начальный и конечный кадры: модель сгенерирует то, что происходит между ними.
Референсы и голос персонажа
O3 принимает референс-изображения, референс-видео и голосовую дорожку от 3 секунд. Голос можно привязать к статичному изображению персонажа: тогда молчаливый объект на фото заговорит его собственным тембром в готовом ролике. Внешность, одежда, логотипы и текст на объектах сохраняются при смене плана и локации, если референс есть в запросе.
Как сгенерировать ролик на Syntasy
- Открыть вкладку Видео в верхнем меню
- Выбрать модель Kling O3 в нижней панели настроек
- Включить режим: обычная генерация или мультишот с раскадровкой по планам
- Настроить параметры: длительность (до 15s), соотношение сторон, разрешение
- Описать сцену в поле промта: по каждому плану, действие, ракурс, реплики в кавыч
- Прикрепить референсы персонажа, товара или голоса через кнопку загрузки
- Отправить запрос и дождаться генерации
Чем Kling O3 отличается от других моделей
Kling O3 и Kling Video 3.0
Это две модели одной линейки с разным назначением. Video 3.0, основная модель для одиночного плана с сильной операторской подачей и более высокой скоростью генерации. O3 (Omni) нужна тогда, когда важна не одна красивая сцена, а последовательность из нескольких планов с одним и тем же персонажем, товаром или голосом: рекламный ролик из трех-четырех сцен, диалог, бренд-контент с узнаваемым лицом.
Kling O3 и Kling O1
O1 умела редактировать и продлевать видео в том же движке, но держала максимум 3-10 секунд и слабее сохраняла персонажа при смене ракурса или локации. O3 добавила голосовые референсы, мультишот на шесть планов и заметно более высокую консистентность за счет обновленной системы Elements. Иначе говоря: O1 закрывала задачу «одна сцена, разные операции», а O3 закрывает задачу «сериал из сцен с одним героем».
Kling O3 и Seedance 2.5
Seedance 2.5 держит один непрерывный дубль до 30 секунд без монтажных склеек внутри сцены. O3 работает иначе: она осознанно режет сцену на планы и хороша именно там, где нужна структура «план-контрплан», смена ракурса или диалог с перебивками. Если сюжету нужен один долгий кадр без монтажа, логичнее Seedance, если нужна раскадровка с несколькими планами и узнаваемым персонажем через все планы, O3.
Как писать промты для Kling O3
Структурируйте промт по планам
Для мультишота опишите каждый план отдельно: что в кадре, какая крупность, что делает камера. Общее описание сцены без разбивки модель попробует уместить в один план и потеряет часть действия.
Задавайте референс персонажа
Если персонаж или товар должны быть одинаковыми во всех планах, достаточно один раз прикрепить референс-изображение или видео. Повторное текстовое описание внешности в каждом плане чаще путает модель, чем помогает.
Берите реплики в кавычки и указывайте язык
Прямая речь в кавычках запускает липсинк. Для многоязычных сцен с несколькими персонажами явно указывайте, кто на каком языке говорит, иначе модель может назначить один язык на всех.
Отдельно прописывайте голос, если персонаж озвучен по фото
Для генерации голоса по статичному изображению добавляйте отдельную голосовую дорожку от 3 секунд и явно указывайте в промте, что голос принадлежит именно этому персонажу, иначе модель может распределить озвучку по своему усмотрению.
Когда использовать
- рекламные ролики из нескольких планов с одним героем или продуктом
- диалоговые сцены с перебивками и сменой ракурса
- бренд-контент, где лицо или голос должны быть узнаваемы во всех роликах
- превизуализация раскадровки перед реальной съёмкой
- короткие сериальные форматы для соцсетей с одним и тем же персонажем
Для одного длинного непрерывного дубля без монтажных склеек лучше подойдёт Seedance 2.5 или Kling Video 3.0. Та же рекомендация, если важнее операторская проработка одного кадра, чем раскадровка.



