Рейтинг нейросетей для видео: сравнил 12 моделей на одном промпте (октябрь 2026)

Двенадцать нейросетей для видео прогнали на одном промпте: 8 секунд, 720p, по одному прогону (одной генерации) на модель. Первым по сумме баллов вышел Luma Ray 3.14: 9,1 из 10, две минуты, 5 токенов, дешевле всех в списке. Лучшую картинку показала Seedance 2.5, и она же самая дорогая: 138,7 токена, в 27 раз дороже лидера.
Проверено 9 октября 2026 года. Версии всех моделей указаны по состоянию на эту дату.
В марте 2026 года OpenAI закрыла Sora. Модель, с которой год назад сравнивали всех остальных. В этом списке её нет, и место Sora никто не занял целиком: его поделили между собой двенадцать генераторов ниже.
Карточки моделей похожи друг на друга до скуки: 1080p, звук, 10-15 секунд, референсные изображения (образцы, по которым модель держит персонажа или стиль). Обычные рейтинги нейросетей для видео сравнивают именно эти характеристики, и по ним модель не выбирается: у половины списка цифры совпадают, а разница в разрешении и длине сцены перекрывает разницу в том, как модель работает. Увидеть её можно только тогда, когда всем дают одну и ту же задачу.
Так что задача была одна: двенадцать моделей, один промпт, одно разрешение и ни одной подсказки о том, как каждая из них себя поведёт.
Дальше: как считали, полная таблица с баллами и разбор по каждой модели.
Короткий ответ
По сумме баллов: Luma Ray 3.14, 9,1 из 10, две минуты, 5 токенов. Дешевле всех в списке, но ролик требует цветокоррекции, а звука и референса персонажа у модели нет.
По картинке: Seedance 2.5. Единственная сделала задачу без скидок и самая дорогая в тесте: 138,7 токена и шесть минут.
Быстро и дёшево: Gemini Omni Flash 1.1, 10,5 токена и минута, при потолке 720p и десяти секундах.
Для эпизода с несколькими планами и репликами: Kling 3.0, от 3 до 15 секунд, звук и синхронизация губ, без провалов.
Хуже всех: Wan 2.7, 3,2 из 10, десять минут на генерацию и проигрыш по всем трём частям оценки.
Как тестировали нейросети для видео: один промпт, 8 секунд, 720p
Один текстовый промпт на двенадцать моделей. 8 секунд, 16:9 и 720p, чтобы все оказались в одинаковых условиях.
720p выбран намеренно, хотя половина моделей умеет больше. Сравнивать 4K против 720p бессмысленно, разница в разрешении перекроет разницу в качестве работы. Все двенадцать снимали на одном и том же разрешении.
Почему восемь секунд? Veo 3.1 за один проход больше не делает, а ставить 8 секунд рядом с 15 нечестно.
Смотрели, держится ли объект от первого кадра до последнего и как ведут себя огонь, пар, дым и вода. Проверяли, сделала ли модель то, что написано в промпте, и считали время с расходом.
Звук оценивали отдельно. У Runway и Luma своего звука нет, и снимать с них за это баллы в общей оценке странно.
Grok Imagine 1.5 Preview работает только от стартового кадра, текстом его не запустить. Та же история с Runway Gen-4 Turbo. Для них сделали исключение: стартовый кадр сгенерировали в их собственных моделях для изображений, в Grok и Runway Frames, и уже от изображения получили видео. Прогон остался один, как у всех.
Каждую модель запускали по разу. В реальности такое редко даёт идеальный результат, обычно нужны попытки. Тем интереснее: справятся ли модели с одной? Второй попытки не делали никому, в том числе Veo 3.1, у которой единственный прогон вышел самым слабым в верхней половине списка.
По ходу теста все модели выдали результат без ошибок и сбоев, а на генерацию потребовалось до 1 часа. Почти всё это время ушло на ожидание, а не на работу: у Gemini на ролик уходит минута, у Wan десять.
Все двенадцать прогонов шли через SYNTX.AI. Одна среда, один аккаунт, один формат учёта токенов. Токен у каждого сервиса считается по-своему, и расход между разными платформами складывать нельзя. Здесь единица учёта одна на весь тест, поэтому цифры сопоставимы между собой.
Промпт для теста: одна задача на двенадцать моделей
A street food vendor at a rainy night market tosses noodles in a wok, flames leap up, steam rises into neon light, raindrops hit the awning, camera slowly pushes in from a medium shot to a close-up of his hands, shot on 35mm film, shallow depth of field
В кадре за восемь секунд должны успеть появиться огонь, пар, дождь, неон, руки крупным планом и движение камеры. На руках и лапше модели ломаются чаще всего, а дым и пар проверяют, понимает ли модель физику, или просто рисует красивые пятна.
Промпт собран как ловушка. Скучная задача не показала бы разницы, все двенадцать выдали бы примерно одно и то же.
Все двенадцать роликов рядом:

Как считали оценки: качество 80%, скорость и цена по 10%
Итог собран из трёх частей: качество картинки и попадание в промпт (80%), скорость генерации (10%), экономия по токенам (10%).
Качество весит больше всего, потому что ролик заказывают ради картинки. Скорость и цена её только правят: ждать шесть минут неприятно, но не так неприятно, как получить брак за одну.
Качество ставили глазами, по десятибалльной. Скорость и экономию посчитали по прогону.
Скорость: 1 минута это 10 баллов, 10 минут это 1 балл, шкала линейная между ними.
Экономия: 5 токенов это 10 баллов, 138,7 токена это 1 балл. Токены считаем не абсолютной цифрой, а по разбросу внутри списка, иначе цифра ничего не говорит.
Модель | Время | Токены | Скорость | Экономия | Качество | Итог |
|---|---|---|---|---|---|---|
Luma Ray 3.14 | 2 мин | 5 | 9 | 10,0 | 9 | 9,1 |
Seedance 2.5 | 6 мин | 138,7 | 5 | 1,0 | 10 | 8,6 |
FLUX 3 Video | 2 мин | 80 | 9 | 5,0 | 9 | 8,6 |
Kling 3.0 | 3 мин | 48 | 8 | 7,1 | 8 | 7,9 |
Gemini Omni Flash 1.1 | 1 мин | 10,5 | 10 | 9,6 | 7 | 7,6 |
Grok Imagine 1.5 Preview | 1 мин | 44 | 10 | 7,4 | 7 | 7,3 |
Veo 3.1 | 5 мин | 119 | 6 | 2,3 | 8 | 7,2 |
Hailuo 3.0 (MiniMax H3) | 3 мин | 48 | 8 | 7,1 | 6 | 6,3 |
Seedance 2.0 | 3 мин | 30,8 | 8 | 8,3 | 5 | 5,6 |
Runway Gen-4.5 | 4 мин | 28 | 7 | 8,5 | 5 | 5,5 |
Runway Gen-4 Turbo | 2 мин | 28 | 9 | 8,5 | 4 | 5,0 |
Wan 2.7 | 10 мин | 48 | 1 | 7,1 | 3 | 3,2 |
Всего на двенадцать роликов ушло 628 токенов.
Seedance 2.5 и FLUX 3 Video набрали одинаковые 8,6: у Seedance на балл выше картинка, а FLUX быстрее и дешевле, и эти преимущества гасят друг друга.
Первая пятёрка держится на качестве, а не на цене. Три из пяти её участников дорогие: Seedance 2.5 на 138,7 токена, FLUX на 80, Kling на 48. Две дешёвые, Luma и Gemini.
И места сильно зависят от того, какой из трёх частей дать больший вес. Ниже тот же прогон, посчитанный по 60 / 20 / 20.
Модель | 80 / 10 / 10 | 60 / 20 / 20 | Сдвиг |
|---|---|---|---|
Luma Ray 3.14 | 1 | 1 | 0 |
Seedance 2.5 | 2 | 6 | +4 |
FLUX 3 Video | 3 | 2 | −1 |
Kling 3.0 | 4 | 4 | 0 |
Gemini Omni Flash 1.1 | 5 | 3 | −2 |
Grok Imagine 1.5 Preview | 6 | 5 | −1 |
Veo 3.1 | 7 | 8 | +1 |
Hailuo 3.0 (MiniMax H3) | 8 | 7 | −1 |
Seedance 2.0 | 9 | 9 | 0 |
Runway Gen-4.5 | 10 | 10 | 0 |
Runway Gen-4 Turbo | 11 | 11 | 0 |
Wan 2.7 | 12 | 12 | 0 |
Больше всех от смены веса страдает Seedance 2.5: четыре позиции. У остальных сдвиг не больше двух. Один и тот же прогон, одни и те же оценки, разный ответ на вопрос «что важнее».
Рейтинг нейросетей для видео: 12 моделей на одном промпте
Порядок собран из оценок выше: качество 80%, скорость 10%, экономия 10%. В подписях к роликам указаны модель, длина, разрешение и время генерации, чтобы их можно было сопоставить с таблицей.
1. Luma Ray 3.14: 9,1


Вышла 26 января 2026 года. Нативный 1080p, а на 720p в 4 раза быстрее и в 3 раза дешевле Ray 3.0.
Картинка и физика в порядке, ролик требует цветокоррекции. Расход 5 токенов. Лучший результат в списке, в 27 раз дешевле Seedance 2.5.
Главная фишка нужна не всем. Это вывод в формате EXR (OpenEXR: формат с расширенным динамическим диапазоном, HDR): готовый кадр можно нести колористу и красить без потерь. Для колориста это очень много, а тому, кто делает ролик для Reels, это ничего не даёт.
Звука нет. Референса персонажа тоже нет, то есть задать героя картинкой и удержать его между генерациями не получится.
Единственная модель, которая выиграла в обоих расчётах. Она сняла почти как лидер, а стоила копейки, и при любом весе оценки это работает в её пользу.
2. Seedance 2.5: 8,6


ByteDance выпустила её 31 июля 2026 года, и главная цифра у неё 30.
Тридцать секунд за проход, без склеек. У остальных моделей из списка потолок от 8 до 20 секунд. В запрос можно загрузить до 50 референсов: персонажей, локации, аудио. Если в готовом ролике сломался один кадр, его перерисовывают отдельно, а не генерируют всё заново.
Лучший результат теста по картинке. Десять баллов, придраться не к чему: огонь, пар, дым, руки, фактура. Из всех моделей здесь она одна сделала то, что просили, и не потребовала скидок.
Второе место при 6 минутах и 138,7 токена. Самый дорогой прогон в тесте. Если роликов будет серия, считать придётся каждый. Если это один ролик, на который не жалко денег, конкурентов у неё нет.
3. FLUX 3 Video: 8,6


Картинки, видео и звук FLUX 3 учила вместе, в одной архитектуре. До 20 секунд, Full HD, 24 кадра в секунду, звук.
Начать и закончить ролик она может на заданных кадрах, а уже готовое видео умеет продолжить.
Картинка, движения и физика в порядке. Балл сняли за одно: вместо наезда камеры модель переключилась на крупный план рук. Формально она сделала то, что просили, но сделала это монтажной склейкой, а не движением. Заметит такое только тот, кто смотрит ролик рядом с промптом.
80 токенов. Третья по расходу после Seedance 2.5 и Veo 3.1. От второго места её отделяют тысячные доли балла, и разница эта не в её пользу, а в пользу Seedance. Брать её стоит, когда нужен ровно один хороший ролик без раскадровки и дешевле Seedance.
4. Kling 3.0: 7,9


Veo снимает кадр. Kling снимает эпизод.
Kuaishou сделала ставку на раскадровку: от 3 до 15 секунд, несколько планов в одной генерации, звук и синхронизация губ сразу. Если в промпте три действия, модель раскладывает их по планам, а не сваливает в один.
Восемь баллов из десяти и ни одного провала. Три минуты, 48 токенов. Такой ролик можно ставить в серию, не пересматривая каждый.
Лучшая модель списка по соотношению качества и предсказуемости, если вам не нужны длинные сцены.
5. Gemini Omni Flash 1.1: 7,6


В списке она значится как Google Omni Flash 1.1, официально это Gemini Omni Flash. Семейство Omni Google показала на I/O 2026.
Сильная сторона не картинка. Ролик можно править прямо в диалоге: «убери машину», «пусть будет вечер». На вход она принимает текст, изображения, видео и аудио, то есть ролик можно переделать, не запуская генерацию заново.
Минута генерации и 10,5 токена. Второе место по экономии.
За эти деньги она справилась отлично. Единственный вопрос к размерам лапши, они слегка плавают. Картинку она отдаёт не как Veo и не как Seedance, но и стоит в десять раз меньше.
При весе на качестве она опускается с третьего места на пятое. Это цена её компромисса: быстрая и дешёвая, но не лучшая по картинке.
6. Grok Imagine 1.5 Preview: 7,3


xAI выпустила превью 30 мая 2026 года. Модель берёт стартовый кадр и описание движения. Звук, музыку и диалог с синхронизацией губ она делает за один проход. До 15 секунд, 480p или 720p.
Текст ей дать нельзя, как и Runway Gen-4 Turbo, поэтому кадр мы нарисовали ей в том же Grok. Со стартовой картинкой она справилась, включая дым от готовки. Минута и 44 токена.
Для своей цены этого достаточно. Здесь есть оговорка: половину работы модель получает готовой, и сравнивать её в лоб с текстовыми генераторами не совсем честно.
7. Veo 3.1: 7,2


Veo 3.1 вышла в октябре 2025 года. До 4K, звук с диалогами, до четырёх референсных изображений на генерацию.
У неё единственный прогон оказался самым слабым в дорогой половине списка: картинка на восемь баллов, но в промпт ролик попал. Мы отнёсли его в раздел неудачных попыток. Второй попытки мы не делали никому, поэтому в рейтинге стоит то, что вышло с первого раза.
По картинке она не уступает лидерам, и при второй попытке вполне могла бы побороться за верх таблицы. Но рейтинг построен на одном прогоне на модель, и здесь у неё седьмое место, а не первое. Пять минут ожидания и 119 токенов, немногим меньше, чем у Seedance 2.5, съедают всю разницу.
Вопрос не в том, умеет ли она снимать, а в том, сколько дублей уйдёт на нормальный кадр. От Grok Imagine её отделяет одна десятая балла. Формально седьмое место, по факту они с Grok ровесники в таблице.
Плюс потолок в восемь секунд за проход. Длиннее получается только продлением по кускам, и стыки потом придётся проверять глазами.
8. Hailuo 3.0 (MiniMax H3): 6,3


Официальное название у неё MiniMax H3, а в народе её называют Hailuo 3.0, по имени приложения. Вышла 31 июля 2026 года, в один день с Seedance 2.5, так что сравнивать их будут ещё долго.
До 15 секунд, до 2K, 24 кадра в секунду, стереозвук. Диалоги с синхронизацией губ на 11 языках.
Картинка и движения адекватные, три минуты и 48 токенов, столько же, сколько у Kling. Вопросы к физике: огонь и лапша ведут себя как-то не так. Не катастрофа, но именно на такой задаче это видно.
Два одинаковых результата по расходу разводятся качеством. Здесь 6 против 8, и в обоих расчётах Kling выше. Она нужна ради дублей на других языках, где Kling так не умеет.
9. Seedance 2.0: 5,6


Утешительным призом её не назовёшь. Seedance 2.0 возглавляла лидерборд Artificial Analysis, публичный рейтинг моделей по слепым сравнениям. От 1 до 15 секунд, звук генерирует сама.
Зачем она, если есть 2.5? Ради цены. Три минуты и 30,8 токена против шести минут и 138,7 у новой версии. Разница в четыре с половиной раза.
Картинка адекватная, а вот движения и физика под вопросом. Хуже всего то, что предметы пропадают. Лопатка входит в вок и не возвращается.
10. Runway Gen-4.5: 5,5


В 2026 году Runway продаёт не модель. Он продаёт мастерскую вокруг неё.
Gen-4.5 вышла 1 декабря 2025 года. 720p, 5 или 10 секунд. Своего звука нет, его добавляют через интеграцию с ElevenLabs или отдельную функцию Lip Sync (синхронизацию движения губ с записанной дорожкой).
Зато есть редактор, апскейл (увеличение разрешения готового ролика) и экспорт в ProRes 4444. Если ролик потом пойдёт в монтажку, это весит больше, чем лишнее разрешение.
Четыре минуты и 28 токенов, расход скромный. Проблема в другом: вопросы и к картинке, и к движениям, и к физике. Пять баллов за это. Мастерская вокруг сильная, а внутри неё модель прошлого поколения.
11. Runway Gen-4 Turbo: 5,0


Gen-4 вышла весной 2025 года, и главным в ней был персонаж, который не меняется от кадра к кадру по одному референсу. Тогда это было событием. Сейчас то же самое умеют почти все модели выше.
Turbo поставили в список ради сравнения с прошлым поколением. 28 токенов, столько же, сколько у Gen-4.5, но в 2 раза быстрее. На скорости все преимущества и заканчиваются.
Картинка лучше, чем у Wan. Физика и движения слабые. Четыре балла. Брать его смысла почти нет: за те же 28 токенов Gen-4.5 снимает лучше.
От Gen-4.5 его отделяют полбалла. При весе на картинке разрыв между ними виден отчётливее, чем при весе на цене.
12. Wan 2.7: 3,2


Модель Alibaba. Можно задать первый и последний кадр, собрать видео по сетке из девяти картинок и править готовый ролик текстовыми командами.
Пластиковая картинка, три балла из десяти. Движения и физика неестественные. Единственная модель, которая проиграла и по качеству, и по скорости, и её не спасает даже вес, считающий цену: при 60% на картинку она всё равно последняя.
Десять минут при 48 токенах. По расходу столько же, сколько у Kling и Hailuo, а ждать более чем в три раза дольше. Десять минут на ролик, который всё равно не пригодится.
Сводная таблица
Модель | Длина за проход | Максимум модели | Свой звук | Токены | Качество | Итог |
|---|---|---|---|---|---|---|
Luma Ray 3.14 | 5 или 10 с | 1080p | нет | 5 | 9 | 9,1 |
Seedance 2.5 | до 30 с | 1080p | да | 138,7 | 10 | 8,6 |
FLUX 3 Video | до 20 с | 1080p | да | 80 | 9 | 8,6 |
Kling 3.0 | 3-15 с | 4K | да | 48 | 8 | 7,9 |
Gemini Omni Flash 1.1 | 4-10 с | 4K | да | 10,5 | 7 | 7,6 |
Grok Imagine 1.5 Preview | до 15 с | 720p | да | 44 | 7 | 7,3 |
Veo 3.1 | 8 с | 4K | да | 119 | 8 | 7,2 |
Hailuo 3.0 (MiniMax H3) | до 15 с | 2K | да, стерео | 48 | 6 | 6,3 |
Seedance 2.0 | до 15 с | 4K | да | 30,8 | 5 | 5,6 |
Runway Gen-4.5 | 5 или 10 с | 720p | нет | 28 | 5 | 5,5 |
Runway Gen-4 Turbo | 5 или 10 с | 720p | нет | 28 | 4 | 5,0 |
Wan 2.7 | до 15 с | 1080p | да | 48 | 3 | 3,2 |
В колонке «Максимум модели» стоит то, что модель умеет вообще. Тестировали все на 720p.
Как выбрать под свою задачу
Задача решается таблицей, а не «лучшей моделью вообще»: у каждой из первых пяти своя ниша, и они почти не пересекаются.
Если нужно | Берите | На что смотреть |
|---|---|---|
Дешёвый ролик на 8 секунд, потоком | Luma Ray 3.14 | цвет придётся править, звука нет |
Один кадр без компромиссов, деньги не важны | Seedance 2.5 | 138,7 токена и шесть минут за прогон |
Дешевле Seedance, но так же красиво | FLUX 3 Video | камеру может подменить склейкой |
Эпизод с планами и репликами | Kling 3.0 | длиннее 15 секунд не снимет |
Считают каждый токен | Gemini Omni Flash 1.1 | потолок 4K и 10 секунд, правки в диалоге |
Оживить готовую фотографию со звуком | Grok Imagine 1.5 Preview | текстом не запускается, нужен стартовый кадр |
Если задача не попадает ни в одну строку, ориентируйтесь на три цифры из таблицы: время генерации, расход и длину сцены за проход. Разница в картинке между первым и пятым местом меньше, чем разница в 27 раз по расходу между первым и вторым.
Что показал тест
Вес оценки решает больше, чем сами оценки. Seedance 2.5 с лучшей картинкой теста была шестой при весе 60% на качество и стала второй при 80%. Gemini Omni Flash 1.1 опустилась с третьего места на пятое. Спорить о том, какая модель лучше, бессмысленно, пока не договорились, что считаем важным.
Тот же эффект виден на Veo 3.1. По картинке у неё восемь баллов: столько же, сколько у Kling, и на балл меньше, чем у FLUX. Но 119 токенов и пять минут держат её на седьмом месте, и даже при весе 60% на качество она не поднимается. Дорогие секунды тянут среднее вниз сильнее, чем помогает качество, даже когда качество признано высоким.
Тревога за промпт была ложной. Мы ждали, что задача окажется слишком сложной и развалится у большинства: руки, лапша, дым и наезд камеры одновременно. Развалилась она у пятерых из двенадцати: четверо внизу таблицы и единственный прогон Veo 3.1, где картинка вышла на восемь баллов, что было бы отличным результатом для других моделей. Верх списка (Luma, FLUX, Kling, Gemini и Grok) отработал огонь, пар, дым и наезд камеры спокойно, а Seedance 2.5 прошла тест идеально.
Значит, выбирать между моделями стоит не по тому, справятся ли они вообще, а по цене, скорости и длине сцены. Разница в картинке между первым и пятым местом есть, но она меньше, чем разница в 27 раз по расходу между первым и вторым.
Ограничения теста
Здесь то, что рейтинг не показывает, и границы, за которые его выводы не выходят.
Один прогон на модель. Второй попытки не делали никому, включая Veo 3.1, у которой вышел не лучший результат для её возможностей. В реальной работе модель обычно запускают несколько раз.
Слабое место одного прогона. Один результат ничего не говорит о стабильности: неизвестно, повторит ли модель удачу со второй попытки. При втором дубле Veo 3.1 могла бы побороться за верх таблицы, но рейтинг считают по одному прогону, и он у всех одинаковый.
720p. Половина моделей умеет больше, и про 4K, 2K или 1080p здесь ничего не сказано: разрешение измерялось одинаковое, чтобы разница в нём не перекрыла разницу в работе. Поведение моделей на своём максимуме не проверялось.
Восемь секунд. Потолок выбран по самой короткой модели списка. Всё, что модели умеют на 15-30 секундах, в тесте не видно.
Звук вне оценки. Он есть у большинства, но не у всех, поэтому в общий балл не вошёл. Качество звука и синхронизации губ мы отдельно не сравнивали.
Стартовый кадр у двух моделей сделали мы. Grok Imagine 1.5 Preview и Runway Gen-4 Turbo не принимают текст, и кадр для них сгенерировали в их же моделях для изображений. Это не лобовое сравнение с текстовыми генераторами: половину работы они получили готовой.
Оценка картинки глазами, одним человеком. Без слепого просмотра и второго оценщика. Баллы за качество стоит читать как мнение, а не как измерение.
Не проверяли: деньги и тарифы, лицензии и права на коммерческое использование, работу с референсами персонажа на нескольких генерациях. Токены и минуты показывают то, что дал прогон через SYNTX.AI, а не прайс сервисов.
Повторить тест
Все двенадцать моделей из этого рейтинга доступны в одном месте: в SYNTX.AI их можно прогнать на одной задаче с одним промптом, не переключаясь между сервисами. Для читателей Хабра действует промокод CTRLAI: скидка 20% на любой тариф.
Источники
Характеристики и даты релизов моделей сверяли с официальными страницами разработчиков по состоянию на 9 октября 2026 года:
Seed (ByteDance), Seedance 2.5, Seedance 2.0: длина сцены, референсы, звук.
Kling AI (Kuaishou), Kling 3.0: раскадровка, длина, синхронизация губ.
Google AI for Developers и DeepMind, Gemini Omni Flash 1.1 и Veo 3.1: разрешения, диалоги, референсы.
xAI, Grok Imagine 1.5 Preview: работа от стартового кадра, звук, разрешения.
Black Forest Labs, FLUX 3 Video: архитектура, длина, частота кадров.
Runway, Gen-4.5 и Gen-4 Turbo: разрешения, тарифы в кредитах, ProRes и Lip Sync.
Luma, Ray 3.14: разрешения, EXR, отличия от Ray 3.0.
MiniMax, Hailuo 3.0 (H3): длина, разрешение, языки диалогов.
Alibaba, Wan 2.7: первый и последний кадр, сетка из девяти картинок.
Формат проверки «одна задача на все модели» ориентировался на обзоры CNET, Pexo и invideo: это пример того, как такие тесты собирают другие.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.