Новости генерации AI-видео: последние модели и обновления 2026 года
Будьте в курсе AI-генерации видео в 2026 году. Ежемесячный обзор новых релизов моделей, изменений доступности API, обновлений цен и изменений возможностей.
Меня зовут Дора. Я начала эту колонку, потому что постоянно теряла нить.
Пространство ИИ-моделей для видео развивается настолько быстро, что то, что я записала в марте, к маю уже устаревало. После четвёртого случая, когда я поймала себя на цитировании уже изменившейся цены, я бросила пытаться всё запоминать и начала записывать. Раз в месяц. В одном и том же формате. Это первый выпуск.
Я не журналист. Я работаю с этими инструментами и читаю те же релизные посты и диффы чейнджлогов, что и все остальные. Что я добавляю — если добавляю вообще что-то — это фильтрацию. Какие утверждения я проверила сама. Какие лишь цитирую. Какие вызывают у меня откровенный скептицизм. В этом вся суть колонки: ежемесячный проход по куче новостей об ИИ-генерации видео с моими пометками.
Что нового в генерации видео с помощью ИИ прямо сейчас
Структура этого обзора
Шесть разделов, в одном и том же порядке каждый месяц: запуски моделей, доступ к API, ценообразование, изменения возможностей, движения в индустрии, что дальше. Плюс FAQ. Каждый пункт краткий. Каждый датирован. Я помечаю источники как официальные (документация компании, системные карточки, страницы релизов), по данным прессы (мейнстримные издания) или сообщество (лидерборды, независимые бенчмарки). Когда эти три источника расходятся, я это отмечаю. Когда я не могу самостоятельно проверить что-то, я так и говорю. Лучше пометить факт как «неподтверждённый», чем пересказывать пресс-релиз как истину.
Как читать даты «по состоянию на»
Я усвоила это на собственном горьком опыте. Тарифный план из февраля не доживает до июня. Функция, анонсированная в день запуска, через несколько недель оказывается за рейт-лимитами. Каждое утверждение здесь несёт отметку «по состоянию на». После этой даты — допускайте смещение. Я проверяю перед тем, как строить что-то на любой цифре в своей работе. Вам стоит делать то же самое.
Новые запуски моделей и крупные обновления версий
Последние релизы за этот период
С февраля по май был необычно плотный период для выхода ИИ-моделей видео в 2026 году. Я вернулась и насчитала четыре релиза, заслуживающих внимания:
- Kling 3.0 — Выпущен 5 февраля 2026 года компанией Kuaishou. Нативный вывод 4K, многоязычное аудио, мультимодальная архитектура. По имеющимся данным, в течение нескольких дней после запуска занял первое место в лидерборде Artificial Analysis Text-to-Video. Позиции в лидерборде с тех пор менялись, так что я бы не цитировала этот рейтинг к моменту, когда вы это читаете.
- Seedance 2.0 — Выпущен 12 февраля 2026 года компанией ByteDance. Достиг №1 в том же лидерборде с 1213 Elo с аудио, согласно странице ByteDance Seedance. Релиз почти сразу же сопроводился вирусными клипами с реальными актёрами, что вызвало пристальное внимание по вопросам авторских прав, до сих пор не разрешённое.
- Veo 3.1 Lite — Выпущен 31 марта 2026 года компанией Google. Бюджетный уровень, доступный через Gemini API и Google AI Studio. Цена по имеющимся данным: $0,05 за секунду для 720p. Полный Veo 3.1 остаётся флагманом.
- LTX-2.3 — Выпущен 5 марта 2026 года компанией Lightricks. Точечный релиз линейки LTX-2. Первая линейка моделей с открытым исходным кодом, поставляемая с нативным 4K, аудио и открытыми весами одновременно.
Четыре релиза примерно за сто дней. Большая часть маркетинговых формулировок совпадает — каждый заявляет о «скачке» в чём-то. Из того, что я оставляю, — более узкое: нативное аудио, 4K и продолжительность свыше 60 секунд теперь являются базовым стандартом. Не отличительными чертами.
Ожидаемые запуски за которыми стоит следить
Два направления, за которыми я слежу в публичной дорожной карте:
- Wan 3.0 (Alibaba) — По публичной дорожной карте Alibaba намечен на середину 2026 года. Заявленные характеристики: 60B параметров, нативный 4K, 30-секундная непрерывная генерация за один проход. Сроки не подтверждены. Я не ставлю на точную дату.
- Следующая видеомодель OpenAI — Публичной даты выхода нет. Сворачивание Sora (следующий раздел) оставляет очевидный пробел.
Доступность API и изменения в доступе
Новые эндпоинты API и обновления SDK
Это раздел, который обходится разработчикам в реальные деньги, когда они его пропускают.
-
Отключение API OpenAI Sora — OpenAI объявил 24 марта 2026 года, что потребительское приложение Sora и API будут прекращены. Приложение прекратило работу 26 апреля 2026 года. Завершение работы API запланировано на 24 сентября 2026 года, согласно официальной странице OpenAI Sora 2. Я знаю двух людей в процессе миграции. Окно короче, чем кажется, если у вас что-то есть в продакшене.
-
Veo 3.1 Lite через Gemini API — Страница модели Veo от Google подтверждает доступ через Gemini API и Google AI Studio. Впервые у семейства Veo появился настоящий бюджетный уровень через публичный API.
-
Официальный API разработчика Seedance 2.0 — По состоянию на конец мая 2026 года так и не выпущен. Сторонние платформы интегрировали модель на условиях лицензирования. По имеющимся данным, ByteDance отложил API разработчика, пока не урегулированы споры об авторских правах с голливудскими студиями. Я бы пометила этот пункт как заслуживающий отслеживания — когда официальный эндпоинт появится, математика затрат для всех, кто сейчас работает через агрегаторов, изменится.
Региональная доступность и движение очередей ожидания
За время своего существования Sora 2 распространился на Android в США, Канаде, Японии, Корее, Таиланде, Вьетнаме и Тайване. Теперь это история. Veo 3.1 в некоторых регионах по-прежнему требует аутентификации через Google Cloud. Kling продолжает работать на двух уровнях доступа (kling.ai для международного использования, klingai.com для Китая). За этот период я не заметила крупных снятий с очередей ожидания.
Обновления цен и рейт-лимитов
Изменения цен за секунду и за клип
Всё в этом разделе имеет срок годности. Я проверяла каждую цифру на собственной странице платформы в момент написания. Проверьте снова перед использованием:
- Veo 3.1 Lite: $0,05/секунда для 720p (официально, Google).
- Kling 3.0 через сторонний API: примерно $0,029/секунда (по данным, fal.ai).
- Сторонний доступ к Seedance 2.0: $0,10–$0,80 за минуту в зависимости от разрешения и уровня (по данным; официального тарифа для сравнения нет).
- API Sora 2: цены не изменились с момента запуска, но функциональный срок службы заканчивается 24 сентября 2026 года.
Общая закономерность в этом раунде последних изменений цен на ИИ-генерацию видео: стоимость за секунду на бюджетном уровне снижается. Ценообразование на флагманском уровне не движется в том же направлении. Для высокообъёмной работы этот разрыв важнее, чем маркетинговые заявления о качестве модели.
Изменения параллелизма и пропускной способности
За этот период крупного опубликованного повышения параллелизма не было. Несколько платформ тихо перешли с биллинга по кредитным корзинам на биллинг за задачу. Одна и та же нагрузка — другой счёт. Стоит промоделировать, если вы прогнозируете затраты на пакетную обработку.
Изменения возможностей, важные для продакшена
Нативная генерация видео с аудио
Крупнейший межвендорный сдвиг за квартал. Seedance 2.0, Veo 3.1 и Kling 3.0 теперь все производят видео с синхронизированным аудио за один проход. Veo — единственный, кто надёжно генерирует диалог в 48 кГц, согласно документации Google. Остальные справляются со звуковыми эффектами, фоновым звуком и грубой синхронизацией губ. Двухэтапный конвейер (сначала сгенерировать видео, затем наложить аудио) сворачивается в один.
Более длинные связные выходные данные
Sora 2 дотянулся до 25 секунд. Kling 3.0 расширился до 60 секунд. Оба сохраняют непрерывность идентичности на всём протяжении с неоднозначными результатами — результат зависит от сложности объекта. В научных статьях конца первого квартала упоминаются «Long-Context Video Transformers», нацеленные на когерентные сегменты продолжительностью 10–20 минут. Ни один из них ещё не вышел.
Согласованность персонажей и сцен
«Ingredients to Video» от Veo 3.1 принимает до трёх опорных изображений на генерацию. Seedance 2.0 использует привязку в пространстве скрытых состояний на протяжении 60-секундного клипа. Kling 3.0 поддерживает до шести связанных кадров в режиме нескольких планов. Ни одна не идеальна. Все лучше того, что было доступно полгода назад. Это всё, что я могу подтвердить, не проводя собственных сравнений, которых я в этом месяце не делала.
Движения в индустрии, актуальные для разработчиков
Партнёрства и интеграции в экосистему
- Партнёрство OpenAI–Disney — Сообщается о сделке на $1 млрд за лицензированную генерацию персонажей. Первое студийно-ИИ-партнёрство такого масштаба. Что это означает для рабочих процессов с лицензированной интеллектуальной собственностью, ещё формируется; я не буду гадать.
- Привлечение Runway на $315 млн — Закрыто в этот период. Капитал продолжает поступать на уровень производственного конвейера (превизуализация, раскадровка, интеграция VFX), а не только к слою модели.
- Оценка Luma в $4 млрд — По имеющимся данным. Тот же сигнал, что и у привлечения Runway — уровень производственного инструментария является устойчивой ставкой, на которую инвесторы делают в этом цикле.
Политика, безопасность и водяные знаки
Я почти пропустила этот раздел. Потом вспомнила, почему не стоит.
- Статья 50 Закона ЕС об ИИ — Правоприменение начинается 2 августа 2026 года. Требует машиночитаемой маркировки на всём ИИ-сгенерированном видео, распространяемом для аудитории ЕС. Штрафы до €15 млн или 3% от мирового годового оборота.
- Калифорнийский SB 942 — Вступил в силу 1 января 2026 года. Требования к раскрытию информации для ИИ-сгенерированного контента, распространяемого в Калифорнии.
- Контентные учётные данные C2PA — Seedance 2.0 поставляется со встроенными водяными знаками C2PA. TikTok пометил более 1,3 миллиарда ИИ-сгенерированных видео с использованием обнаружения C2PA. Справочный документ — техническая спецификация C2PA. SynthID от Google разворачивается как дополнительный водяной знак на уровне пикселей.
Если ваш конвейер производит видео для распространения в ЕС или Калифорнии, и у вас нет плана соответствия требованиям к августу, — это та работа, которую я бы приоритизировала в этом месяце. Это из тех вещей, которые обнаруживаются слишком поздно.
Что отслеживать дальше
Три направления, за которыми я буду следить в третьем квартале:
- Выйдет ли Wan 3.0 в намеченные сроки середины 2026 года, и сохранится ли история с открытыми весами при 60B параметрах.
- Что заполнит пробел, когда API Sora прекратит работу 24 сентября.
- Как будет разворачиваться правоприменение по статье 50 ЕС в первые 60 дней — в частности, будут ли платформы загрузки удалять метаданные C2PA, и где окажется ответственность, когда они это сделают.
FAQ
Как часто на самом деле меняется ландшафт ИИ-генерации видео?
По моим наблюдениям, цикл новостей в сфере ИИ-генерации видео сжался примерно до месячного для крупных релизов моделей и до недельного для обновлений возможностей и обновлений ИИ-генераторов видео. Цены меняются в середине квартала. Сигналы, которым я доверяю больше всего: движение в лидерборде, диффы документации API, правки страниц с ценами. Анонсы запусков я взвешиваю меньше — слишком много из того, что анонсируется, не выходит вовремя или выходит за очередью ожидания.
Какие последние релизы моделей наиболее актуальны для разработчиков?
Я не скажу вам, какую модель выбрать. Но релизы ИИ-видеомоделей 2026 года, заслуживающие оценки прямо сейчас, основываясь на том, что вышло в этот период: Veo 3.1 для нативного аудиодиалога, Kling 3.0 для сбалансированного по стоимости объёма итераций, Seedance 2.0 для сцен с интенсивным движением — когда (и если) появится официальный API. Sora 2 относится к разговору о миграции, а не о новых проектах, учитывая закрытие 24 сентября.
Как последние изменения цен влияют на производственное планирование?
Цены за секунду на бюджетном уровне снижаются быстрее, чем на флагманском. Если вы в основном работаете на 720p, бюджетный уровень Veo 3.1 Lite и сторонний доступ к Kling существенно меняют модели затрат. Проверяйте актуальные тарифы по последним обновлениям ИИ-генераторов видео перед фиксацией бюджета — я не видела, чтобы цены в этой категории оставались стабильными хотя бы целый квартал за 2026 год.
За какими изменениями возможностей разработчикам стоит следить в 2026 году?
Три, из более широких новостей видео-ИИ-индустрии, заслуживающих отслеживания: нативная аудиогенерация становится стандартом (к концу года перестаёт быть отличительной чертой, по моей оценке), согласованность персонажей распространяется за пределы 60 секунд, и машиночитаемая маркировка происхождения становится обязательной для распространения в ЕС к 2 августа. Третье — не опционально. Первые два влияют на то, как выбирать модель. Третье — на то, сможете ли вы вообще выходить на определённые рынки.
Предыдущие посты:
- Best AI Video Generator in 2026: What Actually Holds Up in Production
- AI Video Generation Models 2026: What Builders Are Actually Using
- What Is Veo 4? Everything We Know So Far
- Google Veo 4: What to Expect from the Next Video Generation Model
- Omni Flash vs Veo vs Sora vs Seedance: Which Video Model Fits Your Workflow?
