#open-source
14 articles

HiDream-O1-Image-Dev: 8B пиксель-нативная модель, превзошедшая FLUX.2 с 56B параметрами
HiDream-O1-Image-Dev — это дистиллированная модель для генерации изображений с 8B параметрами, которая отказалась от VAE и внешнего текстового энкодера, нативно генерирует изображения в разрешении 2K и превосходит модели в 7 раз большего размера по показателям GenEval, DPG и HPSv3.

Что такое Google Gemma 4? Архитектура, тесты производительности и почему это важно
Google Gemma 4 — самое мощное семейство открытых моделей от DeepMind на сегодняшний день: четыре размера под лицензией Apache 2.0 с мультимодальным вводом, встроенными возможностями рассуждения и развёртыванием на устройстве вплоть до Raspberry Pi.

daVinci-MagiHuman: Опенсорс-модель, которая уничтожила всех конкурентов в генерации цифровых людей
daVinci-MagiHuman — это опенсорс-модель на 15 млрд параметров, генерирующая видео с синхронизацией губ за 2 секунды на одном H100. Превосходит Ovi 1.1 (80% побед) и LTX 2.3 (60,9%). Лицензия Apache 2.0, поддержка множества языков и молниеносная скорость.

Знакомьтесь: daVinci MagiHuman Image-to-Video на WaveSpeedAI
daVinci MagiHuman Image-to-Video — это открытая модель на 15 млрд параметров, которая превращает референсные изображения в кинематографические видео с опциональной синхронизацией звука. Сопоставима с WAN 2.5. Разрешение до 1080p, длительность 5–10 секунд. REST API, $0.04/сек, без холодного старта.

Представляем daVinci MagiHuman Text-to-Video на WaveSpeedAI
daVinci MagiHuman Text-to-Video генерирует кинематографические видео с акцентом на людей по текстовым запросам с поддержкой синхронизации звука. Модель с открытым исходным кодом на 15B параметров, разрешение до 1080p, длительность 5–10 секунд. REST API, $0.04/сек, без холодного старта.

Helios: модель генерации длинных видео в реальном времени, которая не использует никаких упрощений
Helios генерирует видео длительностью в минуту со скоростью 19,5 FPS на одном H100 — без KV-кеша, разреженного внимания и каких-либо стандартных приёмов ускорения. Вот что делает его особенным.

BitDance 14B: автогрессивная генерация изображений с ИИ в 30 раз быстрее
BitDance 14B генерирует изображения в 30 раз быстрее других авторегрессивных моделей благодаря бинарным токенам. Превосходит FLUX.1 в тестах. Попробуйте на WaveSpeedAI.

Kimi K2.5: Всё, что мы знаем о визуальной агентной модели Moonshot
Kimi K2.5 — это модель с открытым исходным кодом компании Moonshot AI с параметрами 1T, технологией Agent Swarm, контекстом 256K и мультимодальными возможностями. Вот полный обзор.

OpenClaw: Открытый персональный AI-ассистент под вашим контролем
Откройте для себя OpenClaw — инновационный открытый персональный AI-ассистент, который работает на ваших собственных устройствах и интегрируется с несколькими платформами обмена сообщениями, сохраняя ваш полный контроль.

MOVA vs WAN vs Sora 2 vs Seedance: Сравнение видео-аудио AI моделей в 2026
Сравните OpenMOSS MOVA, WAN 2.2 Spicy, WAN 2.6 Flash, Sora 2 и Seedance 1.5 Pro для видеогенерации со звуком. Функции, цены и рекомендации.

DeepSeek V4: Всё, что нам известно о предстоящей AI-модели для программирования
DeepSeek V4 запустится в феврале 2026 года с революционными возможностями для кодирования. Вот что нам известно об архитектуре, функциях и бенчмарках.

Apple SHARP: Превратите любое фото в 3D менее чем за секунду
AI-модель Apple SHARP преобразует одиночные 2D-фотографии в фотореалистичные 3D-сцены менее чем за одну секунду, используя Gaussian splatting. Узнайте, как работает это открытое исходное кодом открытие.