Kandinsky Lab выпустила семейство моделей Kandinsky 6.0 Video, которые создают видео и звук одновременно. Пользователь может описать сцену текстом или загрузить картинку и задать, что должно произойти дальше.

Kandinsky 6.0 Video генерирует пятисекундные ролики с синхронной звуковой дорожкой, включая речь и движения губ. Доступны две версии: Lite с 3 млрд параметров и Pro с 29 млрд.

Реклама. Erid 2VtzqvEeCCc. ООО «Клик.ру». ИИ-директолог
Реклама. Erid 2VtzqxmQdcp. ООО «Клик.ру». ИИ-директолог

Читайте также: ТОП-5 бесплатных нейросетей для создани видео

Нейросеть Kandinsky 6.0 Video — что умеет и как работает

В основе Kandinsky 6.0 — два потока, отвечающих за видео и аудио. Они связаны двунаправленным cross-attention и во время генерации обмениваются информацией, чтобы события в кадре и звуки совпадали по времени и смыслу.

Для генерации по изображению загруженная картинка задаёт первый кадр, а текстовое описание — дальнейшее действие. Модель подгоняет исходное изображение под размер ролика и при необходимости обрезает его по центру.

Нейросеть Kandinsky 6.0 Video — что умеет и как работает

Звук генерируется с частотой дискретизации 44 кГц. Отдельная модель суперразрешения позволяет масштабировать видео вплоть до Full HD — 1920 × 1080 пикселей.

По результатам попарного сравнения роликов участниками исследования версия Pro превосходит Kandinsky 5.0 Video Pro. Авторы также сравнивают модель с другими системами генерации видео и аудио и отмечают высокое качество синтезированной речи.

Нейросеть Kandinsky 6.0 Video — что умеет и как работает

Как пользоваться

Код и веса Kandinsky 6.0 опубликованы 6 октября 2026 года под лицензией MIT. Помимо основных моделей, доступны ускоренные версии Lite Distill и Pro Distill.

Для Pro Distill открыт демонстрационный сервис на Hugging Face. Модели также можно запускать через Diffusers и ComfyUI. Инструкция для самостоятельной установки из репозитория требует видеокарту NVIDIA и Python 3.13 или 3.14.

Как пользоваться

Чтобы скачать файлы основной Pro-модели из Hugging Face, нужно войти в аккаунт, принять условия доступа и согласиться передать контактные данные.

Как пользоваться

Ранее Сбер выпустил Kandinsky 6.0 Image — нейросеть для генерации и редактирования изображений в ГигаЧате.

⭐ Наш Telegram-канал, где мы показываем, как применять ИИ в работе: промты, кейсы, гайды и рабочие схемы. Подписывайтесь → «Промты — и точка».

⭐ Наш Telegram-канал, где мы показываем, как применять ИИ в работе: промты, кейсы, гайды и рабочие схемы. Подписывайтесь → «Промты — и точка».

Комментарии: Вышла нейросеть Kandinsky 6.0 Video — модель генерирует видео со звуком
⚡ В тренде
Даже на платных тарифах ChatGPT действуют лимиты на использование. Если они заканчиваются, сервис может прямо во время работы закрыть доступ к выбранной модели или переключить чат на облегчённую версию. Ограничения распространяются на ИИ-модели, сообщения, файлы и дополнительные функции. Их объём зависит от тарифа, выбранного инструмента и текущей нагрузки на сервис. В статье разберём, какие лимиты […]
Если вы загружаете ролики на YouTube и оформляете канал, размеры лучше определить заранее. Иначе шапка обрежется на смартфоне, мелкий текст на превью станет нечитаемым, а вертикальное видео будет выглядеть не так, как в редакторе. У YouTube нет одной страницы со всеми размерами. Требования к видео, обложкам, баннеру канала, аватару и Shorts находятся в разных разделах […]
Октябрь — самое время доставать плед, заваривать что-нибудь горячее и устраивать длинные вечера за просмотром сериалов. Тем более что в этом месяце выходит множество достойных проектов, чтобы не пересматривать старое по кругу. В подборке — главные премьеры сериалов октября 2026 года. Всё расположили по датам выхода. Подборка за сентябрь здесь. Читайте также: Где смотреть зарубежные […]
OpenAI выпустила GPT-6.1 Sol — новую модель семейства GPT-6 для сложных задач. По данным компании, по возможностям она приближается к GPT-6 Astra, но расходует токены более экономично. В этой статье покажу, где найти и включить GPT-6.1 Sol и как ей пользоваться. Затем, в рамках рубрики #Тестиум, протестирую модель на своих реальных задачах и дам примеры […]
ChatGPT можно использовать не только для генерации изображений, ИИ-фотосессий и визуала для соцсетей. В него можно загрузить обычную фотографию со смартфона и попросить обработать её: поправить свет и цвет, убрать шум, сделать ретушь или придать снимку характер профессиональной съёмки. Главное — точно описать в запросе, что можно менять, а что должно остаться как на исходной […]
Блоги компаний
Новости
Свежие статьи