«Сбер» выпустил нейросеть Kandinsky 6.0 Video с синхронным звуком
«Сбер» представил нейросеть Kandinsky 6.0 Video, которая способна создавать видеоролики с синхронизированной речью, музыкой и окружающими звуками.
Как сообщили разработчики, новая модель позволяет генерировать ролики длительностью до пяти секунд в качестве SD, HD и Full HD (1920 × 1080 пикселей). Звук формируется с частотой дискретизации 44 кГц, при этом движения губ персонажей синхронизируются с речью. При желании ролик можно создать без звуковой дорожки.
Запрос формируется с помощью текстового описания либо на основе загруженного первого кадра. Линейка включает две версии: Lite с 3 млрд параметров и Pro с 30 млрд параметров. По заявлению компании, модель в среднем в 71% случаев превзошла предыдущую версию по всем критериям передачи движения и физики.
Инструмент встроен в сервис «ГигаЧат», а также выложен на Hugging Face. Исходный код и веса модели открыты под свободной лицензией MIT, что позволяет разработчикам бесплатно использовать ее в собственных продуктах.
Что это значит
Модель доступна пользователям в «ГигаЧате», а сторонние разработчики могут бесплатно интегрировать ее под лицензией MIT через репозиторий Hugging Face.
Источники
- Hi-Tech Mail: Сбер представил Kandinsky 6.0 Video: генерирует видео с синхронным звуком в Full HD СМИ
- iXBT.com: «ГигаЧат» Сбера научился создавать видео с синхронным звуком СМИ
- 3DNews: «Сбер» выпустил Kandinsky 6.0 Video — ИИ-модель для генерации видео с синхронным звуком СМИ
- Хабр: «Сбер» выпустил модель Kandinsky 6.0 Video для генерации видео с речью и музыкой СМИ
Материал подготовлен с помощью ИИ. Нашли ошибку — напишите нам.
Опубликовано 7 октября 2026, 14:32 · Обновлений не было · Хронология сюжета




Комментарии к этой новости — под её постом в нашем Telegram-канале. Комментировать в Telegram