Tezkun Новости Узбекистана. Коротко, с источниками. USD 11 790,79 ▲ EUR 13 285,86 ▲ RUB 137,78 ▼
Технологии

«Сбер» выпустил нейросеть Kandinsky 6.0 Video с синхронным звуком

Иллюстрация: Tezkun / ИИ. Не является фотографией события.

«Сбер» представил нейросеть Kandinsky 6.0 Video, которая способна создавать видеоролики с синхронизированной речью, музыкой и окружающими звуками.

Как сообщили разработчики, новая модель позволяет генерировать ролики длительностью до пяти секунд в качестве SD, HD и Full HD (1920 × 1080 пикселей). Звук формируется с частотой дискретизации 44 кГц, при этом движения губ персонажей синхронизируются с речью. При желании ролик можно создать без звуковой дорожки.

Запрос формируется с помощью текстового описания либо на основе загруженного первого кадра. Линейка включает две версии: Lite с 3 млрд параметров и Pro с 30 млрд параметров. По заявлению компании, модель в среднем в 71% случаев превзошла предыдущую версию по всем критериям передачи движения и физики.

Инструмент встроен в сервис «ГигаЧат», а также выложен на Hugging Face. Исходный код и веса модели открыты под свободной лицензией MIT, что позволяет разработчикам бесплатно использовать ее в собственных продуктах.

Что это значит

Модель доступна пользователям в «ГигаЧате», а сторонние разработчики могут бесплатно интегрировать ее под лицензией MIT через репозиторий Hugging Face.

Опубликовано 7 октября 2026, 14:32 · Обновлений не было · Хронология сюжета

Обсуждение
  1. Загружаю комментарии…
Без ссылок и оскорблений. Не чаще одного комментария в 20 секунд.

Комментарии к этой новости — под её постом в нашем Telegram-канале. Комментировать в Telegram