- PVSM.RU - https://www.pvsm.ru -

Первая в России нейросеть для генерации полноценного видео: Сбер представил Kandinsky Video

Команда Сбербанка представила свою новую разработку в области нейросетей. Как отмечает пресс-служба, Kandinsky Video стала первой в России генеративной моделью для создания полноценных видеороликов по текстовому описанию. 

Первая в России нейросеть для генерации полноценного видео: Сбер представил Kandinsky Video
Пример видеоролика от Kandinsky Video. Иллюстрация: Сбер

Модель генерирует видеоряд продолжительностью до восьми секунд с частотой 30 кадров в секунду. Об этом в ходе международной конференции AI Journey рассказал первый заместитель председателя правления Сбербанка Александр Ведяхин.

Архитектура Kandinsky Video состоит из двух блоков: первый отвечает за создание ключевых кадров, из которых складывается структура сюжета видео, а второй — за генерацию интерполяционных кадров, которые позволяют достичь плавности движений в финальном видео. В основе двух блоков лежит новая модель синтеза изображений по текстовым описаниям Kandinsky 3.0 [1].

Первая в России нейросеть для генерации полноценного видео: Сбер представил Kandinsky Video
Пример видеоролика от Kandinsky Video. Иллюстрация: Сбер

Формат сгенерированного видео представляет собой непрерывную сцену с движением как объекта, так и фона. Именно это отличает видеоролики, синтезированные моделью Kandinsky Video, от анимационных видеороликов, в которых динамика достигается за счёт моделирования пролёта камеры относительно статичной сцены. 

Нейросеть создаёт видеоролики с разрешением 512 х 512 пикселей и различным соотношением сторон. Модель обучена на наборе данных из более чем 300 тыс. пар «текст — видео». Генерация видео занимает до трёх минут.

Александр Ведяхин рассказал:

Недавно мы обучили Kandinsky создавать анимационные видео по текстовому описанию, а уже сегодня представляем модель совершенно другого уровня — первую в России модель по генерации полноценных видеороликов по тексту. Это важный вклад в развитие российских генеративных нейросетей. У пользователей появится ещё больше возможностей для креатива и реализации своих творческих задумок любой направленности. Люди смогут создавать уникальные видеоролики абсолютно бесплатно. Наша модель, как и большинство других в линейке Сбера, будет доступна в open source. Мы верим, что искусственный интеллект сможет открыть перед людьми новые супервозможности и создать инструменты, которыми они будут пользоваться для решения своих задач.

Оценить возможности нейросети Kandinsky Video можно на платформе fusionbrain.ai [2] и в Telegram-боте [3], где можно оставить заявку на доступ.

 

Источник [4]


Сайт-источник PVSM.RU: https://www.pvsm.ru

Путь до страницы источника: https://www.pvsm.ru/news/388336

Ссылки в тексте:

[1] новая модель синтеза изображений по текстовым описаниям Kandinsky 3.0: https://www.ixbt.com/news/2023/11/22/kandinsky-3-0.html

[2] платформе fusionbrain.ai: https://www.ixbt.com/click/?c=53616c7465645f5f2395ae7605f0dfd61e42fb22120407b2930eb262a08fec35446eae629987c489812f1d3bbfca0fbb95f88f829f92c8f21bd0fc702e09e5e5&h=8a351f7d2a7e99dbe19caf0e0d683f659f9f0113

[3] Telegram-боте: https://www.ixbt.com/click/?c=53616c7465645f5fa8f38404e3ead82d03150be02013b12bf649672f9e5e5f51ed5dc90249ad6cf8804035c51947d4c3b8af1ad984a36be90a00081455a060911023eb7a889fef1f6957de4200a9a400&h=0e42389fb94843883349a833591d808fd4f4a7f3

[4] Источник: https://www.ixbt.com/news/2023/11/22/pervaja-v-rossii-nejroset-dlja-generacii-polnocennogo-video-sber-predstavil-kandinsky-video.html