Мемориал в честь моряков-пограничников установили на Шумшу
09:07
Вахта Победы: Почти 100 забайкалок получили медали и ордена за рождение и воспитание детей
27 июля, 23:00
Новая жизнь колхозников и театралов: Якутия летом 1945 года
27 июля, 17:00
Фестиваль студенческих отрядов собрал 350 участников на Сахалине
27 июля, 16:47
Жители Южно-Сахалинска провели насыщенный день в парке
27 июля, 13:29
Как создать тренды и привлечь подписчиков рассказали на Камчатке
27 июля, 12:45
Военкор Семён Пегов ответил на вопросы камчатских журналистов
27 июля, 12:40
На Сахалине работает первый в России водно-болотный карбоновый полигон
27 июля, 12:38
Порт Корсаков готовится к приему круизных лайнеров
27 июля, 11:34
Вахта Победы: дети "вкалывают" не хуже взрослых, а "Сахалиннефть" вновь отстает
27 июля, 11:00
Жамсаран Цыдыпов победил в РАПИД Гран-при на Сахалине
27 июля, 10:57
Гонки эндуро No Place to Run 2025 стартовали на Сахалине
27 июля, 09:14
Валерий Лимаренко обсудил с жителями Ново-Александровска вопросы благоустройства
27 июля, 08:35
На Сахалине вновь пройдет этап чемпионата России по пляжному волейболу
26 июля, 16:10
Доступность финуслуг в селах Сахалина и Курил лидирует на Дальнем Востоке
26 июля, 15:04

Сбер представил Kandinsky Video — нейросеть для генерации полноценного видео

Нейросеть Сбера умеет создавать 8-секундные видеоролики по самым разным темам запросов
23 ноября 2023, 14:45 Общество
Нашли опечатку?
Ctrl+Enter

Сбер представил нейросеть Kandinsky Video (6+) — генеративную модель для создания полноценных видеороликов по текстовому описанию. Модель генерирует видеоряд продолжительностью до восьми секунд с частотой 30 кадров в секунду. Об этом в ходе международной конференции AI Journey (16+) рассказал первый заместитель председателя правления Сбербанка Александр Ведяхин.

Архитектура Kandinsky Video состоит из двух ключевых блоков: первый отвечает за создание ключевых кадров, из которых складывается структура сюжета видео, а второй — за генерацию интерполяционных кадров, которые позволяют достичь плавности движений в финальном видео. В основе двух блоков лежит новая модель синтеза изображений по текстовым описаниям Kandinsky 3.0 (6+).

Формат сгенерированного видео представляет собой непрерывную сцену с движением как объекта, так и фона. Именно это отличает видеоролики, синтезированные моделью Kandinsky Video, от анимационных видеороликов, в которых динамика достигается за счёт моделирования пролёта камеры относительно статичной сцены. Нейросеть создаёт видеоролики с разрешением 512 х 512 пикселей и различным соотношением сторон. Модель обучена на датасете из более чем 300 тысяч пар "текст — видео". Генерация видео занимает до 3 минут.

Александр Ведяхин, первый заместитель Председателя Правления Сбербанка:

"Недавно мы обучили Kandinsky создавать анимационные видео по текстовому описанию, а уже сегодня представляем модель совершенно другого уровня — модель по генерации полноценных видеороликов по тексту. Это важный вклад в развитие российских генеративных нейросетей. У пользователей появится ещё больше возможностей для креатива и реализации своих творческих задумок любой направленности. Люди смогут создавать видеоролики абсолютно бесплатно. Наша модель, как и большинство других в линейке Сбера, будет доступна в open source. Мы верим, что искусственный интеллект сможет открыть перед людьми новые супервозможности и создать инструменты, которыми они будут пользоваться для решения своих задач".

Ранее у активных пользователей Kandinsky 2.2 в тестовом режиме появилась возможность создания анимационных видеороликов. По одному запросу можно создать видео длиной в четыре секунды с выбранным эффектом анимации, с частотой 24 кадра в секунду и разрешением 640 х 640 пикселей. Пользователи нейросети Kandinsky 3.0 также могут создавать видеоролики по текстовому описанию в режиме анимации.

Оценить возможности нейросети Kandinsky Video можно на платформе fusionbrain.ai (18+) и в Telegram-боте (18+), где можно оставить заявку на доступ.

Нейросеть разработали и обучили исследователи Sber AI при партнёрской поддержке учёных из Института искусственного интеллекта AIRI на объединённом датасете Sber AI и компании SberDevices. В апреле 2023 года сервис на базе нейросети Kandinsky 2.1 (6+), стал одним из самых быстрорастущих в мире. Он набрал 1 млн уникальных пользователей всего за четыре дня после выхода.

16842
64
43

Электронный ресурс (Сайт) использует cookies и метрические программы. Продолжая посещение настоящего сайта, пользователь соглашается на смешанную обработку, сбор, использование, хранение, уточнение (обновление, изменение), обезличивание, блокирование, уничтожение своих персональных данных владельцем Электронного ресурса в соответствии с Политикой обработки персональных данных и Согласием на обработку персональных данных Пользователей.
На сайте используются рекомендательные технологии