Современные модели генерации изображений и видео: текущее состояние и вызовы

Сбербанк

Ведущий исследователь данных в Kandinsky Lab в «Cбере» Никита Киселев представил на Data Fest доклад об используемых в настоящее время моделях генеративного ИИ для создания изображений и видео.

Спикер описал принцип работы диффузионных моделей и разобрал этапы их обучения:

  • предобучение (Pre-Train);
  • тонкая настройка с учителем (Supervised Fine-Tuning, SFT);
  • обучение с подкреплением на основе обратной связи от человека(Reinforcement Learning from Human Feedback, RLHF);
  • дистилляция.

Также он выделил основные направления дальнейшего развития подобных решений, в частности тренд на омнимодальность.

Расскажите знакомым:

96Дата добавления:04.09.2026
96Дата добавления:04.09.2026
Добавить мою презентацию
на ICT.Moscow
Что такое ICT.Moscow?

ICT.Moscow — открытая площадка о цифровых технологиях в Москве. Мы создаем наиболее полную картину развития рынка технологий в городе и за его пределами, помогаем бизнесу следить за главными трендами, не упускать возможности и находить новых партнеров.