Современные модели генерации изображений и видео: текущее состояние и вызовы
Сбербанк
Ведущий исследователь данных в Kandinsky Lab в «Cбере» Никита Киселев представил на Data Fest доклад об используемых в настоящее время моделях генеративного ИИ для создания изображений и видео.
Спикер описал принцип работы диффузионных моделей и разобрал этапы их обучения:
- предобучение (Pre-Train);
- тонкая настройка с учителем (Supervised Fine-Tuning, SFT);
- обучение с подкреплением на основе обратной связи от человека(Reinforcement Learning from Human Feedback, RLHF);
- дистилляция.
Также он выделил основные направления дальнейшего развития подобных решений, в частности тренд на омнимодальность.
111Дата добавления:04.09.2026
111Дата добавления:04.09.2026