Инфраструктура RL-обучения

Яндекс

На конференции Deep Tech Night руководитель группы базовой ML-инфраструктуры «Яндекса» Иван Сапожков рассказал о принципах использования холдингом вычислительных мощностей для процесса обучения с подкреплением (Reinforcement Learning, RL) ИИ-моделей.

В своей презентации спикер описал место RL в общем процессе обучения, представил способы оптимизации вычислений. В качестве вызовов для инфраструктуры и при обучении моделей Сапожков выделил увеличение длины контекста моделей и ограничения при передаче данных.

Расскажите знакомым:

103Дата добавления:09.09.2026
103Дата добавления:09.09.2026
Добавить мою презентацию
на ICT.Moscow
Что такое ICT.Moscow?

ICT.Moscow — открытая площадка о цифровых технологиях в Москве. Мы создаем наиболее полную картину развития рынка технологий в городе и за его пределами, помогаем бизнесу следить за главными трендами, не упускать возможности и находить новых партнеров.