Vision-Language-Action-модели: современные подходы и открытые вопросы

AIRI

Научный сотрудник лаборатории когнитивных систем ИИ AIRI Егор Черепанов выступил на Turbo ML Conf с обзорным докладом о VLA-моделях (Vision-Language-Action).

Спикер описал типовую архитектуру подобных нейросетей, историю их развития, и обозначил проблемы, которые стоят перед разработчиками подобных решений:

  • небольшая длина контекста;
  • нехватка данных для обучения и высокая стоимость их получения;
  • отсутствие обучения на собственных ошибках;
  • неспособность стабильно накапливать новые навыки.

Расскажите знакомым:

60Дата добавления:17.08.2026
60Дата добавления:17.08.2026
Добавить мою презентацию
на ICT.Moscow
Что такое ICT.Moscow?

ICT.Moscow — открытая площадка о цифровых технологиях в Москве. Мы создаем наиболее полную картину развития рынка технологий в городе и за его пределами, помогаем бизнесу следить за главными трендами, не упускать возможности и находить новых партнеров.