Vision-Language-Action-модели: современные подходы и открытые вопросы
AIRI
Научный сотрудник лаборатории когнитивных систем ИИ AIRI Егор Черепанов выступил на Turbo ML Conf с обзорным докладом о VLA-моделях (Vision-Language-Action).
Спикер описал типовую архитектуру подобных нейросетей, историю их развития, и обозначил проблемы, которые стоят перед разработчиками подобных решений:
- небольшая длина контекста;
- нехватка данных для обучения и высокая стоимость их получения;
- отсутствие обучения на собственных ошибках;
- неспособность стабильно накапливать новые навыки.
122Дата добавления:17.08.2026
122Дата добавления:17.08.2026