Контролируемая генерация многокамерного видео для симуляции сенсорных данных автономного транспорта
ML-разработчик в группе симуляции сенсоров сервиса Автономного транспорта и роботов «Яндекса» Анастасия Демидова рассказала на конференции Data Fest 2026 о том, как ИИ генерирует ситуации для обучения беспилотных автомобилей.
В своей презентации спикер описал метод, который позволяет воспроизводить реалистичные видео на основе структурного описания сцены (траектории агентов, конфигурация дорожной инфраструктуры, погодные условия и время суток). Подход предполагает использование диффузионных моделей для симуляции данных с камер и визуально-языковых моделей (VLM) для аннотации сцен.