Компания Artificial Analysis опубликовала отчет о состоянии рынка искусственного интеллекта в 2025 году. Материал основан на данных собственного тестирования, а также на анализе публично доступной информации о моделях и участниках рынка.
В отчете рассматриваются основные изменения на рынке ИИ и расстановка сил между крупнейшими разработчиками, развитие языковых моделей и ИИ-агентов, динамика стоимости и производительности моделей, ключевые тенденции в генерации изображений и видео, а также работе с речью.
Ключевые выводы:
- по данным Artificial Analysis, в 2025 году рассуждающие модели стали стандартом на рынке. Если в начале года o1 от OpenAI была единственной, то в течение года аналогичные решения появились практически у всех крупных разработчиков;
- к концу 2025 года OpenAI, Anthropic, Google и xAI входили в число лидеров по уровню возможностей языковых моделей. OpenAI сохранила первое место, однако разрыв с ближайшими конкурентами стал меньше;
- по мнению авторов отчета, конкуренция между разработчиками ИИ заметно усилилась. В 2025 году собственные модели стали выпускать больше компаний из разных стран, хотя США и Китай по-прежнему уверенно лидируют;
- модели с открытыми весами продолжили приближаться к закрытым по уровню возможностей, однако самые сильные решения по-прежнему остаются проприетарными;
- как говорится в материале, в 2025 году заметно улучшилось соотношение возможностей моделей и их стоимости. За ту же цену теперь можно получить более высокий уровень качества либо прежний уровень — значительно дешевле. По оценке Artificial Analysis, стоимость использования моделей уровня o1 снизилась примерно в 128 раз;
- уменьшению стоимости способствовали более эффективные архитектуры моделей, программные улучшения при обработке запросов и новое оборудование. В то же время более крупные модели, более сложные рассуждения и работа ИИ-агентов продолжают увеличивать потребность в вычислительных мощностях;
- в 2025 году ИИ-агенты начали переходить от отдельных специализированных сценариев к выполнению многоэтапных задач. Особенно заметно продвинулись агенты для программирования, а в 2026 году авторы ожидают распространения агентов на более широкий круг рабочих процессов;
- в 2025 году существенно выросло качество генерации изображений и видео. Более распространенными сценариями стали редактирование изображений по текстовой инструкции, создание видео на основе изображений и генерация видео со звуком;
- кроме того, по мнению авторов отчета, в 2025 году значительно улучшились технологии работы с речью. Снизилось число ошибок при распознавании, выросло качество синтеза, а модели получили больше возможностей для управления интонацией, темпом, акцентами и другими особенностями голоса;
- нативные модели преобразования речи в речь быстро развиваются и позволяют ИИ работать непосредственно с аудио без обязательного промежуточного перевода речи в текст, отмечают авторы материала. Это создает основу для голосовых агентов, хотя в неоднозначных ситуациях, сложных диалогах и при плохом качестве звука их возможности пока ограничены.