Ученые из R&D-центра группы «Т-Технологии» создали метод, который позволяет оценить склонность LLM соглашаться с предлагаемыми решениями задач на основе строгой логики и помогает повысить объективность рассуждений моделей при работе над ними.
Для оценки склонности модели соглашаться (Sycopahcy) с решением пользователя специалисты разработали два бенчмарка. Первый оценивает, как меняется проверка LLM готового решения в зависимости от того, задан ли пользователем заранее нейтральный или негативный контекст. С помощью второго бенчмарка проверяются задачи с противоречивыми условиями, где модель должна не дать решение, а обнаружить логическую нестыковку.
Метод также может применяться при создании помощников для программистов, систем оценки учебных решений и инструментов корпоративной проверки.
В ноябре 2025 года ученые из T-Bank AI Research и лаборатории Центрального университета Omut AI разработали метод обучения LLM, который развивает способность к рассуждениям за счет использования векторов-настроек.
Нажимая на кнопку, вы соглашаетесь с политикой конфиденциальности
ICT.Moscow — открытая площадка о цифровых технологиях в Москве. Мы создаем наиболее полную картину развития рынка технологий в городе и за его пределами, помогаем бизнесу следить за главными трендами, не упускать возможности и находить новых партнеров.