Назад к докладам семестра

Исследование способности больших языковых моделей распознавать ложные предпосылки в пользовательских запросах

Деревягина Александра 3381

18 декабря 2026 г.19:00
  • NLP

Рассмотрение запросов, содержащих неверные утверждения, ошибочные обобщения и подмену понятий, которые LLM не всегда выявляют, принимая исходное утверждение за истинное и продолжая рассуждение. Разработка набора тестовых запросов с различными типами ложных предпосылок, методика оценки и сравнительный эксперимент нескольких LLM.