Назад к докладам семестра
Исследование способности больших языковых моделей распознавать ложные предпосылки в пользовательских запросах
Рассмотрение запросов, содержащих неверные утверждения, ошибочные обобщения и подмену понятий, которые LLM не всегда выявляют, принимая исходное утверждение за истинное и продолжая рассуждение. Разработка набора тестовых запросов с различными типами ложных предпосылок, методика оценки и сравнительный эксперимент нескольких LLM.