Учёные выявили слабость ИИ в тесте на внимание

Международная группа учёных проверила способность ведущих языковых моделей справляться с тестом Струпа — психологическим заданием на концентрацию внимания. В ходе эксперимента модели нужно было определять цвет, которым написано слово, игнорируя его значение. Например, при слове «красный», напечатанном синим, правильный ответ — «синий». Тест проводился на GPT-4o, Claude 3.5 Sonnet, GPT-5, Claude Opus 4.1 и Gemini 2.5.

На коротких списках из пяти слов модели показывали высокую точность: GPT-4o — 91%. Однако с увеличением длины задания результаты резко ухудшались. При 40 словах точность GPT-4o упала до 15%, у Claude 3.5 — до 24% после 20 слов. Исследователи объяснили это тем, что ИИ теряет фокус и возвращается к основному навыку — распознаванию слов. В отличие от человека, модели не способны устойчиво удерживать произвольное внимание. Работа опубликована в журнале PNAS Nexus.

загрузка...

Политика конфиденциальности Пользовательское соглашение

© 2015-2026 Сетевое издание «Фактом». Зарегистрировано в Федеральной службе по надзору в сфере связи, информационных технологий и массовых коммуникаций (Роскомнадзор).
Реестровая запись ЭЛ No ФС 77 - 67652 от 10.11.2016.