Когда ИИ догадывается, что вы сделаете, обычно он просто догадывается Вы уже видели этот трюк раньше. Спросите языковую модель, что персонаж истории будет делать дальше, и она даст вам уверенный ответ. Спросите его, почему, и вы получите правдоподобно звучащее просто...
Когда ИИ догадывается, что вы сделаете, обычно он просто догадывается
Вы уже видели этот трюк раньше. Спросите языковую модель, что персонаж истории будет делать дальше, и она даст вам уверенный ответ. Спросите его, почему, и вы получите правдоподобно звучащее обоснование, сшитое постфактум, историю, перепроектированную так, чтобы она соответствовала тому, что она уже выбрала. Большинство систем, предсказывающих человеческие решения, сопоставляют шаблоны от ситуации к результату и для галочки заполняют «ментальную» часть.
Прямой ответ достигает F1 42,2. Самосогласованность для шести выборок возрастает до 56,8, что в большинстве случаев подтверждает то же предположение с большей уверенностью. Ни один из подходов не спрашивает, что человек в сцене знает, намеревается или чувствует, прежде чем действовать.
Моделирование ментального мира предлагает другой подход: рассматривать убеждения, намерения, эмоции и нормы как переменные состояния, которые находятся рядом с физическими фактами, начиная с первого шага анализа. Конвейер Mentis поддерживает связь физического и мысленного каналов на каждом этапе: от анализа сцены до моделирования того, что происходит дальше, и определения подходящего действия. В полном объеме он достигает 66,8 F1 в среднем по восьми протестированным LLM, что на 24,6 балла выше, чем при прямом ответе, и на 10,0 балла, при самостоятельном ответе.