Содержание
В Age of Empires II собрали крошечную нейросеть из коз, травы и мостов — так исследователь Microsoft Адриан де Винтер высмеял разговоры о «сознании» чат-ботов.
Проект выглядит как шутка для людей, которые слишком долго сидели в редакторе сценариев. Но за шуткой стоит нормальная академическая мысль. Если мы готовы приписывать человеческие качества LLM из-за текста в красивом интерфейсе, тогда по той же логике можно начать искать их и у коз в стратегии 1999 года.
Нейросеть на козах собрали в редакторе сценариев
Адриан де Винтер описал эксперимент в работе If LLMs have human-like attributes, then so does Age of Empires II. Он не доказывает, что большие языковые модели точно «не мыслят». Он показывает, насколько легко люди натягивают человеческие свойства на систему, если видят знакомое поведение.
Полноценную LLM внутри Age of Empires II он не строил. Для аргумента хватило базового кирпича нейросетей — 1-битного перцептрона и логического элемента NAND. В этой схеме козы играют роль битов, а трава и мосты помогают организовать состояние и переходы.
Проще говоря, исследователь взял редактор сценариев AoE II и собрал там примитивную вычислительную схему. Она грубая, медленная и нарочито абсурдная. Но она повторяет идею строительного блока, на котором держатся более сложные модели.
Код и демонстрации схемы де Винтер выложил на GitHub. Там видно, что речь не про метафору на салфетке, а про работающую конструкцию внутри игры.
Почему это удар по антропоморфизации чат-ботов
Главная цель эксперимента — показать слабое место в разговорах о «личности» ChatGPT, Claude, Gemini и других LLM. Пользователь видит связный текст, слышит вежливый тон и быстро достраивает за машиной намерения, эмоции и характер.
Этот эффект старше современных нейросетей. Еще ранние текстовые боты вроде ELIZA провоцировали людей общаться с программой как с собеседником. Нейросеть для этого не нужна — хватает интерфейса, который отвечает человеческим языком.
Де Винтер в интервью 404 Media прямо говорит, что любит доводить абсурд до максимума. Козы в Age of Empires II здесь работают как лакмус. Если сознание козьей схемы звучит нелепо, то к сознанию чат-бота тоже стоит относиться осторожнее.
В работе он опирается на классический принцип из сравнительной психологии: действие машины не нужно объяснять высшими когнитивными процессами, если его можно честно объяснить более простыми механизмами.
57% работ уже допускают человеческие черты у LLM
Самая приземленная часть исследования — статистика по научным публикациям. Де Винтер изучил 337 работ по компьютерным наукам за последние два года. По его оценке, 57% из них допускали, что LLM могут обладать человеческими чертами.
Это не мелкая стилистика. Такая исходная установка влияет на тесты, формулировки задач и выводы. Если исследователь заранее ищет «понимание», «намерение» или «эмпатию», он с большей вероятностью найдет похожий паттерн в ответах модели.
Коммерческие чат-боты усиливают этот эффект интерфейсом. Они обучены на естественном языке и отвечают в форме беседы. Пользователю легко принять плавный диалог за внутреннее состояние, хотя под капотом работает статистическая модель текста.
Компаниям это не мешает. Наоборот, человеческий образ продукта помогает продавать подписки и удерживать аудиторию. Де Винтер отдельно ссылается на исследования, где люди охотнее покупают продукты, к которым испытывают эмпатию.
В сухом остатке эксперимент не спорит с пользой LLM. ChatGPT, Claude и Gemini уже стали рабочими инструментами для текста, кода и поиска идей. Но козы из Age of Empires II напоминают неприятную вещь: похожее на мышление поведение еще не доказывает наличие мышления.
Ключевая формулировка из работы звучит жестко: «Ни в одном случае активность машины не следует трактовать через высшие когнитивные процессы, если ее можно честно объяснить процессами ниже по шкале когнитивной эволюции и развития».