Любопытство Гаурава относительно природы его решений в конце концов привело его в аспирантуру Стэнфордского университета[1]. К тому времени он уже был знаком с нейронными сетями и эмерджентностью. Он интуитивно чувствовал потенциал этих идей, но еще не мог полностью связать их с волновавшими его вопросами.
И вот однажды Гаурав попал на семинар Джея Макклелланда, который к тому времени был уже маститым профессором.
Больше всего Гаурава поразила бескомпромиссная конкретность подхода Джея. Он не отмахивался от важных деталей, не ссылался на непостижимые теоретические концепции, не занимался спекуляциями и не делал удобных допущений. Вместо этого Джей выбирал явление, которое хотел понять, формулировал набор четких исходных принципов и предположений, а затем прозрачно применял эти принципы для вычисления активаций нейронной сети при заданных входных сигналах. Гаурав пришел к Джею, чтобы лучше понять его подход.
Первое явление, которое Джей продемонстрировал Гаураву, касалось извлечения информации о группе людей. Это была разработанная Джеем нейронная сеть, которую мы опишем в главе 4. Гаурав тщательно проследил активации в сети и с восторгом обнаружил, что нейронная сеть способна делать логические выводы. Эта способность не была заложена в сеть явно – она возникла из взаимодействия элементов сети. Это стало поворотным моментом. Он помнит, как сидел за столом и сказал себе: «Я уже никогда не буду думать о разуме так, как думал раньше».
Цель нашей книги – дать читателям возможность пережить такое же откровение.
Для достижения этой цели мы отобрали результаты экспериментов с людьми, животными и искусственными нейронными сетями, которые проливают свет на важнейшие аспекты человеческого разума. Эти примеры показывают, как мы воспринимаем мир, формируем понятия, принимаем решения, испытываем эмоции, проявляем самоконтроль, используем и понимаем язык и даже как мы мыслим и рассуждаем. Каждое явление, которое мы стремимся объяснить, подкреплено обширными экспериментальными данными, позволяющими оценить объяснительную силу разрабатываемых нами нейросетевых моделей.