К книге
Мозг игрока. Как нейронауки и UX влияют на дизайн видеоигрЧасть первая. Об устройстве мозга. 6. Мотивация. 6.2. Мотивация, навязанная окружением, и приобретенные стимулы
29%
Часть первая. Об устройстве мозга. 6. Мотивация. 6.2. Мотивация, навязанная окружением, и приобретенные стимулы
22

6.2.1. Внешняя мотивация: о кнутах и пряниках

Бихевиористы изучают, как окружение формирует мотивацию. Мы имплицитно учимся ассоциировать стимул с подкреплением, либо положительным, либо отрицательным. Этот процесс обычно называют «обусловливанием», или «оперантным научением» (подробнее о бихевиористском подходе к обучению см. главу 8). Согласно теории научения Халла, мотивация есть сумма «потребности» и «подкрепления» [Hull, 1943]. Иными словами, мы движимы ценностью и вероятностью вознаграждения за то или иное поведение, направленное на удовлетворение потребности. Например, если мы голодны (потребность), то идем искать еду (мотивация). Поев, мы чувствуем насыщение (награда).

Вознаграждение служит для нас положительным подкреплением, повышающим частотность поведения, которое позволило это вознаграждение получить. И наоборот, отрицательное подкрепление (наказание) снижает частотность соответствующего поведения (так, мы не трогаем горячую сковородку, чтобы не обжечься и не испытать боль). Наказанием также может служить отсутствие ожидаемой награды. Если мы делали что-то ради удовлетворения потребности, но не удовлетворили ее, то в следующий раз едва ли будем делать то же снова.

Приобретенные стимулы, как и все паттерны поведения, сильно подвержены влиянию гормонов и нейромедиаторов, хотя и не так, как нас убеждают кликбейтные статьи. Дофамин, кортизол, окситоцин, тестостерон, адреналин, норэпинефрин (норадреналин), эндорфины и так далее влияют на наше настроение и ощущения, на то, что мы делаем, и как воспринимаем награду. Так, было доказано, что тестостерон повышает заботу о социальном статусе [van Honk и др., 2016], а эндорфины определяют нашу способность наслаждаться чем-либо. То есть можно сказать, что мотивация – это «хотение», которое поддерживается «удовольствием».

Возможно, вам встречался такой термин, как «система внутреннего подкрепления» – крайне упрощенный способ описать отклик человека на естественное вознаграждение. Эта система определяет, что мы «хотим» (т. е. желания) и что нам «нравится» (т. е. удовольствие), а также влияет на наше обучение через подкрепление (обусловливание). Чаще всего это происходит бессознательно, т. е. нам может что-то «нравиться» имплицитно, без непосредственного ощущения удовольствия.

Конечно, говорить, будто у нас в голове есть «центр вознаграждения», было бы слишком примитивно. В системе внутреннего подкрепления задействовано много разных отделов мозга и соответствующих им нейромедиаторов: миндалевидное тело, гиппокамп, префронтальная кора, эндорфины (опиоиды) и дофамин. Например, миндалевидное тело (или амигдала) вместе с гиппокампом помогают нам запоминать ассоциации с конкретными стимулами, а также то, были они положительными или отрицательными. Таким образом, если стимул встречается снова, мы можем решить, избегать его или нет.

Итак, навязанная окружением мотивация поддерживается вознаграждением за поведение, направленное на удовлетворение стимула, или наказанием за избегание стимула, а также нашей памятью об этом опыте. Именно поэтому мы можем говорить о приобретенных стимулах.

В жизни много того, что мы не хотим делать (не испытываем внутреннего побуждения), но делаем, так как научены, что в этом случае получим ценные прямые или косвенные награды: еду, жилье, развлечения [Vroom, 1964]. Деньги – это косвенная награда, открывающая доступ к другим ценностям: на них можно купить стейк, оплатить жилье на месяц или сходить в кино (если только вы не цените деньги сами по себе).

Многочисленные исследования показали, что затрачиваемые усилия и качество выполнения задачи определяются стимулом [см. напр. Jenkins и др., 1998]. В некоторых ситуациях эти показатели напрямую зависели от величины вознаграждения. Например, студенты, которых попросили перетащить как можно больше кругов в определенный участок компьютерного экрана, работали лучше, получая четыре доллара, чем те, кто получал десять центов [Heyman, Ariely, 2004].

Как указано в разделе о внутренней мотивации, некоторые стимулы эффективнее других, причем награды, воспринимаемые как контролирующие (в ряде случаев это деньги), оказываются менее эффективными. Однако есть свидетельства, что система внутреннего подкрепления активируется как при получении награды, так и при ее ожидании, причем ожидание денежного вознаграждения действует сильнее, чем ожидание словесной похвалы [Kirsch и др., 2003].

6.2.2. Регулярное и нерегулярное вознаграждение

Ведущий фактор, определяющий, насколько ценна для нас награда, – это неуверенность в отношении шансов ее получить. Кроме того, сказываются особенности личности: люди, не любящие рисковать, воспримут непредсказуемую (т. е. ту, получение которой не гарантировано) награду как менее ценную [см. Schultz, 2009]. При этом существуют убедительные доказательства в пользу того, что награды, выдаваемые нерегулярно (т. е. определенное действие не всегда вознаграждается), сильнее влияют на поведение, нежели регулярные (т. е. когда действие вознаграждается всегда).

В своих опытах психолог-бихевиорист Б. Ф. Скиннер обнаружил, что те крысы, которые получали награду (кусок корма) каждый раз, когда нажимали на рычаг, в итоге бросали это занятие, если награда вдруг переставала поступать. И наоборот, если награда выдавалась не при каждом нажатии, а с переменной частотой (т. е. раз в 1–20 нажатий), крысы были значительно более увлечены задачей. Этот же феномен объясняет, почему игровые автоматы вызывают зависимость: они разработаны по принципу «ящика Скиннера», т. е. основаны на оперантном обусловливании[29] с непредсказуемым нерегулярным вознаграждением [Schüll, 2012]. Перед тем как сесть играть, настоятельно рекомендую вам четко определить, сколько денег вы готовы оставить в казино. В противном случае процесс вас затянет, и вы проиграете гораздо больше, чем хотели бы.

Нерегулярные награды часто используются в видеоиграх. Они могут быть интервальными (т. е. зависеть от времени) либо частотными (т. е. зависеть от действий игрока), а также фиксированными (предсказуемыми) либо переменными (непредсказуемыми). Примером фиксированной награды могут служить ежедневные награды, которые игрок получает, просто заходя в игру. Еще один пример можно встретить в играх вроде Clash of Clans (Supercell), где на строительство зданий уходит определенное время. Примером непредсказуемой награды могут служить мобы в многопользовательских онлайн-играх (т. н. MMO) вроде World of Warcraft (Blizzard): они время от времени возрождаются, но игроки не могут точно предсказать когда. Новая способность в древе навыков – это фиксированная частотная награда: игрок знает наверняка, сколько действий ему нужно совершить (т. е. какое поведение требуется), чтобы ее получить. Сюда же относится шкала опыта, точно показывающая, какое количество опыта нужно набрать для следующего уровня. При этом сам набор очков менее предсказуем, так как игра обычно не сообщает, сколько именно опыта приносит конкретное действие (например, убийство монстра). Наконец, как отмечалось выше, переменные частотные награды похожи по сути на игровые автоматы. Бустеры с картами, сундуки, лутбоксы и т. д. – это все примеры того, когда игрок не знает, получит ли ожидаемую награду. Лотерея, иными словами.

Как примерно показано на рис. 6.1, каждая нерегулярная награда по-своему влияет на отклик. После получения фиксированной награды обычно наступает пауза в поведении: получив то, что хотели, и зная, когда возникнет следующая возможность (по времени или по действиям), мы на какое-то время перестаем стремиться к получению этой награды. Если фиксированная награда больше не выдается по графику, это довольно быстро сводит отклик на нет, то есть мы прекращаем прикладывать усилия к ее получению. И наоборот, переменные награды в целом вызывают более стабильный отклик, что неудивительно, ведь мы не знаем, когда именно получим награду. Частотные награды обычно вызывают более высокий отклик, чем интервальные. Соответственно, самый высокий и стабильный отклик вызывают переменные частотные награды.

Как считает Ариэли [2008], наша привычка постоянно проверять почту и социальные сети может быть вызвана переменной частотой и нерегулярностью подкрепления. Обновляя экран приложения, мы рассчитываем увидеть новые «лайки» к своему посту (т. е. признание со стороны общества) или нужное сообщение (поздравление от начальника, любовное послание и т. п.). Как и с игровыми автоматами, по большей части мы не получаем ничего, но иногда «выпадает» нежданная награда, которая нам действительно важна. Так и возникает зависимость.

Рис. 6.1. Типы нерегулярных наград и их примерное влияние на поведение

Вознаграждение играет большую роль в формировании мотивации и поведения. Мы учимся связывать определенные стимулы с наградами через обусловливание, тем самым формируя ожидания, от которых зависит, будем ли мы выполнять те или иные действия. Приобретенные стимулы во многом опираются на имплицитные системы и оттого особенно сильно влияют на наше поведение. Вместе с тем необходимо отметить, что, согласно ряду серьезных исследований, некоторые типы наград, связанные с внутренней мотивацией, в определенных обстоятельствах могут оказаться даже более весомыми, чем награды внешние.

Предыдущая главаГлава 22 из 77Следующая глава