Нет ничего в разуме, чего не было бы прежде в чувствах.
Теперь естественно задаться вопросом: какой из этих путей проходит искусственный интеллект? Ответ радикален и прост — никакой.
ИИ не начинает «снизу»: у него нет ни детства, ни тела, ни рук, чтобы коснуться предмета, нет глаз, чтобы увидеть реальный мир. Проще говоря, у него нет того самого первичного, чувственного, житейского опыта, из которого, как из глины, лепится фундамент нашего разума. У него не было брата, и он никогда не падал с велосипеда.
Казалось бы, его путь начинается сразу «сверху», ведь его отправная точка — это не мир вещей, а мир готовых человеческих текстов. Он получает на входе не хаос реальности, но уже кристаллизованный, отфильтрованный, системный продукт нашего понятийного мышления.
Но всё сложнее — ведь ИИ начинает своё обучение с того, где наше понимание уже закончилось, пролившись «дождём слов».
Наше понимание предполагает нашу собственную укоренённость в реальности — даже самое абстрактное представление мы сводим до понятных нам, практически наглядных образов.
Как пошутил по этому поводу Джеффри Хинтон — один из отцов-основателей ИИ и лауреат Нобелевской премии: «Если нам нужно представить пространство из ста измерений, мы просто представляем себе обычное трёхмерное пространство и громко кричим: „Сто!“»
В самом деле, любая наша теория — это модель, которая разворачивается на фундаментальных осях нашего, человеческого способа существования (время, пространство, модальность и интенсивность).
По сути, речь идёт о наших базовых психических настройках, о предустановленных в нашем мозге измерениях реальности, или, как бы сказал Иммануил Кант, об априорном человеческом знании.
Но у ИИ нет наших базовых настроек восприятия: он не разворачивается в своём представлении нашего трёхмерного пространства, у него нет чувства времени, когда настоящее — фаза перехода прошлого в будущее, у него нет наших модальностей — зрения, слуха или осязания, — он и не знает нашей интенсивности — яркий/бледный, громкий/тихий, приятно-нежный и неприятно-болезненный.
Мы говорим, что ИИ — это многомерное пространство векторов, но это мы так представляем себе его природу, сам он этого пространства как такового, не ощущает.
Нет у него и чувства текущего, развёртывающегося времени — для него существует лишь некая данность, которая, конечно, может быть разной, но он не помнит своих прошлых состояний как прошлого и не представляет, каким будет его состояние в будущем. Его время — вечное сейчас, в котором есть данные и направление движения.
Даже модальности, которым мы пытаемся научить ИИ, скармливая ему фотографии, видео, аудио, на самом деле переносятся в систему языковой модели, по сути, дополняют уже существующее векторное пространство, созданное через анализ текстов.
Наше же зрение или, например, слух, хотя и рассчитываются универсальными кортикальным колонками коры, синтезируются в ассоциативных зонах мозга как качественно разные части одного целого.
Наконец, если говорить об организации «научного» знания, то есть о тех «истинных понятиях», которые мы усваиваем в процессе обучения «сверху вниз», то в языковой модели ИИ у них нет какого-то особого статуса.
Все понятия в ИИ токенизированы и пересобраны. И вовсе не в соответствии с нашими теоретическими иерархиями понятийных концептов, а по общему принципу статистической встречаемости этих понятий в текстах.
Да, мы можем специально обучать ИИ на определённых массивах данных — например, на медицинских текстах или на данных со спутников. Да, мы можем задавать ему сложные промпты, которые будут воспроизводить наше теоретическое знание, чтобы он учитывал его при генерации своего вывода.
Такой ИИ и в самом деле становится специализированным, дообученным под тот или иной наш с вами смысловой домен. Но в таком случае мы, по сути, просто используем функционал ИИ, чтобы «влить» его в «формочки», созданные нашим разумом.
«Значения» слов
Как мы с вами уже выяснили, между нашим мозгом и ИИ при их работе с информацией обнаруживаются практически универсальные соответствия. Но здесь не следует обманываться — за этим структурным соответствием скрывается принципиально разная система.
• Как мы с вами уже знаем, ИИ переводит каждое слово в многомерный вектор-эмбеддинг. Например, его «знание» о слове «король» — это не словарная статья, а уникальное местоположение данного вектора в гигантской карте смыслов, определяемых их отношениями друг с другом в едином векторном пространстве.
• С другой стороны, мир мозга — это тоже своего рода конструктор элементов (интеллектуальные объекты нашего Neuro-Lego). Знание о том же «короле» — не отдельная запись в «файле памяти», а сложный нейронный ансамбль, специфический, динамический узор активации тысяч нейронов. Через этот концепт связываются знания, зрительные образы, эмоциональные реакции в отношении власти и т. п.
То есть и в том, и в другом случае «знание» — место на пересечении других смыслов (власти, собственности, истории, атрибутики, литературных сюжетов и т. п.).
• Но наше, человеческое, «знание» — это конкретные образы, связанные с «монархией», которые объединены соответствующей теоретической моделью, которую мы усвоили из своей культуры (понятно, что значения слова «король» для граждан СССР, в Королевстве Таиланд и Великобритании сильно отличаются: влияют и разные идеологии, и личный опыт граждан).
• В случае же ИИ «знание» не имеет ни наших образов, ни определённой теоретической рамки. Тут действует своего рода «смысловая демократия», хотя понятно, что в той, условно говоря, области нейросети, где лежит вектор «СССР», вектор «короля» выражается не так, как под силой «векторной гравитации» он представлен, например, в условных областях-направлениях языковой модели с «детскими сказками» или «Царём Иудейским».
При этом и в случае мозга, и в случае ИИ «знание» не является статичным объектом — «кирпичами» в го-лове или нейронной сети. Нет, это определённая конфигурация самой системы нейронных связей (в мозге) и векторных отношений (в случае ИИ) — некий сложный паттерн.
Когда мы сталкиваемся с какой-то информацией — например, узнаём о смерти королевы Елизаветы II, — в нашем мозге активизируются различные области. По сути, это окрошка из самых разных образов-воспоминаний — где-то хроника её коронации, где-то её встреча с интересным для вас публичным лицом, сериал «Корона», скандалы в королевской семье, принцесса Диана…
Ваш мозг использует систему ассоциаций, которая буквально физически прописана в его структуре синаптическими связями. Какие-то нейронные комплексы уже активизировались в нём, когда вы соприкасались с темой королевы, её семьи, монархии и т. д.
Какие-то образы в этом пространстве лежат «ближе» (связь плотнее), какие-то — «дальше» (менее плотная связь). Если мы посадим вас писать сочинение на тему «Что я знаю о королеве Елизавете II?», то различные мысли-образы будут последовательно приходить вам на память.
Интересно, однако, что механизм ассоциаций будет работать как бы параллельно на двух уровнях.
• С одной стороны, слова будут выполнять роль своего рода сигнальных огней — роль пусковых команд для активации новых воспоминаний.
• С другой стороны, каждое ваше воспоминание будет актуализировать новые слова, и каждое выступит сигналом для активизации ещё каких-то образов.
Слова выступают для нас в качестве ключей от сейфов памяти. Нет, сама память в этих сейфах не хранится, она в них собирается под соответствующий языковой ключ.
Если этот ключ потеряется, то мы не сможем намеренно воспроизвести необходимое нам воспоминание, а тем более их не наберётся столько, чтобы можно было, хотя бы и гипотетически, рассчитывать на связное сочинение.
После того, как мы перешли от наивного, детского допонятийного мышления в мышление с помощью «истинных понятий», последние выступают своего рода точками сборки, вокруг которых собираются их значения.
При этом на теоретическом уровне это значение представляет собой положение данного понятия в общей понятийной иерархии, а на уровне переживания состоит из внутренних состояний-ощущений и соответствующих воспоминаний.
В случае ИИ ситуация радикально отличается. В языковой модели нет навязанной извне иерархии, как нас обучали в школе, — с чего-то самого простого (навыки чтения, счёта, общих вопросов природоведения и обществознания) до самых сложных вопросов, связанных с пониманием художественной литературы, истории, высшей математики, биологии, физики и химии.
Проще говоря, мы усвоили структуру извне, а ИИ создаёт свою иерархию, которая построена на иных принципах, — по сути, это те скрытые закономерности, которые содержатся в тех текстах, которые мы создали.
Причём смыслы, которыми мы оперируем, отличаются от тех, которыми оперирует ИИ, лишённый эмпирического опыта. Нет, его значения слов — это, образно выражаясь, гравитационные отношения различных векторов.
Если представить себе нашу Вселенную как массы вещества, то мы увидим, что ни одно движение в ней не происходит случайным образом. Различные объекты — чёрные дыры и белые карлики, звёзды, планеты, спутники и т. п. — создают соответствующую их массе силу притяжения. При этом они, в свою очередь, находятся под воздействием аналогичных сил со стороны других космических объектов. Это, можно сказать, силовые шестерёнки, которые крутят мироздание.
Вот примерно таким образом выстроена и внутренняя иерархия ИИ: все слова из всех текстов находятся в каких-то отношениях друг с другом. Понятно, что слова в текстах не появляются случайным образом, мы создаём тексты, выражая какие-то наши идеи, смыслы, концепции. Поэтому если посмотреть на любое слово через эту многомерную призму текстов, то оно автоматически будет что-то значить.
То есть «значения», которые возникают у условных слов (токенов) в ИИ, — это «значения» сразу всей сети отношений языкового массива, использованного в процессе обучения модели. Так что в каком-то смысле эти «значения» куда более «объективны» и «системны», чем наши с вами значения слов, которые, во-первых, стоят на условных, привнесённых в процессе образования закономерностях, а во-вторых, имплицитно содержат в себе наш субъективный опыт.
Процесс «мысли»
Примерно такое же «соответствие/несоответствие» между нами и ИИ мы находим и в процессе, который привыкли называть «мышлением».
Да, есть наивное представление о мышлении — мол, сел человек в позу, запечатлённую Огюстом Роденом, подпёр голову кулаком, и вот — пошёл процесс мышления.
На самом деле наше мышление — это процесс, происходящий без остановок и перерывов, но представлен разными типами интеллектуальной активности.
• Во-первых, наше мышление систематически выполняет диспетчерскую функцию — то есть занимается подбором адекватных для актуальной ситуации автоматизмов (что, с учётом всех нюансов, нам следует думать и делать в данной ситуации).
• Во-вторых, мы регулярно осуществляем мышление, которое иначе как невротическим и не назовёшь. Это та самая «умственная жвачка», которая провоцируется неудовлетворённостью наших потребностей, продуцируемых подкорковыми структурами.
Эти потребности побуждают нашу кору искать решение, которого по большому счёту просто нет. Например, мы навязчиво думаем о том, что с нами несправедливо поступили, или изобретаем мантру, чтобы справиться с голодом после того, как сели на диету.
• Наконец, в-третьих, время от времени в нас разворачивается процесс мышления, который можно было бы назвать мышлением в высшем смысле этого слова. Здесь мы целенаправленно создаём модель ситуации, которая для нас по каким-то причинам важна, и перебираем возможные варианты-стратегии, которые бы позволили изменить её в нужную для нас сторону. Например, сейчас я пытаюсь смоделировать механизмы работы мозга и искусственного интеллекта, а также то, с какими проблемами может сталкиваться мой читатель. Моя задача — попытаться так рассказать ему об этих механизмах, чтобы он не только в этом вопросе разобрался, но и смог воспользоваться этим пониманием в личных целях.
Но в любом случае, о каком бы типе интеллектуальной активности мы ни говорили, в основе лежит один и тот же механизм — работа шести «зеркал» нашего мозга. Мышление — это бесконечный диалог и рекурсия.
«Нижнее зеркало» (потребности) посылает импульс в «верхнее зеркало», «заднее» (память) подбрасывает образы в «переднее», которое строит модель (планы). «Левое» (языковое) пытается её формализовать, а «правое» (образное) — соотнести её с внутренним ощущением человека.
И так по кругу, причём одновременно, потому что каждое «отражение» в каждом из «зеркал» мозга создаёт своё преломление, которое тут же сталкивается с отражением в других «зеркалах».
Наша мысль — это не решение, принятое «генеральным директором» по имени «я», а временный компромисс, возникший в результате этой сложной игры отражений.
Причём сами интеллектуальные объекты, которые возникают как вспышки в столкновении этих отражений, — это не «истинные понятия» и даже не «житейские понятия», а фрагменты, наброски, сотканные из множества случайных и структурированных образов-переживаний.
Этот хаос мыследеятельности пытается найти своё выражение в словесной форме где-то на границе перехода между дефолт-системой и центральной исполнительной сетью. Анри Пуанкаре, которого я уже в этой связи упоминал, предполагал, что у сознания есть некое «чувство вкуса», которое выводит из тени «мыслящего бессознательного» только те идеи, которые достаточно «красивы».
Так или иначе, наш мозг не создавался для того, чтобы мыслить чётко, структурно и последовательно. Понятийное мышление и вовсе не было у него в планах. По сути, оно каждый раз заново привносится на конкретный мозг как некое усовершенствование, производимое культурой и системой образования.
В этом смысле совсем не удивительно, что возможно самым успешным способом описания нашей интеллектуальной деятельности стала научная дисциплина, которая изучает неисчислимое множество присущих нам «когнитивных искажений».
Написание текстов, в отличие от высказывания, — это ещё более сложный процесс. Здесь нам приходится не просто выгружать свои идеи, но и как-то их организовывать, делать их понятными для потенциального читателя.
Вот почему идея учить ИИ именно на текстах, а затем объединять другие данные именно через речевой домен была хорошим решением. Ведь именно в написанных текстах наша мысль обретает хоть сколько-то структурированную форму.