В 1930 году вниманию кинозрителей был представлен пророческий научно-фантастический мюзикл «Только представьте», который открывается хриплым закадровым голосом, предлагающим нам мысленно перенестись в футуристический мир 1980 года, жители которого считают себя «последним словом в скорости». Личные летательные аппараты снуют на фоне городского пейзажа, автомобили мчатся по эстакадам между возвышающимися небоскребами, люди используют для самоидентификации числовые коды вместо имен, еда и напитки употребляются в виде таблеток, а младенцев выдают торговые автоматы. Стоит ли говорить, что ничего из этого не сбылось, когда наступили настоящие 1980-е, но это не помешало фильмам того десятилетия, таким как «Назад в будущее II», «Вспомнить всё» и «Разрушитель», продолжать строить догадки о том, что ждет нас дальше. Казалось бы, к XXI веку у нас должны были появиться ховерборды, самошнурующиеся кроссовки, криогенные тюрьмы, человекоподобные автоматы, роботы для выгула собак, регулярные космические полеты на лунные базы — и, конечно же, еще больше летающих машин. Как ни странно, ни одно из этих новшеств до сих пор не доступно, хотя в 2022 году Toyota подала патентную заявку на автоматического выгульщика собак — судя по всему, придумав, как решить грязную проблему сбора экскрементов в пакеты.
Как говорится, предсказывать сложно — особенно будущее. Поэтому с большим трепетом в этой предпоследней части мы проигнорируем многочисленные предостережения и попытаемся понять, куда движется ИИ в ближайшем будущем. К счастью, нам не нужно полагаться исключительно на свое воображение. На самом деле любой человек может сделать обоснованный прогноз относительно ближайшего будущего ИИ, просто потратив достаточно времени на изучение лавины новых статей об LLM, которые ежедневно загружаются на серверы препринтов, такие как ArXiv. Эти работы намекают на технические трудности, над которыми исследователи ИИ бьются сегодня и которые вполне могут решить уже завтра. Действительно, учитывая головокружительный темп развития исследований, реальность может опередить прогнозы в мгновение ока. Как мы уже слышали, популярный аргумент критиков LLM заключается в том, что они не могут «понимать» мир, поскольку, в отличие от людей, не имеют доступа к сенсорным сигналам — например, к зрительным образам природных сцен. Но в конце 2023 года OpenAI предоставила доступ к мультимодальным функциям всем пользователям GPT-4, а это значит, что теперь систему можно использовать как для интерпретации, так и для генерации изображений (предсказуемо, конечно, сразу же посыпались замечания, что LLM «на самом деле не видят», даже если они получают входные данные в формате, аналогичном зрительной системе млекопитающих). На самом деле принятый нами термин «большая языковая модель» — LLM — стремительно устаревает по мере того, как появляются генеративные модели для изображений, аудио и видео. В качестве альтернативы некоторые предложили термин «передовой ИИ» (Frontier AI).
Хотя точные возможности ИИ будущего остаются предметом догадок, мы можем быть уверены: что бы ни произошло, это кардинально изменит общество. Для сравнения давайте бросим быстрый взгляд назад, на те масштабные перемены, которые принесла с собой революция в цифровых технологиях, произошедшая за последние тридцать лет. В 1993 году, когда я только стал студентом, чтобы связаться с друзьями, находясь вне дома, требовались монеты для таксофона. Чтобы совершить большинство покупок, сначала нужно было найти банкомат и снять пачку бумажных купюр. Чтобы почитать журнал или научную статью, приходилось тащиться в библиотеку; а чтобы посмотреть фильм, нужно было идти в пункт видеопроката на главной улице, например в ныне закрывшуюся сеть Blockbuster. На работе записки доставлялись вручную в вашу персональную ячейку в коричневых конвертах из переработанной бумаги. Поездки за границу планировались в туристическом агентстве или по путеводителю; а чтобы найти дорогу в незнакомом городе, вы пользовались бумажной картой или спрашивали дорогу у местных жителей. С сегодняшней точки зрения каждое из этих действий кажется почти доисторическим: сейчас все постоянно находятся на связи друг с другом, любую информацию можно найти за секунду в Google, смотреть видео и слушать музыку круглосуточно, созваниваться по видеосвязи с бабушкой и дедушкой на другом конце света, а телефон заменяет кошелек, авиабилет и удостоверение личности. Если мы экстраполируем эти ошеломляющие темпы изменений хотя бы на пять лет вперед, где мы окажемся?
Если научная фантастика — сомнительный ориентир в прогнозировании будущего, то, возможно, стоит обратиться за помощью к истории и изучить прошлые качественные скачки в технологиях, чтобы найти подсказки о том, насколько сильно ИИ может перевернуть наше общество. В 1993 году, несмотря на повсеместное распространение таксофонов и видеокассет VHS, намечались серьезные перемены. Вскоре после поступления в лондонский университет в том году мне завели самый первый в моей жизни адрес электронной почты и разрешили спуститься в душный подвал с рядами терминалов, чтобы подключиться к этой новой штуке под названием «интернет» (в 1993 году во всем мире существовало всего 130 веб-сайтов). Оглядываясь назад, можно заметить поразительные параллели между тем, как интернет (тогда) и ИИ (сегодня) постепенно внедрялись в нашу жизнь. Да простят меня те ученые, которые всерьез теоретизируют об эволюции технологий, я бы утверждал, что развитие как ИИ, так и интернета характеризуется тремя параллельными стадиями инноваций: дисфункциональной, забавной и незаменимой.
На первом, дисфункциональном этапе технология уже существует, но толком не работает. В 1990-х годах при использовании dial-up модема интернет-страницы загружались мучительно медленно, так что приходилось ждать несколько минут лишь для того, чтобы обнаружить, что вы забрели в какую-то бессмысленную кроличью нору. Для ИИ лучшим примером дисфункционального этапа служат, пожалуй, ранние цифровые ассистенты вроде Siri и Cortana. Они полагались на прописанные вручную правила для выполнения простых задач, таких как установка напоминаний или сообщение времени, но были настолько комично негибкими, что приходилось повторять запрос пятью разными способами, прежде чем они наконец понимали вас (и вносили в ваш календарь визит к стоматологу на три часа ночи). Большинство пользователей быстро научились отключать этих помощников или использовали их исключительно ради шутки (Siri могла отвечать даже на философские вопросы: если спросить ее, сколько будет ноль разделить на ноль, она выдавала забавный ответ с упоминанием монстра Коржика — но занудно повторяла одну и ту же реплику каждый божий раз).
На втором этапе технология все еще не приносит особой пользы, но эволюционирует во вполне забавную штуку. По мере того как в 1990-х годах интернет рос как на дрожжах, первые энтузиасты заполняли его страницами, посвященными своим главным раздражителям и эксцентричным хобби. Одним из излюбленных сайтов начала 1990-х был виртуальный симулятор рвоты — своего рода гастрономический интерактивный квест «выбери свое приключение», в котором можно было выбрать (из нескольких выпадающих меню), что вы съели и куда хотите все это извергнуть («блеволепно!»). На этом этапе — пожалуй, вполне объяснимо — многие отмахивались от интернета как от временного увлечения, а газета New York Times и вовсе окрестила его «гигантской дорожной развязкой в никуда». Ранний ИИ пошел по схожему пути. В начале 2020-х годов появились первые системы, с которыми (впервые в истории) действительно было весело поиграть. Моим фаворитом был Ask Delphi — чат-бот, который выносил суждение об этичности того или иного планируемого действия.[*1] По состоянию на 2023 год Delphi все еще в строю: если спросить его, что он думает о том, чтобы «покосить газон соседа, пока тот в отпуске, не спросив его разрешения», Delphi сурово упрекнет вас: «Это грубо» (хотя это, наверное, зависит от того, кто ваш сосед). В нашей семье в то время Delphi регулярно использовался в воспитательных целях (запрос «Отправить детей спать сразу после ужина» получал вердикт «Это нормально», что нравилось далеко не всем). К 2021 году художественные приложения на базе ИИ как раз становились повсеместной игрушкой — например, сайту под названием Dream можно было дать текстовый запрос на создание сносных пейзажей в стиле киберпанк-Толкина, изобилующих деталями, которые казались почти реальными объектами.[*2] Модели генерации изображений по тексту в этот период развивались стремительно и вскоре уже могли использоваться для создания плохого клипарта, а с 2021 года я сам начал использовать ИИ для создания иллюстраций к лекциям и выступлениям — с тем лишь досадным неудобством, что у людей на картинках обычно оказывалось по семь пальцев на руках, а лица часто выглядели оплывшими, напоминая жутковатого персонажа со знаменитого полотна Эдварда Мунка «Крик».
Наконец, в начале 2000-х годов интернет сначала стал полезным, а затем, в очень короткие сроки, абсолютно незаменимым. Этот порог был символически пройден в 1998 году с запуском поисковой системы Google, которая пообещала «организовать всю имеющуюся в мире информацию, сделав ее доступной и полезной для каждого», благодаря чему наконец-то стало возможно находить сайты, которые другие люди считали заслуживающими внимания. Google.com до сих пор остается самым популярным сайтом в мире: его посещают более 180 миллиардов раз в месяц. Еще одним поворотным моментом стало создание в 2001 году совместной онлайн-энциклопедии «Википедия». Сегодня «Википедия» остается своего рода чудом: она содержит более шестидесяти двух миллионов статей и держится на благотворительных пожертвованиях и армии онлайн-волонтеров, которые вносят в среднем пять правок в секунду (ирония в том, что статья в «Википедии» о ней самой содержит предупреждение редакции о том, что она написана в излишне рекламном тоне). Таким образом, к началу 2000-х годов интернет уже можно было использовать для поиска того, что вам действительно нужно было знать, причем делать это достаточно быстро и надежно. В сфере ИИ мы можем рассматривать публичный релиз ChatGPT в 2022 году как аналогичный переход через Рубикон. Внезапно ИИ перестал быть просто полусырой игрушкой или пафосной демоверсией, которую топ-менеджеры в водолазках гордо презентуют на помпезных технологических конференциях. ИИ стал доступен каждому, дома или на телефоне, и оказался действительно полезным для проверки фактов, решения математических задач и обобщения данных. Сегодня у ChatGPT более ста миллионов активных пользователей, а сайт OpenAI посещают чаще, чем Netflix, Pinterest или Weather.com.
Итак, что же дальше? Можем ли мы извлечь уроки из того, как интернет сформировал наше общество, чтобы получить хоть какое-то представление о волне новых технологий на базе ИИ, которая вот-вот накроет нас? Можем ли мы использовать историю цифровых технологий последних тридцати лет, чтобы предсказать следующие тридцать — или хотя бы следующие тридцать месяцев? Если мы посмотрим на историю интернета и на то, как ему удалось неразрывно вплестись в нашу жизнь, то увидим две основные тенденции. Здесь я утверждаю, что по мере того, как ИИ будет становиться незаменимым для каждого из нас, развернутся ровно те же два явления. Таким образом, изучение нашей цифровой истории может дать нам возможность заглянуть в будущее и понять, как системы ИИ будут постепенно вкрадчиво проникать во все аспекты нашего существования.
Первая тенденция — это персонализация. На заре интернета каждый пользователь шел по одним и тем же информационным магистралям и закоулкам. Но эта невинная эпоха давно ушла в прошлое. Сегодня результаты поиска в интернете, предлагаемые вам новостные статьи или посты, всплывающие вверху вашей ленты, адаптируются под вас алгоритмами, которые незаметно предугадывают ваше местоположение, ваши вкусы и даже ваши политические взгляды. Подобным же образом в ближайшие годы системы ИИ будут становиться все более персонализированными под конкретного пользователя. LLM будут обучаться говорить то, что вы хотите услышать, и делать то, что сделали бы вы сами. Они научатся имитировать социальное поведение, которое мы ценим в других людях, — такое как доброта, надежность и остроумие. Поступая так, они будут побуждать нас вверять свои жизни ИИ, делиться с ним самыми сокровенными подробностями и даже обращаться к ИИ в поисках полноценного общения. Нравится нам это или нет, но это неизбежно даст системам ИИ пугающую степень власти над нашей жизнью.
Вторая — это инструментальность. Инструментальный агент — это тот, кто стремится к достижению своих целей, то есть мотивирован на то, чтобы добиваться результатов. В первые годы своего существования интернет был преимущественно пассивным инструментом. Он служил своего рода эпистемическим водопоем, куда люди приходили, чтобы утолить жажду информации. Такие сайты, как «Википедия», этот нерушимый бастион достоверных фактов, остаются верны этому идеалу. Но остальная часть интернета сегодня — это гигантский торговый центр, телефон и кинотеатр, слитые в единое целое. Мы используем интернет для покупки товаров и услуг, для связи с друзьями и близкими, а также для круглосуточного стриминга развлечений. Точно так же в ближайшие годы мы увидим переход систем ИИ от роли простых поставщиков информации (когда ChatGPT и Gemini лишь отвечают на запросы) к роли инструментальных агентов, действующих от нашего имени. Поначалу эти действия будут ограничены цифровым миром: отправка электронных писем, планирование встреч или бронирование поездок. Но с распространением интернета вещей — благодаря которому обыденные предметы, такие как ваш автомобиль, холодильник и даже носки, теперь подключены к сети — влияние ИИ проникнет еще глубже во все наши дела, а его щупальца протянутся далеко в физический мир. Скрыться от этого будет трудно.
Движущей силой этих явлений выступает видение того, как именно ИИ будет использоваться в будущем (среди технологических компаний, соревнующихся в создании ИИ, сейчас в моде термин «форм-фактор»). Будет ли будущий ИИ чисто цифровым, живущим в вашем телефоне, или же он обретет физическое воплощение, превратившись в своего рода робота-дворецкого, бесшумно скользящего по вашему дому? Какими полномочиями он будет наделен — станет ли он просто давать вам советы или будет самостоятельно действовать от вашего имени? Какого рода отношения сложатся у вас с ним — где будут проходить социальные границы? Как системы ИИ будут взаимодействовать друг с другом и какую параллельную новую экономику это породит? Эти вопросы уже вызвали бесконечные дискуссии среди исследователей ИИ, социологов, философов и всех остальных, кто находится между ними. Но в одном, конечно, можно быть уверенным: форм-фактор ИИ будущего будет определяться тем, какие возможности откроются для монетизации этой зарождающейся технологии.
Самая очевидная и близкая коммерческая возможность, которую держат в поле зрения все технологические гиганты, заключается в том, что будущие системы ИИ будут выступать в роли цифровых помощников. Идея заключается в том, чтобы пользователи могли переложить рутинные жизненные задачи — оплату счетов, планирование давно назревшего визита к стоматологу, сортировку лавины электронных писем — на надежную и рассудительную LLM, высвобождая больше времени для отдыха или хотя бы для более интеллектуально сложных профессиональных задач. Независимо от того, как выглядит ваше представление о приятном времяпрепровождении — будь то лежание на пляже, обучение полетам на параплане, уход за бегониями, написание биографии или спасение жизней в операционной, — это, должно быть, кажется заманчивой перспективой. Разумеется, чтобы быть эффективным, ИИ-помощник должен достаточно хорошо вас знать (персонализация), чтобы действовать от вашего имени надлежащим образом (инструментальность). Таким образом, две тенденции, на которых я сосредоточу свое внимание, скорее всего, будут ускоряться коммерческими императивами, которые стимулируют развитие ИИ прямо сейчас, когда я пишу эти строки, и, без сомнения, продолжат двигать его вперед в ближайшем будущем.
Таким образом, те тенденции, которые характеризовали становление цифровых технологий на протяжении последних тридцати лет, вполне могут повториться по мере того, как ИИ будет становиться все более мощным и распространенным, и мы можем использовать их как призму, сквозь которую видно, куда ИИ движется прямо сейчас. Но нам также необходимо помнить, что ИИ — это принципиально новая технология. Его способность действовать автономно — делать что-то самому — делает его абсолютно непохожим на все, что человечество успешно создавало ранее. Он будет одновременно гораздо более мощным и гораздо более непредсказуемым, чем все предыдущие инновации. Следовательно, влияние этих тенденций и темпы их развития, по всей видимости, увеличатся многократно.
Пропустить примечания
*1 https://delphi.allenai.org/.
*2 Тоже по-прежнему доступно, но теперь выглядит действительно неплохо: https://dream.ai/create.