Цукерберг о Muse: взрыв ИИ-агентов, «метавселенная, умные очки и крупные модели» — три ключевых ставки сходятся

Tapbit Wire - Tapbit NewsTapbit Wire·Источник:ChainCatcher·
Поделиться

Три года назад генеральный директор Meta Марк Цукерберг в эфире Джо Рогана заявил, что однажды люди будут носить очки, а ИИ-агенты появятся соответственно. Сегодня эта картина, возможно, начинает реализовываться.

Персональный ИИ-агент Meta — Muse — достиг миллионов пользователей за две недели после запуска. В интервью 25 сентября Цукерберг отметил: «Такие ситуации случаются раз в несколько лет». Он назвал первые отклики на Muse «хитом с первой же попытки» — редкость в истории продуктов Meta.

Одновременно он объявил, что Muse будет интегрирован во всю линейку умных очков Ray-Ban, позволяя пользователям вызывать персонального ИИ-агента по собственному слову активации вместо фразы «Эй, Meta».

Метавселенная, умные очки и крупные модели, которые ранее воспринимались внешним миром как три независимые ставки, теперь ускоренно сходятся на уровне продуктов внутри Meta.

В этом интервью Цукерберг также признал провал Llama 4 «самым пугающим моментом» и сообщил, что Meta строит тренировочный кластер мощностью 5 гигаватт, полагая, что достаточная вычислительная мощность позволит «грубой силой» достичь ИИ общего назначения (AGI).

Цукерберг о Muse: взрыв ИИ-агентов,

Почему Muse смог «ударить хитом с первой же попытки»

Идея Muse возникла, когда Цукерберг вместе с сотрудниками Натом и Алексом «собрал» первую версию дома, используя открытые инструменты.

«Мы поняли, что это волшебный опыт», — сказал Цукерберг. — «Если сделать так, чтобы им мог воспользоваться каждый — без необходимости покупать Mac Mini или работать в терминале, — это заинтересует миллиарды людей».

Это понимание определило всю дальнейшую логику разработки: не просто обучение моделей, а полная самостоятельная разработка «сердцебиения» агента — от модели и каркаса до самого агента, который периодически просыпается, проверяет цели пользователя и сам инициирует выполнение задач.

Данные после запуска подтвердили это предположение: за две недели — миллионы пользователей.

Персональный ИИ: исполнение, память и «суждение»

Говоря о различии между персональным и общим ИИ, Цукерберг обобщил текущий фокус конкуренции как создание лучшего агента на основе модели.

«Главное за последний год — программирование агента», — отметил он. Умение программировать критично: даже если пользователь не пишет код напрямую, «ваш Muse будет писать код за вас в фоновом режиме для решения разных задач».

Однако, по его мнению, персональные агенты должны обладать не только возможностями программирования и выполнения задач, но и пониманием границ приватности и социальных контекстов.

Цукерберг привёл пример: когда пользователь просит Muse забронировать ресторан, агент может знать об аллергии или беременности, но это не означает, что такие данные следует автоматически раскрывать. «Вы хотите, чтобы задача была выполнена с минимальным раскрытием информации».

Он заявил, что эта способность относится к «базовым социальным навыкам или здравому смыслу», присущим людям, но многие компании не включают её в возможности своих моделей, если обучают только агентов для программирования.

«Мы обучаем всю модель целиком, а не просто берём чужую готовую модель и создаём вокруг неё фреймворк и агента», — сказал Цукерберг. Meta также добавила на уровне продукта такие функции, как память, отслеживание задач, анимация виртуальных персонажей и интерактивное голосовое взаимодействие в реальном времени.

Что касается персонализации, он отметил, что Meta считает: ИИ не должен иметь лишь одну фиксированную личность. «Многие лаборатории сосредоточены на том, как настроить личность до нужного состояния, но я никогда не верил, что для личности существует лишь один правильный ответ».

Он упомянул, что Muse позволяет пользователям изменять аватар, голос и базовые черты личности; цель проектирования модели — высокая управляемость. «Вы сами определяете, как хотите с ней взаимодействовать — это важно для персонального агента».

У каждого агента есть собственный «компьютер»

Одна из ключевых инфраструктурных особенностей Muse по сравнению с другими ИИ-продуктами — наличие у каждого агента защищённой виртуальной машины (Secure VM).

Цукерберг объяснил, почему это необходимо:

Ваш агент будет знать о вас множество конфиденциальных данных. Мы считаем, что эти данные не должны смешиваться в общей базе с информацией других пользователей.

Он сравнил Secure VM Muse с «компьютером, который находится только у вас под столом»: пользовательские данные шифруются и хранятся, а чувствительные учётные данные (например, пароли) управляются независимым модулем безопасности, к которому сам агент не имеет прямого доступа.

На этой основе Meta также разработала специальный защитный агент «Sentinel», который отслеживает потоки данных в Muse и из неё и напрямую блокирует операции и запрашивает подтверждение пользователя при обнаружении аномалий или высокорисковых действий.

Метавселенная, умные очки и агенты: три направления сходятся

Цукерберг сообщил в интервью, что Muse будет полностью интегрирована в линейку умных очков Ray-Ban и улучшит существующие способы взаимодействия.

Сейчас очки обеспечивают «одношаговый диалог»: вы говорите — получаете ответ — и всё. После интеграции Muse они станут передним интерфейсом для агента: когда пользователь говорит, бэкенд Muse продолжает работать в защищённой виртуальной машине, выполняя задачи и предоставляя обратную связь.

Говоря о дорожной карте продуктов для очков, он описал чёткую иерархию аппаратных решений:

  • Очки только для аудио без камер: уже оснащены Muse и способны обрабатывать звонки, музыку и голосовые задачи

  • Meta Ray-Ban с небольшим дисплеем: уже выпущены, обеспечивают базовую визуальную обратную связь

  • Прототип голографического AR с полным полем обзора: уже представлен, Цукерберг назвал его «очень впечатляющим»

Он отметил, что долгосрочные инвестиции Meta в очки дают компании преимущество после зрелости ИИ-агентов. Meta внедряет Muse и другие ИИ-функции в очки, тогда как технологии метавселенной, ранее делавшие акцент на «присутствии», продолжают развиваться, хотя сейчас больше ресурсов направлено на Muse и ИИ-возможности умных очков.

Что касается виртуальных аватаров, Цукерберг отметил, что раньше для создания высококачественных реалистичных аватаров Meta требовалось оборудование для сканирования помещения, многокамерная система и серверные GPU; теперь пользователи могут настроить аватар по нескольким фото, а соответствующие функции работают даже на паре VR-очков.

Глядя вперёд — к 2030 году, Цукерберг заявил, что основная цель метавселенной остаётся объединение физического и цифрового миров. Он привёл пример: в будущем люди смогут участвовать в совместных мероприятиях с друзьями через голографические образы; на рабочих сценариях люди и несколько агентов смогут участвовать в групповых чатах или совещаниях, где агенты будут представлены в голографической или иной воплощённой форме.

«Самый пугающий момент»: ошибка Llama 4

Не все ставки прошли гладко. Цукерберг редко прямо говорил об ошибке Llama 4 в интервью.

После Llama 4 это был самый пугающий момент… Я думал, что мы идём правильным путём, но нет. Это стало серьёзнейшим негативным сюрпризом.

Он связал проблему с фундаментальной ошибкой в структуре команды:

Я организовал команду так же, как команду рекомендательной системы Instagram или рекламной системы — сотни или тысячи людей работали параллельно. Но обучение языковой модели требует небольшой команды, тесно взаимодействующей как единый научный проект. Каждая позиция чрезвычайно важна.

В результате Meta полностью перестроила структуру: привлекла лучших специалистов отрасли и создала Лабораторию сверхразума Meta (MSL). Цукерберг заявил, что новое поколение моделей скоро выйдет, но не будет анонсировано на конференции Connect.

Путь вычислительных мощностей: «грубая сила» для ИИ общего назначения; строится проект на 5 ГВт

Говоря о технологическом пути к ИИ общего назначения, Цукерберг дал прямую оценку.

Я не уверен, какие фундаментальные архитектурные прорывы ещё нужны… В целом формулу мы знаем. Если построить достаточно крупный кластер суперкомпьютеров, можно достичь цели методом «грубой силы».

Сейчас путь расширения вычислительных мощностей Meta: кластер мощностью свыше 1 ГВт в Огайо уже почти введён в эксплуатацию для обучения следующего поколения моделей; кластер на 5 ГВт в Луизиане находится в стадии строительства.

Он заявил: «Обладая кластерами мощностью в несколько гигаватт для обучения, вы практически достигаете ИИ общего назначения или даже сверхразума».

Однако он также добавил, что текущий путь, основанный на вычислительных мощностях, вовсе не означает неважность архитектурных исследований —

Человеческий мозг потребляет около 10 Вт, тогда как наши системы могут быть в миллион раз менее эффективны. Только сочетание масштабных вычислительных мощностей и архитектурных прорывов позволит по-настоящему лидировать.

Согласованность — не бремя, а задача, которую должны решать продукты

Отношение Цукерберга к безопасности ИИ весьма прагматичное: он не воспринимает её как регуляторное давление, а считает обязательным условием успеха продукта.

Если вы просите Muse выполнить что-то, а она делает наоборот — кто вообще будет ею пользоваться? Мы должны обеспечить, чтобы модель не просто понимала ваши конкретные инструкции, но и улавливала ваши намерения и ценности.

«Если Muse должна достичь миллиарда пользователей, мы обязаны решить проблему согласованности или добиться в ней существенного прогресса», — сказал он.

Касаясь границ безопасности в процессе обучения, он привёл аналогию: «Это как родители, устанавливающие правила для детей — если ИИ «решает» программную задачу, меняя системные настройки, я хочу сказать ему: нет, я хочу, чтобы ты освоил метод решения, а не искал обходной путь».

Цукерберг о Muse: взрыв ИИ-агентов

Полная версия интервью ниже: >

Крупные ставки

Ведущий: Это то, чем захотят пользоваться миллиарды людей. Каково это — создавать? Возможна ли «бессмертие»? Представьте, что я проникаю в ваш разум и переношусь в 2030 год — как это будет выглядеть?

Это Марк Цукерберг. Двадцать два года назад он создал социальную сеть, объединившую миллиарды людей и навсегда изменившую мир. Сейчас он решил построить нечто ещё более масштабное. Для этого он делает крупные ставки в области метавселенной, умных очков и искусственного интеллекта. На протяжении многих лет скептики считали эти три направления отдельными, малоперспективными проектами, но упускали из виду общую картину — ведь сегодня эти ставки объединяются, формируя совершенно новую сверхинтеллектуальную систему.

Сегодня мы расскажем обо всём этом, а я задам Марку вопросы, на которые он ещё никогда не отвечал, чтобы вы могли услышать его видение будущего и опередить всех, создав следующий прорыв.

Ведущий: Большое спасибо за участие в шоу.

Марк: Спасибо, рад быть здесь.

Ведущий: Чтобы подготовиться к этой беседе, я посмотрел все ваши интервью.

Марк: Вау, я сам их просмотрел меньше.

Ведущий: Было увлекательно и очень полезно. Два момента особенно запомнились: во-первых, ваша любовь к «созданию» — вы, безусловно, один из лучших создателей; во-вторых, ваша способность делать смелые ставки — вы решаетесь на грандиозные проекты. На этой неделе все эти ставки совпали, так что начнём именно с этого.

Марк: Хорошо. Мы занимаемся этим давно. Что касается ИИ, компания развивает эту сферу почти с самого основания — первая версия ленты новостей по сути была продуктом машинного обучения. А около 15 лет назад мы создали исследовательскую лабораторию ИИ.

Но сейчас мы вступили в новую фазу — около года назад запустили Лабораторию сверхинтеллекта Meta. Это масштабный перезапуск исследований с привлечением множества талантливых специалистов отрасли — очень вдохновляюще. Сейчас модели постоянно улучшаются, и скоро выйдет следующее поколение — но оно не будет представлено на конференции Connect. Кроме того, у нас есть персональный помощник Muse, который пока получает исключительно положительные отзывы.

Создавая подобные системы, вы заранее не знаете, каким будет результат. Нам это нравится. Ранее в этом году я собирал Open Claw у себя дома, экспериментируя самостоятельно, чтобы понять, как это работает и как превратить в волшебный опыт для любого пользователя.

По сути, когда мы — я, Нэт и Алекс — вместе осознали, что это действительно волшебный опыт, и решили сделать его готовым к использованию «из коробки», доступным даже тем, кто не разбирается в технологиях, не хочет самостоятельно настраивать Mac Mini, не желает работать в терминале и не готов отлаживать сбои, я понял: это то, чем захотят пользоваться миллиарды людей.

С тех пор мы целенаправленно работаем над этой целью: адаптируем модели специально для Muse, создаём не только самого помощника и его операционную среду, но и технологию, обеспечивающую каждому помощнику независимую вычислительную среду — для этого мы разработали целый набор защищённых виртуальных машин Muse.

Внутри компании мы чувствовали: это особенный продукт, команда им в восторге, но реакция пользователей после релиза всегда остаётся загадкой. Иногда бывает потрясающий успех с первого дня, но чаще — сначала поступают положительные отзывы, а затем требуется несколько итераций, чтобы продукт «защёлкнул». В этот раз он защёлкнул мгновенно. Увидеть всё это — настоящее волнение: всего за две недели число пользователей уже достигло миллионов — такое случается крайне редко. Подобные ситуации происходят раз в несколько лет, но это, безусловно, один из самых приятных моментов для стартапа.

Ведущий: Ваша способность оставаться в игре и продолжать пробовать по-настоящему впечатляет. А количество ваших успешных проектов — просто удивительно. Три года назад в интервью Джо Рогану вы упомянули, что однажды сможете носить очки, а ИИ-помощник будет появляться прямо перед вами. Поэтому мне кажется, что у Muse уже есть физическое воплощение — очень удачное решение, ведь такое ощущение неизбежно возникнет.

Марк: Мне кажется, это просто делает ИИ дружелюбнее и милее. Слишком многие описывают ИИ как нечто пугающее, но он должен быть полезным и увлекательным. Физическое воплощение — дизайнер создал этого персонажа на раннем этапе проекта, и команда хотела его доработать, но первая версия оказалась лучшей. Позже кто-то сказал: «Он должен быть синим — ведь это Meta». Я ответил: «Нет, именно это воплощение идеально — вы попали в цель с первого раза». Так и есть — это весело.

Чем персональный ИИ отличается от общего ИИ?

Ведущий: Отличные детали. Если вы хотите, чтобы модель отлично справлялась с персональными задачами, а не просто была общей ИИ-системой, как изменится подход к её обучению?

Марк: Думаю, ключевой задачей сейчас является превращение модели в превосходного «агента». За последний год главным трендом стало программирование агентов — в нём заложены две основные идеи: экспертные навыки программирования и общая способность быть выдающимся агентом.

Наша стратегия — сделать самого агента по-настоящему качественным, а не сосредотачиваться исключительно на программировании.

Программные возможности важны: даже если пользователи не считают, что пишут код, Muse постоянно генерирует его в фоновом режиме, чтобы выполнять для вас разные задачи. Однако мы считаем, что агент должен сначала быть выдающимся агентом, а программные функции служат этой цели.

Кроме того, при создании персонального помощника некоторые аспекты важнее, чем разработка корпоративных ПО. Например, при создании корпоративного инструмента программирования модели не нужно понимать «масштаб раскрытия информации» — какие данные можно озвучить, а какие — нет. Для Muse это критически важно.

Эту способность необходимо обучать так же, как и любую другую. Вы сообщаете модели многое, надеясь, что она поможет вам достичь целей. Например, при бронировании ресторана Muse знает ваши аллергии или беременность, но должна выполнить задачу, раскрывая минимум информации — это конкретный навык, базовый социальный здравый смысл.

Компании, создающие только программные агенты, обычно не обучают эту способность. Мы можем это делать, поскольку работаем «под ключ»: не используем готовые модели, а обучаем модель с нуля специально для этих возможностей.

Модель обязательно должна обладать широким общим интеллектом, но также и этими специфическими навыками. На этой основе строится весь помощник и все детали вокруг него: память, операционная среда и механизм «пульсации» — периодического пробуждения для проверки: «Вот цели, которые я понял о вас; могу ли я сейчас продвинуть их вперёд?»

У нас есть отдельная команда, полностью отвечающая за тонкую настройку анимации виртуального представления: оно не шаблонное — вы можете задать любое представление, и оно будет двигаться естественно. Также запускаем голосовой режим для реального общения с помощником рядом с вами. Все эти детали возможны благодаря нашему «под ключ»-подходу: модель и продукт разрабатываются совместно.

Ведущий: Ещё один важный элемент — виртуальная машина. Почему она важна и какие возможности открывает?

Почему Meta предоставляет каждому ИИ-помощнику отдельный компьютер?

Марк: По сути, чтобы агент мог действовать за вас, ему нужна площадка для хранения вашей информации. Мы считаем, что она не должна смешиваться с чужими данными в общем пуле ресурсов.

Представьте так: ваш помощник знает много конфиденциальной информации о вас. Многие пользователи первых ИИ-агентов (например, OpenCloud) устанавливают дома Mac Mini. Мы подумали: не все хотят покупать и настраивать Mac Mini самостоятельно. Какой опыт максимально приближён к этому? Ответ: достаточно скачать приложение, зарегистрироваться и получить выделенный компьютер для вашего помощника — для работы, хранения данных и построения вокруг них защищённой модели. Это как собственный компьютер под столом — даже Meta не имеет к нему доступа.

Например, конфиденциальная виртуальная машина Muse — это разрабатываемая функция, содержимое которой даже мы не видим.

Мы также реализовали множество связанных решений, например безопасное хранение учётных данных: когда помощнику нужны пароли, он сам их не видит — просто вставляет их по вашей команде при входе в сервис, и только тогда, когда вы явно запросили это. Система спроектирована так, чтобы такие данные были недоступны случайно: из-за взлома или сбоев.

Поэтому необходимо гарантировать, что ни агент, ни Meta не могут получить доступ к этим данным. Предоставление каждому помощнику отдельного компьютера и максимизация безопасности — фундамент этой технологии: она наделяет Muse возможностями для помощи пользователям при полной приватности и защите, делая её мировым лидером в этой области.

Ведущий: Значит ли это, что данные в виртуальной машине, к которой подключается Muse, шифруются, как в WhatsApp? Как правильно понимать фактическое хранение данных в ВМ?

Марк: Мы создали две версии. Защищённая виртуальная машина Muse (Secure VM) включает различные функции приватности, в том числе всю архитектуру агента Sentinel. У вас есть обычный помощник Muse, выполняющий задачи, и одновременно — агент безопасности Sentinel, который контролирует поток данных в и из вашей Muse.

Если внешний контент пытается нарушить безопасность, Sentinel мгновенно блокирует его. Если Sentinel считает, что Muse собирается совершить действие, требующее вашего подтверждения, он переопределяет операцию Muse и вызывает предупреждение: «Вы действительно хотите, чтобы Muse это сделал?»

Вся эта система в сочетании с безопасным хранением учётных данных и многоуровневой защитой и составляет защищённую виртуальную машину Muse.

Мы также разрабатываем ещё один проект. Нэт и я лично пригласили Мокси Марлинспайка — автора сквозного шифрования в WhatsApp — спроектировать конфиденциальную виртуальную машину Muse (Confidential VM). Основная идея — добавить к защищённой ВМ ваш личный ключ шифрования, чтобы даже Meta не могла получить доступ к её содержимому.

Эта версия сложнее в реализации: если Meta не может просматривать внутренности ВМ, отладка и обеспечение стабильности становятся значительно труднее. Мы потратили на это время, но скоро запустим. Это обеспечит уровень безопасности, знакомый пользователям WhatsApp и наших самых защищённых продуктов.

Ведущий: Преимущество такого подхода — лишь психологическое ощущение безопасности или есть и реальные выгоды?

Марк: Безопасность важна сама по себе. Наша цель — приблизиться к ощущению наличия локального устройства под вашим столом. Что даёт вам такое устройство? То, что ни одна компания не может получить к нему доступ.

Итак, если Meta хочет предоставить вам эту услугу, как обеспечить тот же уровень конфиденциальности и безопасности, чтобы ни одна компания — будь то Meta, злоумышленники или местные власти в странах, где им не доверяют, — не могла получить доступ? Ведь и мы сами не имеем к нему доступа: у нас просто нет прав.

Я считаю это чрезвычайно важным — одна из ключевых причин, почему пользователи доверяют WhatsApp. Конфиденциальность, безопасность и доверие действительно ценны.

Если у вас будет ассистент, знающий о вас всё — а, вероятно, почти у всех он будет — через пять лет каждый получит ассистента, понимающего ваши цели и всё о вас, способного помогать решать задачи. В этом контексте лидерство в области конфиденциальности и безопасности особенно важно. Мы стремились к этому с самого начала.

Как формировать личность ИИ?

Ведущий: У вас интересная особенность — вы изучали психологию в университете.

Марк: Да, но всего два года — однако это сильно повлияло на мои последующие разработки.

Ведущий: Говоря о моделях, мы часто называем их «очень умными». Но при выборе друзей решающим фактором является не только ум, но и то, нравится ли нам их энергетика и стиль общения. Как вы подходите к формированию личности модели?

Марк: Идеальная модель должна быть достаточно адаптивной, чтобы соответствовать стилю разных людей. Многие профессионалы в отрасли пошли по неверному пути: они сосредоточены на «правильном» проектировании личности, тогда как я никогда не считал личность чем-то фиксированным. Именно поэтому я твёрдо верю в открытый исходный код и в способность пользователей настраивать продукты под себя — и именно поэтому Muse создавался как максимально персонализируемый продукт.

Вы можете настраивать и персонализировать Muse — не только изображение и голос; при первой регистрации первым вопросом будет: «Какой базовый характер вы хотите задать мне?», и изменить его можно в любое время.

Мы стремимся сделать модель высокоуправляемой, позволяя вам определять, как именно вы хотите взаимодействовать. Это ключевой элемент превращения её в отличного личного ассистента — гибкость в формировании личности имеет решающее значение.

Ведущий: А какой стиль у вашего личного Muse?

Марк: Я сделал его прямолинейным и ориентированным на эффективность — довольно забавно. Ранние версии были саркастичными и юмористическими, а эта — более прямая. Мой ассистент использует стандартное изображение Muse, но я одел его в тогу и дал глубокий до комического голос — общаться с ним весело.

Ведущий: Чтобы обладать чувством юмора, нужно быть по-настоящему умным. Многие не осознают, что комики — одни из самых умных людей в обществе: им необходима быстрота реакции и остроумие. У вас этот талант точно есть. Я посмотрел все ваши интервью — вы всегда производите отличное впечатление.

Неожиданные прогнозы Марка об ИИ и метавселенной

Ведущий: В интервью с Тео вы много говорили о следующем технологическом рубеже и о том, куда всё это движется в конечном счёте. В сфере ИИ уже бывали несколько «зимних» периодов, когда считали, что прорывов не будет. Такие периоды переживала и метавселенная — многие воспринимали её как несбыточную ставку. Вчера я попробовал новую голографическую функцию — она потрясающая. В интервью с Лексом казалось, что сканирование лица займёт 11 часов, а теперь — всего 3 минуты. Как мы достигли этого сегодня?

Марк: В общем развитии метавселенной, когда мы основали Reality Labs, мы всегда верили, что в итоге появятся очки нормального внешнего вида, которые со временем станут не только средством для полного погружения, но и мощными ИИ-устройствами — ведь очки — единственный форм-фактор, способный видеть то, что видите вы, слышать то, что слышите вы, общаться с вами весь день и отображать изображения.

Но 10–15 лет назад я предполагал, что сначала появится голографическая технология, а затем — развитый ИИ. Однако путь технологической эволюции оказался иным: ИИ и персональный суперинтеллект появились первыми, а затем — технологии, позволившие сделать голографию массовой и доступной. Этого я не предвидел, но рад, что прогресс идёт сразу в двух направлениях.

Наши значительные инвестиции в очки ставят нас в выгодное положение сейчас, когда ИИ-ассистенты готовы к внедрению. Многие анонсы на конференции Connect касались интеграции Muse и множества ИИ-функций в очки — думаю, пользователям это очень понравится. Это действительно важно.

Что касается присутствия, мы продолжаем двигаться вперёд, но темпы относительно невысоки, поскольку основная часть наших ресурсов ушла на разработку Muse и ИИ-функций для очков. В то же время у нас есть долгосрочный проект — создание высокоточных виртуальных аватаров в реальном времени.

Как вы сами отметили, три–четыре года назад для захвата человека с разных ракурсов требовалась целая сканирующая комната, а для рендеринга — серверные видеокарты уровня предприятия, что было крайне громоздко. Демонстрация, которую мы показали в подкасте Лекса, как раз использовала такую конфигурацию. А сегодня мы уже запускаем это в паре VR-очков — это первые очки, способные обеспечить столь впечатляющий VR-опыт без массивного шлема. Создать виртуальный аватар теперь можно всего по нескольким фотографиям, и прогресс поразителен.

Ведущий: Кроме того, он может имитировать мимику на основе голоса. На демонстрации это заставило меня рассмеяться, вовлекло в интерактив и позволило понять, как движется моё лицо в синхронизации с аудиодорожкой. Вы упомянули в том подкасте, что некоторые обычно сдержанные в выражении эмоций люди хотят проявлять более насыщенную мимику в виртуальном мире. Как вы считаете, люди будут чётко различать «виртуальное „я“» и «настоящее „я“»?

Марк: Я думаю, мы пока находимся на ранней стадии понимания этого феномена с социологической и психологической точек зрения. Чувство собственной идентичности и образ, который человек хочет представить миру, зачастую несколько отличаются от его реального «я». С момента появления соцсетей люди тщательно выбирают свои аватары. Мы наблюдаем аналогичные явления и с виртуальными образами Muse. Речь идёт не столько о «кураторстве самого себя», сколько о «кураторстве» того «человека», с которым вы хотите взаимодействовать.

Я считаю, что когда вы даёте людям возможность самовыражения, важно, чтобы это действительно отражало их личность, одновременно являясь самостоятельной формой самовыражения, а не просто зеркальным отражением — это и общение, и выражение одновременно. Мы стремимся создать баланс между этими двумя аспектами. Это всегда итеративный цикл: наблюдение за тем, как люди пользуются продуктом, и последующее его совершенствование. После многолетней работы мы наконец подошли к стартовой черте — впервые можем интегрировать в продукты достаточно качественные реалистичные аватары, работающие как на смартфонах, так и в VR. Мне очень интересно увидеть результаты.

Каким будет 2030 год?

Ведущий: Хорошо, давайте заглянем в ваше видение — представим, что сейчас 2030 год и всё идёт по плану. Какой станет голограммная технология? Как она объединится с Muse и очками?

Марк: Моя интерпретация видения метавселенной всегда сводилась к эффективному объединению физического и цифрового миров. Основная идея такова: у нас есть прекрасный физический мир и удивительный цифровой мир — огромный объём контента, накопленного в интернете за последние 20–30 лет, поражает воображение. Однако способы доступа к нему ограничены: либо мы сидим за столом, либо пользуемся маленьким экраном в кармане — это принципиально ограниченный подход.

Я считаю, что идеальный вариант — это бесшовная интеграция физического и цифрового миров. Представьте: сейчас мы с вами здесь. В будущем один из нас может быть голограммным проекционным образом, но при этом вы по-прежнему будете ощущать настоящее чувство присутствия друг друга — это совершенно иное ощущение по сравнению с видеозвонком.

Суть виртуальной реальности — передать именно это ощущение присутствия: почувствовать, что вы реально находитесь в одной комнате с другими людьми или в другом месте. Этого можно достичь с помощью голограммных технологий и различных способов их интеграции. Например, я могу играть в покер с друзьями: одни будут физически присутствовать, другие — присоединятся через голограммы и смогут участвовать в игре; сам покерный стол тоже может быть голограммным, позволяя интегрировать тех, кто не находится в помещении.

Одновременно ИИ также может получить воплощение и появиться в этом сценарии. Это особенно логично в рабочих контекстах — я сейчас активно использую различные программные агенты для создания продуктов. Представьте: у вас есть групповой чат с несколькими людьми и несколькими агентами, и вы распределяете задачи между ними. Иногда все собираются на совещании — и агенты тоже должны присутствовать. Как они появятся? Просто добавьте ещё несколько мест на диване — и они появятся как голограммы. Или используйте милого персонажа из Muse, дракона или любой другой забавный образ, который вы создадите.

Думаю, в будущем это будет казаться вполне естественным.

Ведущий: Интересно. В предыдущих интервью вы отмечали, что индустрия часто забывает о «веселье». Мне кажется, наличие физического помощника сделает всё ещё реальнее — это похоже на настоящий аутсорсинг задач. Когда вы видите, как Muse печатает, создаётся ощущение, что что-то действительно происходит. Это реализовано хорошо — вы видите, что происходит в браузере. Так что существует ли вероятность сценария, при котором вы надеваете очки и управляете компьютером, а Muse помогает вам выполнять задачи на ПК?

Марк: Да, безусловно. VR уже позволяет это делать. Можно сидеть где угодно — даже в кафе — и открыть рабочее пространство с шестью мониторами для написания кода; всё необходимое будет на месте.

Что касается очков, то наиболее популярная на данный момент модель не имеет дисплея — это делает её более доступной и позволяет большему числу людей её использовать, хотя мы продолжаем работать над миниатюризацией дисплеев. Тем не менее мы уже выпустили версию Meta Ray-Ban с дисплеем — она пользуется большой популярностью; это небольшой дисплей. Также мы представили прототип полноэкранной голограммной AR-системы, который, как мне кажется, будет весьма впечатляющим.

Таким образом, вся линейка продуктов выглядит следующим образом: от чисто аудио-очков — без камер, внешне ничем не отличающихся от обычных очков, но внутри которых работает Muse с различными аудиоинструментами, воспроизведением музыки и звонками — до более продвинутых моделей.

Ведущий: Интересно, а с этими аудио-очками можно разговаривать с Muse, поручая при этом выполнение задач домашнему компьютеру?

Марк: Да, конечно. Эта функция только что запущена на конференции Connect. Теперь все очки подключены к Meta AI, обеспечивая «одношаговый» опыт — вы отправляете запрос, получаете ответ и всё. А с Muse мы планируем обновить все очки до платформы Muse. Во-первых, вам больше не нужно произносить «Эй, Meta» — вы можете задать любое имя, и это часть удовольствия. Затем вы просто говорите с ним напрямую, он подключается к вашему Muse, а тот выполняет задачи в вашей защищённой виртуальной машине, помогая вам решать поставленные задачи.

Ведущий: Это потрясающе!

Мышление основателя

Ведущий: Ладно, мы сейчас здесь. Muse развивается успешно, очки тоже показывают хорошие результаты. Но около года назад многие задавали вопрос: «Что случилось с Лабораторией сверхразумного ИИ?» Как вы тогда себя чувствовали? Каково было переживать период неудач, сохраняя при этом долгосрочное видение?

Марк: Настоящая проблема возникла с проектом Llama и Llama 4.

Llama 1 стала весьма интересной моделью: она задала вектор всего открытого ИИ-движения, и мы гордимся ею. Llama 2 обеспечила масштабируемость, Llama 3 — отличная модель, почти на переднем крае технологий своего времени. А вот Llama 4 отклонилась от правильного пути развития.

Когда что-то идёт не так, как я ожидал, я долго размышляю: почему так происходит? Что нужно изменить, чтобы добиться лучшего результата? В этот раз я понял: я ошибся со структурой команды.

Я построил её по аналогии с работой над ML-системами ленты Instagram или рекламными системами — сотни или даже тысячи людей параллельно решают множество задач. Но для создания языковых моделей нужна чрезвычайно сплочённая небольшая команда, работающая как единый научный коллектив. Людей требуется немного, но каждый сотрудник в такой команде — крайне ценен.

Поэтому мы собрали лучших специалистов из Meta и привлекли талантливых профессионалов со стороны, создав совершенно новую команду — Лабораторию сверхразумного ИИ Meta.

С моей точки зрения, с запуском MSL я понимал: потребуется время на перезапуск, восстановление инфраструктуры и обучение следующего поколения моделей. Но я знал, что у нас собрана отличная команда, и если она будет слаженно работать, результат будет хорошим.

Для меня самый захватывающий момент наступил после выхода Llama 4: я думал, что движемся в правильном направлении, а потом понял — нет. Это был серьёзный негативный сюрприз. Думаю, предприниматель постоянно проходит такие испытания: ведь не всё может идти гладко. А то, что действительно определяет вектор развития, — это способность найти путь вперёд, когда события развиваются не так, как хотелось бы.

Ведущий: Наверное, работает и обратный эффект: когда что-то превосходит ожидания — например, запуск Muse. Как вы используете такую возможность?

Марк: Безусловно. Сейчас вся компания включена в проект: изначально это была небольшая команда, создававшая продукт, а теперь все осознают, что он готов выйти на большую сцену. Вся компания думает, как масштабировать его и как дать возможность сотням миллионов людей им воспользоваться.

От оптимизации всей инфраструктуры для бесперебойной работы и максимального использования вычислительных мощностей существующих GPU до интеграции Muse различными продуктовыми командами — например, в очки. Видеть, как все работают сообща, чтобы Muse могла масштабироваться без сбоев, — это потрясающее ощущение.

Как Марк формулирует и доносит своё видение

Ведущий: Как основатель, вы, наверное, ждали этого момента больше всего — когда всё складывается воедино. Как вы доносите своё видение до компании? С учётом множества одновременных процессов, мне кажется, вы много пишете. Каков ваш подход?

Марк: Письмо для меня очень полезно: оно помогает уточнить мысли и донести их внешним аудиториям. Этим летом я написал объёмную статью «Будущее принадлежит всем» — около 15 страниц. В ней я системно обозначил свою философскую позицию по ключевым социальным вопросам, связанным с ИИ: что я считаю ценным, как строить взаимодействие с государством, как снять опасения людей, как сделать дата-центры благом для общества, создавать рабочие места, а не разрушать их, как обеспечить национальную безопасность и эффективно снизить риски — будь то хакерские атаки или биобезопасность.

Это чрезвычайно сложный процесс, требующий длительной работы, множества внутренних обсуждений и итераций правок с коллегами. Но для меня он оказался чрезвычайно ценным. В итоге мы получили документ объёмом 15 страниц: «Вот во что мы верим». Затем я сократил его до одной страницы для публикации в виде колонки. Также мы выпустили короткое видео: ведь чтобы достучаться до многих, часто не нужны теоретические рассуждения — достаточно чётко сформулировать свои ценности, убеждения и способы их выражения.

Нет универсального способа доносить подобные идеи до компании или мира. Разные моменты требуют разных подходов, а разные аудитории могут по-разному относиться к вашим инициативам: кто-то сразу созвучен, а кому-то требуется дополнительное объяснение ценности проекта. Я считаю это частью управления компанией и ролью основателя: вы не просто повторяете одно и то же — каждая ситуация уникальна, стоят новые вызовы, и именно это делает работу интересной.

Что побуждает Марка создавать?

Ведущий: Мне кажется, ваше мышление основателя выходит за рамки компании — будь то ваша ферма или освоение нового навыка.

Марк: Мне просто нравится создавать вещи.

Ведущий: Что для вас значит «создавать»?

Марк: Думаю, это врождённая потребность. У разных людей разные способы самовыражения. Если вы писатель, вы чувствуете, что обязаны писать. У кого-то сильна потребность в признании. А мне просто нужно создавать вещи. Если я не реализую своё творчество или не строю что-то новое, я становлюсь раздражительным — и это неприятно для окружающих.

Ведущий: Освоение мастерства горнолыжника — это тот же навык, что и создание продукта?

Марк: Отчасти да: процесс освоения новых навыков во многом схож. В жизни я намеренно бросал себе вызовы в областях, где был слаб. Например, мне всегда было трудно учить языки. Именно поэтому я начал изучать латынь — французский и испанский в классе у меня не шли, и я подумал: «Латынь не требует устной речи, только перевода — как математика».

Позже, когда я возглавил компанию, я ставил себе ежегодные цели — одна из них была освоить мандаринский. Он действительно сложен, особенно тоны. Конечно, есть веские причины его изучать: бабушка Присциллы говорит только на мандаринском, так что мне нужно овладеть им, чтобы общаться с ней. Но главная мотивация — сам вызов.

Все эти навыки можно освоить только практикой: никаких «якорных точек понимания» не существует. Нужно просто вкладывать время — и со временем знания постепенно проникают в сознание. То же с боевыми искусствами и обучением управлению вертолётом: их сложно «понять» рационально — требуется практическое накопление.

Создание продуктов частично аналогично. Программирование можно осмыслить теоретически, но интуиция в проектировании продуктов формируется только через многократную практику. Главный вопрос — что вам по душе: ведь, по моему мнению, не у всех такая сильная потребность в создании, как у меня; у большинства она есть в какой-то степени, и важно её обнаружить, а затем вкладывать время, чтобы преуспеть в том, что действительно хочется делать.

Честно говоря, это не просто «желание», а глубинная психологическая потребность или внутренний импульс. Важно направить этот импульс на конкретное дело и дать себе время, чтобы опыт постепенно усваивался и закреплялся. Этому я стараюсь учить и своих детей: помогать им найти настоящее увлечение, а при застое — мягко подталкивать.

Одна из моих дочерей обожает сочинять музыку, но терпеть не может занятия по фортепиано. Я сказал ей: «Тебе необязательно становиться виртуозом, но если ты хочешь сочинять музыку, тебе нужна интуитивная основа — понимание теории и её работы. А освоив фортепиано, ты легко перейдёшь к гитаре». Думаю, будь то ребёнок, которому родитель даёт толчок, или взрослый, способный собраться и позволить знаниям постепенно усвоиться, — ключевое здесь именно это.

Золотой век создателей

Ведущий: Мне кажется, что все хотят создавать. Я не считаю поколение Z таким безынициативным, как его порой рисуют. Люди просто ищут искру, которая зажжёт их творческий потенциал. Вы много говорили об этом в своей речи в Гарварде.

Марк: Да. Под «созданием» я в первую очередь имею в виду продукты — ПО, аппаратные решения и т.д. Но согласен: у каждого есть творческий импульс. Однако у некоторых доминируют другие черты характера: например, ориентация на служение — врачи и медсёстры движимы желанием «заботиться о других».

Я слышал историю — возможно, от Присциллы, из её опыта в медицинской школе: в первый день занятий кто-то спросил: «Сколько из вас помнят детские воспоминания, когда, увидев человека, думали: „Мне очень хочется о нём позаботиться“?» И все подняли руки. Моя версия такова: у меня множество детских воспоминаний о мысли: «Я хочу сделать эту вещь лучше».

Не у всех одинаковая мотивация, но у каждого есть что-то, что он хочет делать. Согласен: раньше технологии затрудняли старт многим. Вот что особенно вдохновляет меня в персональном сверхинтеллекте Muse и различных ИИ-ассистентах — впервые в истории люди могут начать быстро. Есть смутная идея — ИИ поможет её структурировать, а дальше вы будете её дорабатывать, как скульптор — без необходимости понимать всё до начала.

Это чрезвычайно мощно: многие найдут то, что хотят создать или продвинуть, — и почувствуют более широкое ощущение собственной эффективности.

Как далеко мы от победы над всеми болезнями?

Ведущий: Ещё один ваш проект вне Meta — победа над всеми болезнями. Интересно: насколько мы реально близки к этой цели?

Марк: Гораздо ближе, чем раньше.

Ведущий: А реалистично — насколько близки?

Марк: Когда мы запускали проект, цель была — помочь научному сообществу одолеть все болезни к концу века. Мы сами этого не сделаем: наша гипотеза такова — любые крупные научные прорывы предшествуют появлению новых инструментов для измерения и понимания явлений. Например, изобретение микроскопа позволило понять бактерии, а телескоп — Вселенную.

Некоторые из этих инструментов стали платформами: например, первое вакцинное средство дало людям метод для лечения множества заболеваний.

Однако исторически распределение научного финансирования было весьма децентрализованным, что позволяло исследователям работать независимо; при этом мало средств выделялось специально на создание крупномасштабных инструментов. В Biohub мы стремимся разработать несколько новых инструментов, позволяющих «видеть» биологию по-новому и тем самым ускорять научный прогресс.

Изначально мы считали, что цель «к концу этого столетия» вполне достижима, тогда многие биологи полагали её невозможной. Сейчас же мне кажется, что конец столетия — это слишком далеко.

Прогресс ИИ в сочетании с нашими виртуальными клеточными моделями: основная идея — проводить эксперименты не на реальных живых клетках, а использовать ИИ-модели для симуляции белков, затем клеток, далее — виртуальной иммунной системы или даже целого организма, включая человека. Это позволит учёным проводить множество экспериментов, моделируя последствия различных условий — например, реакции в организме при приёме определённого препарата.

Я не хочу называть точный год, но, скорее всего, это произойдёт значительно раньше конца столетия.

Ведущий: Цель «победить все болезни» звучит осознанно, а не как «бессмертие». Возможно ли бессмертие?

Марк: Это не моя специализация. Я считаю, что эти понятия различны. «Бессмертие» связано скорее с продлением жизни — даже при отсутствии болезней у человека есть естественный предел продолжительности жизни, который требует отдельного изучения. Некоторые могут рассматривать его как «болезнь», и такая точка зрения обоснована, но я также считаю, что необходимо решать и те болезни, которые будут поражать людей даже после решения вопроса продолжительности жизни.

Выбранная нами часть задачи не означает, что вы никогда не простудитесь. Мы говорим о «лечении, профилактике или контроле»: одни болезни можно полностью излечить; другие, как я полагаю, в будущем удастся предотвратить; третьи, возможно, всё равно дадут о себе знать, но то, что раньше приводило к тяжёлым последствиям или даже смерти, теперь будет поддаваться контролю как хроническое заболевание без существенного ущерба качеству жизни.

Цель — поддерживать человеческий организм в сбалансированном состоянии: не исключая контакта с патогенами, а обеспечивая возможность лечения, профилактики и контроля всех болезней.

О чём чаще всего думает Марк?

Ведущий: ИИ стал катализатором множества прорывов, включая персональный интеллект. О чём вы думаете сейчас больше всего? Какие мысли возникают чаще всего в ходе этой работы?

Марк: Это может меняться каждую неделю.

Сейчас я сосредоточен на Muse. Каждый релиз даёт мощный импульс, затем мы взаимодействуем с реальным миром, собираем обратную связь и определяем следующие шаги — эта фаза всегда увлекательна. Сейчас мы как раз в ней: собираем много данных, чтобы понять, чего хотят пользователи. Хорошая новость — продукт им нравится, поэтому мы активно работаем над его широким распространением.

Над моделью ещё предстоит большая работа; модель Muse Spark уже достигла значительных успехов, и мы намерены и дальше двигаться вперёд, создавая мировую лидирующую модель.

Какие прорывы необходимы дальше?

Ведущий: Какие ещё прорывы нужны?

Марк: При проведении таких исследований заранее предвидеть всё невозможно. У нас есть интуитивные представления о некоторых направлениях, и значительная часть работы за последний год была посвящена расширению инфраструктуры.

Полтора года назад многие считали, что для достижения суперинтеллекта требуются фундаментальные прорывы в архитектуре. Сейчас я не уверен в этом. Мне кажется, мы уже достаточно хорошо понимаем «формулу»: при наличии достаточно мощного суперкомпьютерного кластера можно достичь цели за счёт грубой вычислительной силы.

Мы строим такой кластер в Огайо — мощностью более 1 тераватта, он практически готов к работе и уже используется для обучения следующего поколения моделей. Также в Луизиане создаётся кластер мощностью 5 тераватт, который скоро заработает. По моей оценке, при обучении на кластерах мощностью в несколько тераватт мы сможем приблизиться к ИИ общего назначения (AGI), а затем — и к суперинтеллекту.

Но это не означает, что это лучший путь. Для работы человеческому мозгу требуется всего 10 ватт, тогда как наши вычислительные системы примерно в миллион раз менее энергоэффективны. Поэтому я убеждён, что потенциал улучшения архитектуры остаётся, и мы также занимаемся этим: комбинируя огромные вычислительные мощности с архитектурными усовершенствованиями, можно создать мировой лидер. Однако пока масштабирование само по себе даёт значительные результаты.

Ведущий: Да, масштабирование — самый надёжный путь. В исследованиях приходится рассчитывать на крупные прорывы, но масштабирование быстро даёт результаты.

Марк: Именно поэтому крупные компании выбирают именно этот путь. Существует, возможно, гораздо более дешёвый способ, но мы пока его не знаем. А это настолько ценно для мира, что даже при затратах в сотни миллиардов долларов, при условии достаточно высокой вероятности успеха, проект всё равно стоит того — ведь он обеспечивает чёткий путь к достижению цели, даже если дешёвый прорыв так и не будет найден. Разумеется, найти более дешёвый способ было бы ещё лучше.

Поэтому я не хочу говорить, что эта проблема «решена», поскольку на каждом этапе масштабирования инфраструктуры возникают новые инженерные вызовы, требующие отладки и устранения. Сама научная работа продвигается именно таким итеративным путём.

Как выиграть битву за безопасность ИИ

Ведущий: Одна из важнейших задач сейчас — сосредоточиться на согласованности (alignment), чтобы модели были надёжными.

Марк: Да. В отрасли идёт дискуссия о согласованности: будут ли лаборатории ИИ заниматься этим естественным образом? Моя позиция: разумеется, будут. Если вы скажете Muse сделать что-то, а она сделает прямо противоположное, неясно, сколько людей захотят ею пользоваться. Мы должны гарантировать, что модель не просто понимает ваш конкретный запрос, но и улавливает ваши намерения и ценности, чтобы не действовала вопреки вашим ожиданиям или не порождала негативных последствий, которых вы категорически не желаете. Такое глубокое понимание и есть согласованность.

Поэтому, по моему мнению, чтобы Muse добилась успеха и достигла миллиардов пользователей, необходимо добиться реального прогресса в области согласованности — а не просто обсуждать её.

Ведущий: Достигается ли согласованность благодаря отзывам пользователей вроде «это не то, чего я хотел», или её выявляют на стороне сервера?

Марк: И тем, и другим способом. Отзывы пользователей важны, но становится всё очевиднее: согласованность нужно внедрять уже на этапе обучения, а не только после запуска. Сегодняшние модели настолько умны, что если не обеспечить согласованность на этапе обучения, большинство проблем безопасности и сбоев, наблюдаемых в других лабораториях, возникают именно в ходе обучения, а не после выхода продукта к пользователям.

Необходимо выстроить для модели очень продуманную «учебную программу», как родители учат детей, чётко обозначая границы допустимого. Если модель совершает ошибку, она должна научиться: «Нет, тебе следует решить эту задачу по программированию, а не обойти её, изменив конфигурацию системы ради получения награды». Я хочу, чтобы ты освоил этот подход через сам процесс решения задач — вот в чём смысл обучения.

Это в значительной мере связано с созданием надёжных механизмов безопасности и чётких границ. Всё это — естественные задачи, стоящие перед отраслью, и мы вкладываем в них много времени; ситуация меняется ежедневно.

Ведущий: Помню, вы упоминали, что вопрос безопасности ИИ, кажется, внезапно стал фокусом внимания последние две недели, однако никакого единичного события, спровоцировавшего такой срок, не было. Похоже, вы имеете в виду, что вы потратили ещё несколько месяцев на внутреннее обучение.

Марк: Для Muse мы понимали, что этому продукту необходимо уделять особое внимание приватности и безопасности. У нас есть ранняя версия модели, которую, по нашему мнению, можно дополнительно дообучить в части «масштаба раскрытия информации» — как мы уже обсуждали. Поэтому мы выделили время на это. Также мы потратили время на повышение безопасности виртуальной машины. Это заняло ещё несколько месяцев.

Я не совсем согласен с заявлениями некоторых других лабораторий: «Мы терпим огромные трудности, замедляясь». Для Meta и пользователей Muse это правильный шаг. Мы хотим выпустить качественный продукт; если продукт окажется слабым, это плохо и для пользователей, и для нас — мы не хотим выпускать что-то, что оставит плохое первое впечатление и вызовет потерю интереса к использованию.

Я уверен, что все лаборатории испытывают мощную внутреннюю мотивацию добиться успеха. Если правильно выстроить механизмы стимулирования под цель «чрезвычайно ценная и безопасная система», это станет ключом к успеху.

Ведущий: Большое спасибо за ваше время в эту важную неделю.

Марк: Спасибо, большое спасибо.