Проект Stargate за $500 млрд, модели O3 и ИИ-агенты: новые планы OpenAI

WSJ Events 314 тыс. 34 мин 10 мин 22.01.2025
Главное

Директор по продукту OpenAI Кевин Вейл в рамках мероприятия издания The Wall Street Journal рассказал о масштабных планах компании по развитию инфраструктуры искусственного интеллекта и выпуску новых продуктов. В центре обсуждения оказались проект Stargate стоимостью до 500 миллиардов долларов, новые рассуждающие модели серии O3, а также грядущая эра ИИ-агентов, способных полностью автоматизировать рутинные цифровые задачи. Интервью проливает свет на стратегические приоритеты OpenAI в условиях обостряющейся глобальной технологической гонки.

🚀 Мегапроект Stargate: инвестиции в американскую ИИ-инфраструктуру 0:00

Ночью накануне интервью стало известно о запуске масштабного совместного предприятия под названием Stargate, в котором приняли участие компании OpenAI, Oracle и японский холдинг SoftBank. На начальном этапе партнеры планируют инвестировать в ИИ-инфраструктуру США 100 миллиардов долларов в течение следующих четырех лет, а в долгосрочной перспективе общий объем инвестиций может вырасти до 500 миллиардов долларов. Официальный анонс этой инициативы состоялся в Рузвельтовском зале Белого дома с участием генерального директора OpenAI Сэма Альтмана, главы Oracle Ларри Эллисона, основателя SoftBank Масаёси Сона и политика Дональда Трампа.

Основная цель проекта Stargate заключается в строительстве передовых дата-центров на территории США. По словам директора по продукту OpenAI, эти объекты будут оснащены графическими процессорами (GPU), предназначенными как для обучения новых ИИ-моделей, так и для выполнения инференса (работы готовых алгоритмов), обеспечивающего функционирование пользовательских продуктов.

В OpenAI подчеркивают ключевую технологическую закономерность:

Чем больше вычислительных мощностей (compute) задействовано, тем более совершенными становятся ИИ-модели.

Компания стремится взять ситуацию в свои руки и гарантировать наличие достаточного объема ИИ-инфраструктуры на ближайшие 10 лет. В качестве ключевых технологических партнеров в этом направлении по-прежнему выступают корпорации NVIDIA и Microsoft.

🧠 Эволюция моделей: от систем мгновенных ответов к рассуждающим системам O3 2:50

В сфере создания ИИ-модели сегодня наблюдается несколько параллельных трендов: алгоритмы становятся существенно дешевле, умнее, быстрее и безопаснее. Снижение стоимости ИИ-вычислений происходит стремительными темпами. Например, базовая модель gpt3, анонсированная два года назад, обходилась в производстве в 100 раз дороже, чем современная облегченная модель GPT-4o mini — за два года цены упали на 99%.

Главным технологическим прорывом последнего времени стал переход от так называемого «мышления Системы 1» (быстрые, автоматические ответы, свойственные модели GPT-4) к полноценному логическому рассуждению. Новая линейка моделей OpenAI, получившая название O-серии (начиная с o1), способна поэтапно анализировать сложные задачи, выдвигать и тестировать гипотезы, а также корректировать свои действия в процессе. Представитель компании сравнил этот механизм с тем, как человек разгадывает сложный кроссворд или планирует научное исследование.

Интересно, что в нумерации моделей OpenAI решила пропустить цифру 2 из-за телекоммуникационной компании Telefonica, которая владеет известным брендом мобильной сети O2. Таким образом, следующим крупным релизом после o1 станет модель o3.

Скорость разработки ИИ-систем в лабораториях компании значительно увеличилась:

Динамику прогресса наглядно иллюстрируют результаты моделей на специализированных соревнованиях по спортивному программированию, где ИИ тестируется асинхронно наравне с людьми:

  1. Первая превью-версия o1 находилась на уровне примерно миллионного по силе программиста в мире (что, впрочем, соответствовало топ-2% или топ-3% человеческих навыков).
  2. Полноценная первая версия o1 поднялась до уровня тысячного лучшего инженера в мире.
  3. Ожидаемая модель o3, по прогнозам компании, займет позицию на уровне 175-го лучшего программиста планеты.

Модели традиционно планируется выпускать в двух модификациях: быстрая и дешевая mini-версия (сохраняющая глубокие навыки в математике и кодинге, но обладающая меньшим объемом общих знаний о мире) и флагманская полноразмерная модель. Релиз o3 mini ожидается в самое ближайшее время, а полноценная o3 должна выйти ориентировочно в феврале-марте при условии успешного завершения всех тестов.

🤖 Эра ИИ-агентов: автоматизация рутины в 2025 году 8:58

По мнению директора по продукту OpenAI, 2025 год станет моментом, когда ИИ-агенты превратятся в реальность. Если сегодня пользователи взаимодействуют с ChatGPT преимущественно в формате «вопрос — ответ», то в течение года система начнет самостоятельно выполнять комплексные действия за человека в реальном цифровом мире.

В качестве примера спикер привел повседневную работу в браузере: около половины времени тратится на интересный контент (чтение статей или просмотр видео), а вторая половина уходит на рутину, вроде заполнения многостраничных форм для записи детей в спортивные секции. Цель ИИ-агентов — забрать эту рутину себе, возвращая пользователям до получаса полезного времени ежедневно.

Фундаментом для создания агентов служат две важнейшие технологические примитивы, над которыми OpenAI работала параллельно с логическим мышлением моделей:

Часть этого функционала уже доступна в официальных десктопных приложениях ChatGPT для Mac и Windows. С явного разрешения пользователя программа может видеть содержимое экрана или конкретных окон. Например, разработчики уже могут попросить ИИ проанализировать ошибку компиляции прямо в терминале и подсказать решение без необходимости копировать код вручную. В ближайшем будущем агент сможет самостоятельно вносить правки в код. Широкое развертывание агентских функций планируется начать в первом квартале года посредством серии регулярных обновлений.

Отдельное внимание OpenAI уделяет вопросам безопасности и контроля со стороны человека. Поскольку ИИ-модели не идеальны и продолт совершать ошибки, цена неверного действия агента в реальном мире существенно выше, чем цена неправильного текстового ответа.

По этой причине компания разрабатывает механизмы разграничения обратимых и необратимых действий. На первых этапах ИИ будет полностью подготавливать задачу (например, заполнять форму или собирать корзину покупок на Amazon), но финальную кнопку «Отправить» или «Оплатить» должен будет нажимать сам пользователь. Граница автономии агентов будет сдвигаться постепенно, по мере роста надежности систем и доверия со стороны людей.

💼 Инструменты для авторов, робототехника и экосистема партнерств 14:40

В ходе интервью были затронуты вопросы взаимодействия OpenAI с создателями контента и смежными индустриями. Инструмент, позволяющий авторам отказываться от использования их материалов для обучения нейросетей (opt-out tool), все еще находится в разработке. Компания рассчитывает представить детальную информацию по этому проекту позже.

В отношении человекоподобных роботов представитель OpenAI пояснил, что в текущем году прорывов ждать не стоит. По его прогнозам, робототехника отстает от цифровой ИИ-революции примерно на два-три года, поскольку ИИ по своей природе изначально виртуален. Тем не менее, интеграция мультимодальных функций (зрения и слуха) делает робототехнику очевидным следующим шагом. OpenAI уже перезапустила небольшую внутреннюю исследовательскую команду для изучения возможностей в этой области.

Стратегия компании опирается как на развитие собственных продуктов, так и на поддержку сторонних разработчиков:

Говоря о технологических альянсах, представитель OpenAI назвал компанию условной «Швейцарией в мире ИИ-партнерств» из-за ее одновременного сотрудничества с ключевыми игроками рынка. Особое значение имеет интеграция с Apple в рамках системы Apple Intelligence. Цель OpenAI — сделать ChatGPT доступным в один клик или касание на любом устройстве. Благодаря партнерству пользователи смогут вызывать ИИ-помощника долгим нажатием боковой кнопки на iPhone по всему миру.

Для расширения доступности технологий OpenAI в рамках инициативы «12 дней» запустила бесплатный сервис «1-800-CHATGPT» (номер телефона 1-800-242-8478). Любой из более чем 3 миллиардов пользователей мессенджера WhatsApp во всем мире может добавить этот номер в контакты и общаться с ChatGPT напрямую через чат. Несмотря на то, что интерфейс мессенджера накладывает ограничения на богатство оформления ответов, это позволяет предоставить бесплатный доступ к ИИ миллионам людей, что соответствует глобальной миссии компании.

💰 Монетизация, тариф Pro за $200 и реструктуризация бизнеса OpenAI 19:36

Недавнее заявление Сэма Альтмана в соцсетях о том, что OpenAI несет убытки на премиальном тарифе Pro стоимостью 200 долларов в месяц, вызвало активное обсуждение в индустрии. Директор по продукту компании подтвердил этот факт и объяснил логику такого решения. Помимо бесплатного доступа (который доступен даже без регистрации на сайте) и стандартного тарифа Plus за 20 долларов в месяц, компания обнаружила категорию профессиональных пользователей, которым остро не хватало стандартных лимитов.

Эти клиенты были готовы потреблять вычислительные мощности на суммы, значительно превышающие 20 долларов, поскольку ИИ приносил им огромную практическую пользу. В результате был введен тариф Pro за 200 долларов в месяц с практически безлимитным (за вычетом защиты от злоупотреблений) доступом к самым мощным вычислительным ресурсам. Несмотря на текущую убыточность обслуживания таких сверхактивных пользователей, OpenAI делает ставку на долгосрочную перспективу, рассчитывая на дальнейшее стремительное падение стоимости вычислений. Исторический тренд последних 6–12 месяцев показывает, что компания регулярно снижает затраты, расширяет лимиты и добавляет больше бесплатных функций в базовые подписки.

Параллельно в OpenAI прокомментировали продолжающийся процесс трансформации из некоммерческой исследовательской лаборатории (nonprofit) в коммерческую структуру. По словам топ-менеджера, внутри команды эта тема не вызывает никаких споров или разногласий, вопреки активным дискуссиям в прессе.

История перехода выглядит следующим образом:

  1. OpenAI создавалась как небольшой некоммерческий проект в период, когда в возможность построения сильного искусственного интеллекта (AGI) практически никто в мире не верил.
  2. После первых серьезных научных прорывов (модели GPT-1 и GPT-2) стало очевидно, что для дальнейшего развития требуются миллиарды долларов и колоссальные объемы инфраструктуры. Это вошло в противоречие с традиционной некоммерческой моделью.
  3. Для привлечения инвестиций была создана коммерческая дочерняя структура, которая со временем переросла изначальные масштабы проекта.

Текущая реструктуризация призвана привести юридическую форму в соответствие с реальностью, однако она полностью сохранит некоммерческое крыло OpenAI. Планируется, что некоммерческая организация останется крупным акционером объединенной компании и продолжит реализовывать социальные проекты в сфере здравоохранения и образования.

⚖️ Регулирование, геополитическая гонка и стили управления лидеров IT-индустрии 26:35

Обсуждая вопросы безопасности и государственного регулирования, представитель OpenAI высказал мнение, что ИИ уже сейчас частично регулируется государством везде, где он соприкасается с жестко контролируемыми отраслями — например, в медицине или юриспруденции. Компания поддерживает идею разумного регулирования, но видит главный риск в потенциальном появлении лоскутного одеяла из 50 различных законодательных актов в каждом отдельном штате США. По оценке спикера, бюрократические барьеры такого рода могут парализовать развитие всей американской индустрии и привести к поражению в глобальной ИИ-гонке.

Спикер выразил жесткую позицию относительно геополитического соперничества:

США и западный мир обязаны выиграть гонку в сфере ИИ. Нельзя допустить, чтобы в этом соперничестве победил Китай, поскольку победа государства, не разделяющего демократические ценности, поставит мир в совершенно иные, опасные условия.

Что касается сроков достижения человеческого уровня ИИ (AGI), директор по продукту OpenAI прокомментировал недавний прогноз главы Anthropic Дарио Амодеи, ожидавшего этот рубеж к 2027 году. Спикер считает, что из-за невероятно крутой траектории развития моделей (включая прогресс в кодинге от миллионного до 175-го места за считанные месяцы) это событие вполне может наступить даже раньше 2027 года. При этом он призвал общество не поддаваться паническим настроениям, напомнив, что появление автомобилей, радио, электричества и печатного станка тоже сопровождалось пророчествами о конце света, однако человечество успешно адаптировалось ко всем технологическим скачкам.

В завершение интервью Кевин Вейл поделился уникальным личным опытом работы под руководством трех известнейших лидеров Кремниевой долины — Джека Дорси в Twitter, Марка Цукерберга в Meta и Сэма Альтмана в OpenAI. Сравнивая их подходы к проведению рабочих встреч и стратегическому планированию, он выделил характерные особенности каждого руководителя:

💬 Цитаты

«Чем больше вычислительных мощностей задействовано, тем более совершенными становятся ИИ-модели.»

Кевин Вейл 01:19

«США и западный мир обязаны выиграть гонку в сфере ИИ. Нельзя допустить, чтобы в этом соперничестве победил Китай.»

Кевин Вейл 27:42

«Сэм Альтман обладает редким даром мыслить экспонентами, четко экстраполируя масштаб изменений на 3 года вперед.»

Кевин Вейл 34:21
👥 Спикеры
🔗 Упомянутые сайты и проекты
📖 Термины
Инференс
Процесс работы уже обученной нейросети, когда она принимает новые данные и выдает готовый ответ или результат.
Compute (вычислительные мощности)
Аппаратные ресурсы (процессоры, GPU, серверы), необходимые для обучения и функционирования моделей искусственного интеллекта.
Мультимодальность
Способность ИИ-модели одновременно воспринимать и обрабатывать разные типы данных, такие как текст, звук, изображения и видео.
AGI (Сильный искусственный интеллект)
Гипотетический искусственный интеллект, способный выполнять любую интеллектуальную задачу на уровне человека или лучше.
ИИ-агенты
Программные системы на базе ИИ, способные автономно выполнять последовательности действий для достижения поставленных пользователем целей.
📊 Цифры
⚖️ Другая сторона
Искусственный интеллект OpenAI Stargate Сэм Альтман Кевин Вейл ИИ-агенты