OpenAI о Valuemaxxing: Как GPT-5.6 Sol и Terra меняют экономику ИИ-стартапов

OpenAI 13,3 тыс. 54 мин 4 мин 24.07.2026
Главное

Build Hour: «Valuemaxxing» с GPT-5.6 — как извлекать максимум из каждого токена

В рамках свежего выпуска Build Hour специалисты OpenAI и стартапа Ploy обсудили переход от бездумного сжигания токенов к стратегии «valuemaxxing» (максимизации ценности). В центре внимания — новая линейка моделей GPT-5.6, а также конкретные методы оптимизации стоимости и производительности ИИ-агентов в продакшене.

🚀 От Tokenmaxxing к Valuemaxxing: смена парадигмы 2:50

Чарли Го (DevEx OpenAI) констатирует важный сдвиг в индустрии ИИ. Если в начале года доминировал подход «tokenmaxxing», когда успех измерялся объемом потребления — количеством промптов, токенов и активных агентов , то к середине года ситуация изменилась. Многие компании обнаружили, что их годовой бюджет на ИИ испарился за несколько месяцев .

На смену пришел «valuemaxxing». По определению Чарли Го, это измерение прогресса не количеством использованного ИИ, а реальными результатами: сэкономленным временем, улучшением качества кода и выполненной работой . Основной вопрос теперь звучит так: «Если вы удвоите траты на токены завтра, как вы поймете, что это того стоило?» .

🛠 Линейка GPT-5.6 и работа в Codex 7:11

Для реализации стратегии максимизации ценности OpenAI представила семейство GPT-5.6, разделенное по сценариям использования:

Чарли Го представил «лабораторию оптимизации» (Optimization Lab), где наглядно продемонстрировал, что даже легкие модели (Luna) при повышении уровня рассуждений (reasoning levels) могут выдавать высококачественные результаты, сопоставимые с более мощными аналогами .

Практические советы от OpenAI по использованию Codex:

  1. Начинайте с Sol на среднем уровне (Medium). Чарли Го призывает разработчиков не использовать режим «Extra High» по умолчанию — для большинства ежедневных задач среднего уровня достаточно .
  2. Fast Mode. Режим, позволяющий ускорить генерацию в 1.5 раза в обмен на более быстрое исчерпание лимитов использования .
  3. Auto Approval. Рекомендуемый режим вместо полного доступа, где другая модель проверяет безопасность кода перед выполнением .
  4. Chronicle. Новая функция, позволяющая Codex «запоминать» контекст текущей задачи через запись экрана и историю, что делает ИИ умнее в рамках конкретного рабочего процесса .

🦾 Оптимизация ИИ-агентов: инструменты и фишки API 15:16

Чарли Го выделил четыре ключевые технологии, которые помогают экономить ресурсы при построении сложных систем:

📈 Кейс Ploy: Миграция ИИ-агента в продакшене 23:48

Брайант Чоу (Ploy) и Лоренцо Джентиле поделились опытом перевода своего маркетингового движка на GPT-5.6. Ploy позволяет автоматически превращать сайты в «дизайн-системы» и запускать автономные воронки продаж .

Лоренцо Джентиле подробно разобрал работу с KV-caching (кэшированием ключей-значений). Главная проблема — кэш работает только при добавлении в конец (append-only) . Если вы вставляете динамическое время в начало системного промпта, кэш сбрасывается.

Инженерные решения Ploy:

❓ Вопросы и ответы: Субагенты и режимы Ultra 39:57

В финальной части Чарли Го разъяснил путаницу в новых режимах GPT-5.6 :

На вопрос о том, получают ли субагенты полный контекст, Чарли ответил, что им передается только необходимая информация, выделенная основным агентом-оркестратором . Лоренцо добавил, что передача задач между моделями (например, от Sol к Terra или Luna) может быть «потерянной» (lossy), поэтому стоит быть осторожным с глубокой иерархией субагентов .

Также эксперты обсудили выбор между «новым чатом» и «уплотнением» (compaction). Лоренцо отметил интересную UX-проблему: стоит ли давать пользователю самому решать, когда сменять тему, или поручить это ИИ, чтобы избежать замусоривания контекста и лишней траты токенов на нерелевантные задачи .

💬 Цитаты

«Если вы удвоите траты на токены завтра, как вы поймете, что это того стоило?»

«Использовать Ultra-режим для проверки почты — это как принести базуку на драку на ножах.»

«Динамическая вставка даты в начало промпта ломает KV-кэш и резко увеличивает расходы.»

Лоренцо Джентиле 31:44
👥 Спикеры
🔗 Упомянутые сайты и проекты
📖 Термины
Valuemaxxing
Стратегия оптимизации ИИ-систем, направленная на получение максимального результата на каждый потраченный токен.
KV Caching
Метод сохранения промежуточных состояний (ключей и значений) модели для ускорения обработки и снижения стоимости повторных запросов.
Programmatic Tool Calling
Функция ИИ, позволяющая модели писать и исполнять код для взаимодействия с внешними инструментами внутри защищенной среды.
Compaction
Процесс сжатия или суммаризации истории диалога для уменьшения размера контекстного окна.
📊 Цифры
🗓 Хронология
  1. Начало 2026 Период 'tokenmaxxing', когда компании соревновались в объемах потребления токенов.
  2. Июль 2026 Релиз GPT-5.6 и проведение данного Build Hour.
  3. 29 июля 2026 Запланированный Build Hour по модели ImageGen 2.
⚖️ Другая сторона
Искусственный интеллект OpenAI GPT-5.6 Charlie Guo Ploy Prompt Caching