# Взлом «мыслей» ИИ, математический прорыв Claude и исход лидеров из Google

Источник: https://www.youtube.com/watch?v=kKjmv2CuVUI
Канал: Wes Roth
Опубликовано: 12.08.2026

---

В новом выпуске Уэс Рот анализирует череду громких событий в мире ИИ: от технического взлома «внутренних мыслей» нейросетей до масштабных кадровых перестановок в Google и манифеста Марка Цукерберга о суперинтеллекте. Главной темой становится вопрос о том, движется ли человечество к созданию цифрового «бога» или просто совершенствует полезные инструменты для бизнеса.

## 🧠 Кража мыслей: исследователи обошли цензуру Chain of Thought
[[JUMP:00:00]]

Одной из самых интригующих новостей недели стала публикация научной работы под названием «Stolen Thoughts» [00:53]. Группе исследователей удалось извлечь «цепочки рассуждений» (Chain of Thought, CoT) проприетарных моделей через их API, обходя защитные механизмы [13:28].

**Технические и этические аспекты:**

*   **Что такое CoT:** Это внутренние логические шаги, которые модель проходит перед выдачей окончательного ответа. Обычно разработчики (OpenAI, Anthropic) скрывают их или показывают лишь отцензурированную версию [10:37].
*   **Проблема безопасности:** В «сырых» мыслях ИИ часто проскакивают конфиденциальные данные: учетные данные, API-ключи, адреса и номера телефонов пользователей [11:17]. Уэс Рот отмечает случай, когда модель Claude Haiku заметила, что пользователь случайно отправил свой API-ключ, и внутри себя решила не повторять его в ответе, чтобы не подвергать пользователя риску [12:08].
*   **Дистилляция моделей:** Сокрытие мыслей необходимо лабораториям, чтобы конкуренты не могли «дистиллировать» их модели (обучать свои нейросети на логике более продвинутых систем) [12:49].
*   **Риск взлома:** Исследователи предупредили Anthropic и другие лаборатории о найденной уязвимости, которая позволяет воровать трассировки рассуждений, не атакуя модель напрямую [13:14].

## 📈 Математический прорыв Claude и «поддержка» со стороны людей
[[JUMP:06:08]]

Модель Claude (в невыпущенной исследовательской версии) достигла значительного прогресса в работе над гипотезой Римана — одной из самых сложных задач математики, касающейся распределения простых чисел [06:08].

**Как это произошло:**

1.  Claude сумела поднять нижнюю границу доказательства с 41,6 до 67,2 [07:20]. Это не означает, что гипотеза решена на 67%, но прогресс превосходит все предыдущие достижения человечества в этой области [07:35].
2.  **Роль промпт-инженера:** Сотрудник Anthropic Джаред Самнер, не будучи математиком, направлял ИИ исключительно словами поддержки [08:43].
3.  **Масштаб вычислений:** В процессе работы было использовано 31 миллион токенов, создано 60 субагентов Claude, выполнено 2400 команд оболочки и написано сотни Python-скриптов [08:55].
4.  **Психология ИИ:** Уэс Рот иронизирует, что теперь роль человека сводится к «коучингу» нейросети. Фразы вроде «верь в себя» и «продолжай работу» помогли Claude преодолеть «скептицизм» и выдать результат после 650 неудачных идей [09:21].

## 🤖 Grok Bot и автономные агенты на виртуальных машинах
[[JUMP:14:02]]

XAI (компания Илона Маска) в партнерстве с Cursor запустила Grok Bot, который Уэс Рот называет потенциальным убийцей множества стартапов [11:19].

*   **Собственная ОС:** В отличие от обычных чат-ботов, Grok Bot работает на собственной виртуальной машине (Linux). Он не ограничен браузером и может действовать как полноценный «виртуальный сотрудник» [14:32].
*   **Мультиагентность:** Система позволяет запускать несколько ботов параллельно, назначать одного «менеджером» и давать указания подчиненным агентам [15:37].
*   **Реальные кейсы:** Бот уже демонстрирует успехи в создании игровых ассетов, аудите подписок и даже отмене бронирований (хотя случай с «взломом» сайта спортзала в Австралии, где Claude якобы сместил людей в очереди, выглядит как пугающий пример агентского ИИ) [02:13, 16:02].

## 🇪🇺 Критика закона ЕС об ИИ и водяных знаков
[[JUMP:16:58]]

Ведущий крайне скептически оценивает новый закон ЕС об ИИ (AI Act), называя его вредным и устаревшим на 5 лет [02:28].

**Основные претензии:**

*   **Скрытая маркировка:** Компании (OpenAI, Anthropic, Google, Meta) обязались вставлять «невидимые подписи» в генерируемый текст [24:18]. XAI Илона Маска подписывать документ отказалась [24:32].
*   **Риски для авторства:** Если в тексте есть скрытый водяной знак, правительства или корпорации могут в будущем заявить, что работа принадлежит не человеку, а ИИ, и лишить автора авторских прав [25:25].
*   **Цензура и приоритеты:** Существует риск, что социальные платформы будут отдавать приоритет контенту с «правильной» цифровой подписью, фактически отсекая альтернативные или опенсорсные модели (например, китайские Kimmy или DeepSeek), у которых такой маркировки нет [26:19].

## 🎭 Манифест Цукерберга и Muse: ИИ как «бог» или инструмент?
[[JUMP:26:50]]

Meta выпустила новые открытые модели серии Muse и манифест Марка Цукерберга на 6500 слов [26:50].

*   **Позиция Цукерберга:** Он выступает против «пророков конца света» и за демократизацию ИИ, утверждая, что доступные мощные модели сделают экономику более предприимчивой и увеличат занятость [28:05].
*   **Спор о суперинтеллекте:** Уэс Рот отмечает противоречие. Если Цукерберг верит в создание суперинтеллекта (который превосходит человека во всех областях), то слова о «новом бизнесе для людей» теряют смысл [29:35]. 
*   **Мнение экспертов:** По мнению ведущего, такие лидеры как Демис Хассабис (Google DeepMind), Дарио Амодеи (Anthropic) и Илья Суцкевер верят, что мы строим именно суперинтеллект — сущность, способную на рекурсивное самосовершенствование и обладающую мощью, сопоставимой с божественной [32:24].

## 🏢 Исход лидеров из Google и будущее компании
[[JUMP:33:22]]

В Google наблюдается массовый уход ключевых фигур («Exodus»).

*   **Кадровые потери:** Джефф Дин уходит спустя 27 лет работы, чтобы основать стартап Discovery Loop [33:27]. Джон Джампер (создатель AlphaFold) и другие важные разработчики перешли в Anthropic и OpenAI [33:38].
*   **Причины:** Среди причин называют бюрократию, моральное выгорание, задержки с моделью Gemini 3.5 Pro и недовольство сотрудничеством с военными структурами (Министерство внутренней безопасности США) [33:53].
*   **Перспективы:** Несмотря на кризис управления, Уэс Рот считает, что списывать Google со счетов рано из-за их колоссальных ресурсов и собственных чипов (TPU) [34:20].