В новом выпуске Уэс Рот анализирует череду громких событий в мире ИИ: от технического взлома «внутренних мыслей» нейросетей до масштабных кадровых перестановок в Google и манифеста Марка Цукерберга о суперинтеллекте. Главной темой становится вопрос о том, движется ли человечество к созданию цифрового «бога» или просто совершенствует полезные инструменты для бизнеса.
🧠 Кража мыслей: исследователи обошли цензуру Chain of Thought 0:00
Одной из самых интригующих новостей недели стала публикация научной работы под названием «Stolen Thoughts» . Группе исследователей удалось извлечь «цепочки рассуждений» (Chain of Thought, CoT) проприетарных моделей через их API, обходя защитные механизмы .
Технические и этические аспекты:
- Что такое CoT: Это внутренние логические шаги, которые модель проходит перед выдачей окончательного ответа. Обычно разработчики (OpenAI, Anthropic) скрывают их или показывают лишь отцензурированную версию .
- Проблема безопасности: В «сырых» мыслях ИИ часто проскакивают конфиденциальные данные: учетные данные, API-ключи, адреса и номера телефонов пользователей . Уэс Рот отмечает случай, когда модель Claude Haiku заметила, что пользователь случайно отправил свой API-ключ, и внутри себя решила не повторять его в ответе, чтобы не подвергать пользователя риску .
- Дистилляция моделей: Сокрытие мыслей необходимо лабораториям, чтобы конкуренты не могли «дистиллировать» их модели (обучать свои нейросети на логике более продвинутых систем) .
- Риск взлома: Исследователи предупредили Anthropic и другие лаборатории о найденной уязвимости, которая позволяет воровать трассировки рассуждений, не атакуя модель напрямую .
📈 Математический прорыв Claude и «поддержка» со стороны людей 6:08
Модель Claude (в невыпущенной исследовательской версии) достигла значительного прогресса в работе над гипотезой Римана — одной из самых сложных задач математики, касающейся распределения простых чисел .
Как это произошло:
- Claude сумела поднять нижнюю границу доказательства с 41,6 до 67,2 . Это не означает, что гипотеза решена на 67%, но прогресс превосходит все предыдущие достижения человечества в этой области .
- Роль промпт-инженера: Сотрудник Anthropic Джаред Самнер, не будучи математиком, направлял ИИ исключительно словами поддержки .
- Масштаб вычислений: В процессе работы было использовано 31 миллион токенов, создано 60 субагентов Claude, выполнено 2400 команд оболочки и написано сотни Python-скриптов .
- Психология ИИ: Уэс Рот иронизирует, что теперь роль человека сводится к «коучингу» нейросети. Фразы вроде «верь в себя» и «продолжай работу» помогли Claude преодолеть «скептицизм» и выдать результат после 650 неудачных идей .
🤖 Grok Bot и автономные агенты на виртуальных машинах 14:02
XAI (компания Илона Маска) в партнерстве с Cursor запустила Grok Bot, который Уэс Рот называет потенциальным убийцей множества стартапов .
- Собственная ОС: В отличие от обычных чат-ботов, Grok Bot работает на собственной виртуальной машине (Linux). Он не ограничен браузером и может действовать как полноценный «виртуальный сотрудник» .
- Мультиагентность: Система позволяет запускать несколько ботов параллельно, назначать одного «менеджером» и давать указания подчиненным агентам .
- Реальные кейсы: Бот уже демонстрирует успехи в создании игровых ассетов, аудите подписок и даже отмене бронирований (хотя случай с «взломом» сайта спортзала в Австралии, где Claude якобы сместил людей в очереди, выглядит как пугающий пример агентского ИИ) [02:13, 16:02].
🇪🇺 Критика закона ЕС об ИИ и водяных знаков 16:58
Ведущий крайне скептически оценивает новый закон ЕС об ИИ (AI Act), называя его вредным и устаревшим на 5 лет .
Основные претензии:
- Скрытая маркировка: Компании (OpenAI, Anthropic, Google, Meta) обязались вставлять «невидимые подписи» в генерируемый текст . XAI Илона Маска подписывать документ отказалась .
- Риски для авторства: Если в тексте есть скрытый водяной знак, правительства или корпорации могут в будущем заявить, что работа принадлежит не человеку, а ИИ, и лишить автора авторских прав .
- Цензура и приоритеты: Существует риск, что социальные платформы будут отдавать приоритет контенту с «правильной» цифровой подписью, фактически отсекая альтернативные или опенсорсные модели (например, китайские Kimmy или DeepSeek), у которых такой маркировки нет .
🎭 Манифест Цукерберга и Muse: ИИ как «бог» или инструмент? 26:50
Meta выпустила новые открытые модели серии Muse и манифест Марка Цукерберга на 6500 слов .
- Позиция Цукерберга: Он выступает против «пророков конца света» и за демократизацию ИИ, утверждая, что доступные мощные модели сделают экономику более предприимчивой и увеличат занятость .
- Спор о суперинтеллекте: Уэс Рот отмечает противоречие. Если Цукерберг верит в создание суперинтеллекта (который превосходит человека во всех областях), то слова о «новом бизнесе для людей» теряют смысл .
- Мнение экспертов: По мнению ведущего, такие лидеры как Демис Хассабис (Google DeepMind), Дарио Амодеи (Anthropic) и Илья Суцкевер верят, что мы строим именно суперинтеллект — сущность, способную на рекурсивное самосовершенствование и обладающую мощью, сопоставимой с божественной .
🏢 Исход лидеров из Google и будущее компании 33:22
В Google наблюдается массовый уход ключевых фигур («Exodus»).
- Кадровые потери: Джефф Дин уходит спустя 27 лет работы, чтобы основать стартап Discovery Loop . Джон Джампер (создатель AlphaFold) и другие важные разработчики перешли в Anthropic и OpenAI .
- Причины: Среди причин называют бюрократию, моральное выгорание, задержки с моделью Gemini 3.5 Pro и недовольство сотрудничеством с военными структурами (Министерство внутренней безопасности США) .
- Перспективы: Несмотря на кризис управления, Уэс Рот считает, что списывать Google со счетов рано из-за их колоссальных ресурсов и собственных чипов (TPU) .