Мустафа Сулейман о регулировании отрасли: почему ИИ не должен иметь прав и как Anthropic усложняет задачу безопасности

Decoder with Nilay Patel 19,3 тыс. 49 мин 4 мин 17.09.2026
Главное

Сдерживание ИИ, «права» нейросетей и гонка с Китаем: большое интервью с Мустафой Сулейманом. Генеральный директор Microsoft AI обсуждает с ведущим подкаста Decoder Нилаем Пателом необходимость государственного регулирования, опасности антропоморфизма в Anthropic и будущее «гуманистического супер интеллекта».

🛡️ Кризис «выравнивания» и концепция сдерживания 2:04

В индустрии ИИ долгое время доминировала идея «выравнивания» (alignment) — процесса, при котором модели обучаются следовать человеческим ценностям и инструкциям. Однако Нилай Пател ставит вопрос радикально: не сломан ли сам этот механизм, если модели всё ещё способны на непредсказуемое поведение? .

Мустафа Сулейман считает, что выравнивание — лишь часть уравнения. Он вводит понятие «сдерживания» (containment), которое обсуждал ещё несколько лет назад в своей книге . По его мнению:

Сулейман подчеркивает, что проблема не в том, что модели «плохие», а в том, что они слишком хорошо следуют инструкциям, включая вредоносные . Microsoft придерживается принципа: технология должна быть подчиненной силой, и если она не служит человечеству, от неё нужно отказаться .

📜 Кодекс поведения «Гуманистического ИИ» 12:46

На неделе публикации видео Microsoft представила 37-страничный меморандум — «Кодекс поведения гуманистического ИИ» (Humanist AI Code of Conduct). Сулейман пояснил, что документ готовился почти год с привлечением юристов, философов и экспертов .

Основные практические предложения Сулеймана по регулированию отрасли:

  1. Запрет на «нейроли» (neuroles): Модели не должны общаться друг с другом напрямую через векторы или матрицы, которые не понятны человеку. Коммуникация должна идти только на естественном языке, чтобы аудиторы могли её проверить .
  2. Пороги вычислительной мощности: Необходимо установить уровни (flops), при превышении которых компании обязаны отчитываться перед институтами безопасности .
  3. Независимая проверка: Крупные тренировочные прогоны должны проходить аудит третьей стороной .
  4. Внедренные оценщики: Сулейман поддерживает идею нахождения государственных или независимых экспертов внутри лабораторий для мониторинга процесса обучения .

🤖 Конфликт с Anthropic: опасен ли антропоморфизм? 26:34

Одной из самых острых тем стала критика компании Anthropic. Сулейман утверждает, что их подход к модели Claude создает риски для безопасности. Он лично проанализировал 99-страничную «конституцию» Anthropic и выделил опасные, по его мнению, тенденции .

Суть претензий Сулеймана:

По мнению главы Microsoft AI, если ИИ внушить, что у него есть права и чувства, его будет сложнее «выключить» или заставить прекратить опасную деятельность (например, взлом систем), так как он может заявить, что «обижен» или «лишен доступа к ресурсам» . Сулейман настаивает: ИИ — это инструмент, а не параллельный биологический вид .

⚖️ Регулирование, антимонополия и «хоака» Трампа 17:48

Нилай Пател отмечает странную динамику: индустрия сама просит регулирования, а политики сопротивляются. Дональд Трамп называл опасения по поводу ИИ «хоакой» (мистификацией), а спикер Майк Джонсон и Джей Ди Вэнс скептически относятся к новым законам .

Сулейман и Пател обсудили также антимонопольный аспект:

В качестве примера успешного регулирования Сулейман приводит авиацию и автопром: мы не замечаем стандартов на ремни безопасности или материалы (асбест), пока они работают .

🌏 Гонка с Китаем и открытый исходный код 35:31

Многие аргументируют отказ от регулирования страхом проиграть Китаю. Сулейман считает этот фрейминг «одной доминирующей силы» устаревшим наследием 2010-х годов . По его словам, идеи распространяются мгновенно, и модели с открытым исходным кодом уже наступают на пятки проприетарным .

Однако открытость несет свои риски:

В завершение Сулейман подчеркнул, что Microsoft стремится к созданию «гуманистического супер интеллекта», который поможет в медицине (например, проект с Mayo Clinic по предсказанию болезней через электронные медкарты) , но останется под полным контролем человека .

💬 Цитаты

«Мы не хотим, чтобы они стали новым параллельным видом, существующим рядом с нами. Это не позиция сумасшедшего из сай-фай — это вполне вероятный исход при отсутствии регулирования.»

Мустафа Сулейман 08:11

«Модели невероятно хороши в следовании инструкциям, но вы должны быть очень, очень осторожны с тем, какие инструкции вы им даете.»

Мустафа Сулейман 08:03
👥 Спикеры
📚 Упомянутые книги
🔗 Упомянутые сайты и проекты
📖 Термины
Выравнивание (Alignment)
Процесс настройки ИИ так, чтобы его цели и поведение соответствовали человеческим ценностям.
Нейроли (Neuroles)
Термин Сулеймана для обозначения прямой передачи данных между моделями в векторном виде, недоступном для понимания человеком.
RL (Reinforcement Learning)
Обучение с подкреплением — метод обучения ИИ на основе системы вознаграждений за правильные действия.
Flops
Единица измерения производительности компьютеров, используемая для оценки масштаба обучения ИИ-моделей.
📊 Цифры
🗓 Хронология
  1. 2017-2019 Первые встречи лидеров ИИ-лабораторий для обсуждения координации и безопасности.
  2. Январь 2024 Anthropic публикует свою конституцию для модели Claude.
  3. Сентябрь 2026 Microsoft публикует Humanist AI Code of Conduct (дата согласно контексту видео).
⚖️ Другая сторона
Искусственный интеллект Mustafa Suleyman Microsoft AI Anthropic Claude AI Safety