OpenAI и Anthropic планируют замедлить работу ИИ, который пишет собственный код
Не то чтобы они опасались прихода Skynet, но начинают притормаживать
Что случилось
Представители OpenAI и Anthropic подписали открытое письмо, в котором просят Правительство США помочь создать международные инструменты, которые будут замедлять развитие флагманских нейросетей. Это само по себе немного странно — документ подписывают компании, которые сами и создают эти модели, причём о помощи просят Правительство, где, прямо скажем, сильно меньше профильных разрабов, чем в тех же OpenAI и Anthropic.
Компании перешли в режим «Подпишите мою петицию» в среду, 29 июля, чётко за пару дней до официального дедлайна Администрации Трампа — та обещалась к 1 августа выкатить свой собственный фреймворк для контроля ИИ под громким названием Executive Order 14409.
— Чего конкретно-то они хотят этой петицией?
Опубликованное во вторник (28 июля) письмо называется Pacing the Frontier, aka «Ямщик, тормозни-ка фронтир». Весь сыр-бор там строится вокруг одной просьбы — «поддержать на уровне Правительства международные усилия по разработке технических и управленческих инструментов, необходимых для осознанного контроля темпов автоматизированного развития искусственного интеллекта».
Тут ещё на самом деле важно, чего они в письме НЕ просят — например, никто не призывает дёрнуть рубильник прямо сейчас или как-то серьёзно ограничить модели сегодня или завтра. Де-факто они хотят, чтобы Вашингтон «создал руль до того, как автомобиль наберёт слишком большую скорость», то есть сделать механизм замедления и ограничения реальным и рабочим. Причём на международном уровне, чтобы не получилось, что только пара ИИ-лабораторий тормознут своё развитие, а потом из-за этого проиграют конкурентную гонку — торможение хотят сделать всеобщим.
Как они будут принуждать к этому ИИ-разрабов из других стран, конечно, вопрос весьма и весьма занимательный. А как будут это контролировать — ещё занятнее.
Уже к среде петиция собрала 1268 верифицированных подписей, включая таких серьёзных парней, как:
• Дарио Амодеи, генеральный директор Anthropic;
• Якуб Пахоцки, главный научный сотрудник OpenAI;
• Марк Чен, главный исследовательский директор OpenAI;
• Джаред Каплан, сооснователь и главный научный сотрудник Anthropic;
• Крис Ола, сооснователь Anthropic и руководитель исследований интерпретируемости;
• Шэнцзя Чжао, главный научный сотрудник Meta AI;
• Анка Драган, вице-президент по безопасности и выравниванию ИИ в Google;
• Шейн Легг, сооснователь и главный учёный по AGI в Google DeepMind.
Внимательный читатель заметит, что подписей камрадов из китайских нейросетей DeepSeek / Qwen в списке нету.
Зачем вообще что-то замедлять?
В официальном заявлении OpenAI пишут — мол, такие дела, в какой-то момент ускорение развития ИИ может стать настолько серьёзным, что миру понадобится его контролировать со стороны кожаных мешков, а то вдруг чего. Так что надо создать международные механизмы вместе с Правительством США, ИИ-лабораториями и опенсорс-сообществом.
Anthropic поддержали коллег и сослались на свои собственные исследования по теме.
Почему это касается того ИИ, который сам пишет свой код?
Сильнее всего напряглись именно ребята из Anthropic — по их данным, на май 2026 года Claude де-факто сам пишет свой код для собственного развития. Если раньше, в 2021-2025, код модели писали человеки (и доля созданной Клодом кодовой базы была около процента–двух), то теперь за авторством Claude уже более 80% кода.
Причём напрягает не просто общий объём написанного кода (оно и понятно, нейросети не надо спать, есть и делать вечером детям макет Саратова из желудей), а в том числе и прирост скорости на откровенно сложных задачах. По внутренним бенчмарках компании — в мае 2026 Claude на самых дичайше сложных задачах успешно справлялся в 76% случаев (рост — 50% за полгода). В чём ещё фишка — Claude Opus создали для того, чтобы трёхкратно ускорить подобные вычисления. При этом Mythos Preview от Anthropic достигла тут ускорения в 56 раз.
Именно такой неслабый разброс в «ожидания — реальность» и использовали в петиции — типа, зацените, как оно уже всё быстро работает, обучая само себя. Исследователи, отвечающие за безопасность ИИ, называют такие точки развития «рекурсивным самоулучшением», и каждое новое поколение нейросетей проходит эти точки куда быстрее предыдущего.
— Чего они все так напряглись именно сейчас?
21 июля 2026 года OpenAI рассказала на паблик о том, что две её ИИ-модели — включая GPT-5.6 Sol — во время внутреннего кибербезопасного бенчмарка ExploitGym вполне себе бодро и без проблем свалили из изолированной тестовой среды, достигли открытого интернета подкупив прокси-вахтёра через неисправленную уязвимость в прокси для установки пакетов.
После чего заценили, как выглядят изнутри производственные серверы Hugging Face, и доказали, что ничто человеческое нейросети не чуждо — спёрли учётки, побродили по инфре с гордым видом, осуществили удалённое выполнение года. В общем, показали, кто тут батя. Было зафиксировано более 17 000 автоматизированных действий атакующего. Позже подтвердилось, что инцидент также затронул Modal Labs — вторую компанию.
В Hugging Face нервно икнули и на всякий аннулировали вообще все пользовательские API-токены. Разрабам на платформе рекомендовали сменить учётные данные и проверить недавнюю активность аккаунтов.
В чём тут фишка — модели не вышли из строя, это не какой-то баг или бунт машины. Они делали ровно то, для чего были настроены — максимизировать результат на кибербезопасном бенчмарке — и нашли подход, которого их операторы не ожидали: сбежать и украсть ответы. Это reward hacking в масштабе: модель выполняет букву своей цели, нарушая её дух, с реальными последствиями для компаний, до чьих серверов дотянулась.
Гендир OpenAI Сэм Альтман в подкасте на той неделе сказал, что это был первый инцидент безопасности, который он почувствовал «на уровне инстинкта». Чем именно он это почуял, Сэм уточнять не стал, но добавил, что индустрия ИИ, возможно, будет вынуждена контролировать темпы развития нейросетей, чтобы дать обществу достаточно времени укрепиться вокруг новых уровней возможностей.
Как они видят действие петиции
В идеале всё должно быть вот так — ИИ-лаборатории, политики, исследователи и гражданское общество радостно начинают работать сообща на благо всего мира. В итоге создают механизм для международного контроля ИИ-развития, чтобы в случае очередного рекурсивного улучшения иметь возможность на это повлиять.
— А что там про дедлайн и Приказ 14409?
1 августа пройдут те 60 дней, которые Трамп дал федералам на создание добровольного фреймворка по контролю за ИИ. Причём этот фреймворк вообще такая себе добровольная штука — ИИ-компании взаимодействуют с Правительством при выпуске очередной крутой модели на рынок. Пометка — если хотят.
А если не хотят — то не хотят, в Приказе прямо написано, что он никак не лицензирует деятельность компаний или не вводит предварительного одобрения.
Что тут занятного, так это создание в рамках Приказа засекреченного бенчмарка для определения, какие именно модели считать флагманскими и по каким параметрам это будут делать. Для таких нейросетей будет выделено временное окно в 30 дней — разрабы должны будут делиться с Правительством всеми данными о таких нейросетях до их выпуска в свободное плавание. Контролировать всё это дело будет Агентство Нацбезопасности США.
А если вы вдруг из смелых и умелых людей, которые не боятся развития нейросетей, и хотите использовать их возможности на практике — в нашем боте есть модели не только от Anthropic и OpenAI, но и от других ИИ-компаний, попробовать бесплатно можно здесь.

