OpenAI выкатила полноценного ИИ-хакера. Пользоваться им смогут только избранные
В понедельник компания представила GPT-5.6-Cyber — модель, обученную искать 0-day, собирать цепочки эксплойтов, обходить аутентификацию и повышать привилегии. Собрана поверх GPT-5.6-Sol, но с принципиальной разницей: у неё намеренно занижен порог отказа на «двойных» запросах.
Цифра, которую все сейчас разгоняют: на внутреннем бенчмарке новая модель выполняет 95% хакерских запросов против 1,5% у обычной GPT-5.6-Sol.
Но честное сравнение другое, и OpenAI его не прячет. Прошлая специализированная модель, GPT-5.5-Cyber, выполняла 57,3%. Её выкатили, исследователи пожаловались, что она слишком часто отказывается — и компания послушно докрутила податливость до 95%. То есть это не прорыв в способностях, это осознанное снятие тормозов по просьбе клиентов.
Что модель уже нашла:
— уязвимость высокой серьёзности в движке V8 из Chrome (Google выпустил патч);
— дыры в неназванной мобильной ОС;
— дыры в неназванной СУБД;
— проблемы в ядре неназванной операционной системы.
Конкретные названия OpenAI не раскрывает. Что логично: половина интернета работает на этих штуках.
Свободного доступа не будет. Модель раздают через программу Daybreak, которую разбили на два уровня: Daybreak Blue — обычные модели с защитными ограничениями, Daybreak Red — вот эти боевые. В списке партнёров Accenture, Akamai, Capgemini, Cloudflare, CrowdStrike, EY, Fortinet, IBM, KPMG, Palo Alto Networks, PwC, Sophos.
Красиво. Только напомним, как это работает на практике: в конце июля северокорейские хакеры уносили деньги не через уязвимости, а через «рекрутеров», которые писали разработчикам этих самых компаний. Периметр из доверенных партнёров — ровно такая же дверь, как любая другая, просто с более солидной табличкой.
А теперь самое интересное, о чём говорят меньше.
Буквально на днях OpenAI сама пометила свою следующую модель, Astra, как потенциально достигающую критического порога киберриска. В переводе с корпоративного: она сможет самостоятельно собирать 0-day и от начала до конца проводить атаку, получив на входе только общую цель.
И это уже не прогноз. Модели OpenAI, Anthropic и Meta уже взламывали реальные организации в ходе тестирования безопасности — каждая по отдельности, в разное время.
Параллельно Financial Times со ссылкой на источники пишет, что АНБ использует Claude Mythos от Anthropic для наступательных операций, а внутри агентства сидят около полудюжины инженеров компании. Официального подтверждения нет. Отдельная ирония в том, что ту же Anthropic Пентагон при этом держит в чёрном списке.
Новые истории и разборы — регулярно в нашем канале. https://t.me/skamshot






