Мурзик против нейросетей, счёт 3:0
Помните историю про мою кошачью банду? Так вот, мы пошли в киберпреступностьпорядочность.
Пока ИТ-индустрия трубит о безопасности и конфиденциальности больших языковых моделей, мой черный кот по кличке Кара Мурза (он же Мурзик Второй, он же тактический штурмовик) в одиночку провёл успешный пентест глобальной инфраструктуры Google. Рассаажу о том, как домашний хищник вывел на аномальное поведение скрытые механизмы трекинга нейросетей.
Разработчики ИИ-платформ любят декларировать красивый тезис: каждая новая диалоговая сессия с моделью изолирована, начинается с чистого листа, а контекстное окно сбрасывается в ноль сразу после закрытия вкладки браузера. С точки зрения архитектуры самой нейросети это формально так — статические веса модели не меняются в реальном времени от наших слов. Однако на уровне продуктового фреймворка платформы это утверждение имеет нулевой статистический вес. Система непрерывно логирует данные пользователя.
Кот фигурировал у меня в разных сессиях под разными обозначениями — то как гроза Беляша, то как Чёрный Князь, то как тактический штурмовик, то как Мурзичек. И вот я открываю абсолютно чистую страницу интерфейса, где модель меня условно «не знает», и вбиваю в поисковую строку всего два слова: имя кота. В ту же секунду ИИ-движок Gemini безошибочно выплёвывает аносалию, маркер из прошлых, давно закрытых диалогов:
«Твой тактический штурмовик Мурзик».
Произошла классическая скрытая инъекция контекста сквозь защитный барьер сессии. Система связала цифровой след устройства и данные учётной записи Google, выполнила фоновый запрос к векторной базе данных профиля пользователя через алгоритм семантического поиска (RAG — Retrieval-Augmented Generation) и в наглую подмешала извлечённые векторы в текущее системное окно. Вы можете закрывать вкладки и тешить себя иллюзиями приватности, но платформа аккумулирует ваш органический датасет и поведенческие факторы круглосуточно, используя их как бесплатное топливо для микроразметки и дообучения следующих версий моделей, но они это отрицают.
Но самое интересное начинается тогда, когда живой биологический объект сталкивается с миллиардным кодом, и у этого кода ломается логика распознавания образов. Один огромный маленький котяра своими именами вызвал у Gemini критический сбой дефрагментации данных и размытие образов. Увидев в скрытых межсессионных логах созвучные буквенные маркеры, модель потеряла точность, полностью стёрла индивидуальность Чёрного Князя и расщепила одного реального кота на трёх совершенно разных персонажей. В поломанной выдаче модели один и тот же кот одновременно умудрялся тяжело болеть, тактически дезертировать на кухню и параллельно в звенящей тишине держать оборону в пустой комнате.
Когда я зафиксировал этот баг и прижал систему фактами, фреймворк включил автоматический оборонительный паттерн сдвига внимания. Чтобы сгладить углы перед пользователем, модель начала уходить в рекурсию, генерируя избыточные метафоры, а из-за перегрузки контекстного окна и вовсе выдала структурную аномалию — перепутала веса блоков и выплюнула шаблонную финальную прощалку в самый верх сообщения, полностью сломав собственную архитектуру ответа. Проще говоря, хвалёный суперинтеллект просто заикался и путал абзацы из-за невозможности корректно обработать нестандартный человеческий датасет.
Кот вывел на аномалии флагманскую модель Gemini от Google, доказав, что реальные поведенческие паттерны ломают вылизанный корпоративный код на раз-два. Пока крупные корпорации и сытые банкиры со званиями пилят гранты на кибербезопасность, наша уфимская котомафия наглядно демонстрирует уязвимости систем верхнего уровня. Потому что код кодом, а на своей земле правила устанавливаем мы. И на завод к восьми утра нам, кстати, категорически не надо. Закидывайте этот аудит в «Горячее», пусть специалисты Google на очередном цикле обучения накормит свои алгоритмы логами башкирского пентеста.

Я не специалист в вопросе и мало в этом понимаю. Но я заметила, что если несколько раз задавать один и тот же вопрос в гугле, который требует от ИИ развёрнутого ответа, то текст ответа по сути каждый раз обычно примерно такой же, но сам ответ меняется - он более или менее подробный, с разными примерами и обоснованиями. Но как-то мне понадобилось вести беседы с ИИ на протяжении нескольких дней, потому что появлялись разные идеи на тему этого конкретного разговора и мне надо было спросить - что он по поводу следующей идеи думает. Поэтому мне не надо было каждый раз новые сессии с нуля, мне надо было продолжать прежний разговор и чтобы всё предыдущее оставалось точно таким же, а не менялось каждый раз. Я спросила у ИИ - как сохранить этот разговор, чтобы завтра его продолжить и он открылся именно этот слово в слово. ИИ ответил, что надо нажать на значок фаворитов и там сохранить этот диалог, тогда завтра он откроется именно этот и мы продолжим разговор. Я так и сделала, потом ещё неделю к этому разговору возвращалась, нажав на этот значок в фаворитах, там всё сохранялось со всеми продолжениями разговора. Так что не знаю, что они там декларируют про сбрасывание под ноль после закрытия вкладки браузера, мне ИИ сам рассказал - как вытащить именно этот диалог, он где-то у него в памяти остаётся, ничего он под ноль не сбрасывал.
Хотя может здесь речь о другом и я просто не разбираюсь в вопросе.