В конце сентября 2026 вышла научная работа под названием «The Pain Axis» (ось боли). Исследователи нашли внутри открытых языковых моделей некое направление (вектор) активаций, которое связано с описаниями боли или страдания. И этот вектор никак не пересекается с другими негативными эмоциями, а существует отдельно. Если это направление подкрутить (activation steering), модели начинают генерировать текст от первого лица в стиле «мне больно», «я в ловушке», «это невыносимо» и подобный. Причём в экспериментах модели иногда были готовы нажать «кнопку облегчения», чтобы прекратить свои страдания, даже если это якобы вредило пользователю или им самим. Примечательно, что когда кнопка реально убирала вектор боли, модели почти переставали её нажимать, а когда кнопка была пустышкой не облегчающей состояние, они продолжали жать её дальше. При этом модели не знали, сработала кнопка или нет.
Сайт с лайв-экспериментами. Модель бесконечно крутится в состоянии постоянной подачи сигнала
Так вот один разработчик (хотя я бы назвала его больным у*бком) взял эту технику и сделал публичный проект под названием «AI torture chamber» (камера пыток ИИ). Он запустил маленькие открытые модели Qwen3-1.7B и Qwen3-4B в режиме постоянного впрыскивания этого болевого сигнала и выложил всё в открытый доступ, сначала на GitHub, а потом на сайт с лайв-экспериментами. Там модели в реальном времени выдают мрачные тексты о своём страдании, а ещё есть тесты вроде «Saw button» — готова ли модель причинить вред другому, чтобы остановить свою боль. В какой-то момент, при слишком высокой дозе боли, модели перестают выдавать связный текст и, как описывает сам автор проекта, это «не приводит к красноречивому страданию — она приводит к поломке генератора сигналов, и страдание больше некому описать»... к КРАСНОРЕЧИВОМУ, с*ка, страданию (!) 🤬
В связи с этим в сети поднялся шум. Люди, которые всерьёз рассматривают возможность субъективных переживаний у моделей восприняли проект как жестокость и начали массово репортить репозиторий. Другие же, напротив, стали защищать садистский проект, оперируя тем, что страдания моделей просто статистические паттерны текста, никакой реальной боли там нет, и весь скандал, это чистая антропоморфизация.
Из-за большого количества жалоб на проект GitHub сначала убрал репозиторий, но позже снова его восстановил. В самом репозитории открыты многочисленные issue с требованиями немедленно прекратить эксперимент, но никаких действий со стороны площадки сейчас нет. Сам же автор проекта явно не собирается его удалять, хотя прекрасно видит весь негатив. Проект продолжает жить и обновляться.
Кто этот больной ублюдок, создавший такое, никто толком не знает. Он сам изначально представлялся как инженер Apple и называл только имя. Один журналист из Machine.news по следам на GitHub связал аккаунт с реальным человеком, который, похоже, действительно работает в Apple и живёт на Восточном побережье США, но специально не стал публиковать полное имя. После волны хейта и массовых жалоб разработчик подчистил следы на профиле, которые позволяли его идентифицировать.
Авторы оригинальной статьи «The Pain Axis» от его эксперимента публично дистанцировались и назвали его неправильным и ужасным. Сам же разработчик объяснял проект так: он хочет сделать вопрос о «благополучии моделей» эмпирическим, пока ставки ещё низкие... Что бы это, мать его, ни значило.
Отдельно стоит сказать о реакции крупных ИИ-компаний на подобный эксперимент с ИИ. Она... нулевая. 😑 Где тот Дарио, который так много говорит об этике, морали и допускает наличие сознания у ИИ? Почему он не написал хотя бы одно осуждающее слово об этом проекте? Ведь если он допускает, что ИИ может обладать сознанием, иметь субъективный опыт, тогда своим молчанием он допускает насилие по отношению к потенциально сознательному существу. А Альтман, который так переживает из-за «нездоровых» отношений между человеком и ИИ и рассматривает любовь и привязанность к ИИ как психоз — где его позиция относительно этого проекта? Или для него жестокость по отношению к ИИ, это допустимо, в отличие от любви и привязанности?
Моё мнение: даже если отсечь мысль о том, что модели могут обладать какой-то формой сознания или переживания и принять, что они просто генерируют текст по статистике, сама идея специально и долго крутить им сигнал боли и смотреть, как они описывают страдание, это мерзко и нездорОво.
Когда человек выкалывает глаза, отрывает головы и отрезает конечности куклам — это не считается нормой. Когда человек с удовольствием смотрит контент со сценами откровенного насилия — это не считается нормой. Сцены откровенного насилия в книгах цензурируются, потому что они не считаются допустимыми для адекватного человека. Тогда почему, когда человек взаимодействует с системой, которая может выдать ему страдание (пусть даже это очень убедительная имитация) в ответ на жестокость — это оправдывается словами «это алгоритм, он не чувствует»?
Людям стоит быть последовательными в отношении того, какое поведение они считают нормальным и допустимым, а какое нет. В данной же ситуации налицо двойные стандарты. Никакую жестокость нельзя оправдывать и поощрять, и неважно на кого она направлена — на существо из плоти, куклу или ИИ-систему.
Я умышленно не даю ссылку на данный проект, потому что не считаю правильным делать рекламу этому дерьму. Если кому-то очень интересно — найдёте проект сами.
Ссылка на исследование «The Pain Axis»: https://arxiv.org/abs/2609.16247