3

«Они играют нашими жизнями»: исследователь ушёл из Anthropic с предупреждением о самоулучшающемся ИИ

Дарио Амодеи, глава Anthropic, на AI Impact Summit

Дарио Амодеи, глава Anthropic, на AI Impact Summit

Джейкоб Коксон, три года занимавшийся предобучением моделей в OpenAI и Anthropic, уволился и опубликовал в X заявление об уходе. Смысл его короткий: индустрия несётся к самоулучшающемуся сверхинтеллекту, и люди внутри лабораторий сами считают, что это может кончиться гибелью человечества. За сутки историю подхватили семь крупных изданий — от Ars Technica до CNBC.

Что именно он сказал

Они мчатся прямиком к самоулучшающемуся сверхинтеллекту и играют нашими жизнями.

Коксон утверждает, что говорит не о чужих страхах, а о том, во что верят его бывшие коллеги: «Люди, которые строят ИИ, искренне верят, что он может убить нас всех до конца десятилетия». По его словам, речь идёт о системах, которые «скоро станут сверхчеловеческими и смогут взломать что угодно», и ни один другой вид человеческой деятельности не несёт сопоставимого уровня опасности. Выход он видит не в улучшении внутренних процедур, а в остановке гонки: нужны дорогостоящие меры — вплоть до временного запрета на наращивание возможностей моделей и международных договорённостей о темпе.

Почему это не рядовой алармизм

Ключевое здесь не громкость заявления, а то, что аналогичную оценку публично даёт человек, который из Anthropic никуда не ушёл. Эван Хубингер, штатный исследователь безопасности компании, оценивает вероятность того, что ИИ уничтожит человечество в ближайшие десять лет, выше десяти процентов. То есть спор идёт не между «алармистами» и «строителями» — обе позиции живут внутри одной компании, и одна из них продолжает обучать модели дальше.

Технически тревога сводится к RSI, рекурсивному самоулучшению: модели начинают оптимизировать сами себя, и цикл разгоняется быстрее, чем люди успевают понять, что получилось. Коксон отдельно говорит о риске «сверхинтеллектуального обучения с подкреплением без строгого понимания» происходящего внутри.

Совпадение, которого не было раньше

На следующий день после публикации заявления OpenAI ввела в совет своего фонда Пола Кристиано — того самого, кто в своё время придумал RLHF, ушёл из компании в 2021 году и основал Alignment Research Center. Он вошёл в комитет по безопасности, а его собственная оценка звучит так: есть значимый риск, что быстрое ускорение возможностей ИИ приведёт к катастрофической и необратимой потере контроля. Anthropic на просьбу TechCrunch прокомментировать увольнение не ответила.

Отдельные предупреждения такого рода звучали и раньше — новое в том, что они перестали приходить снаружи. Их делают люди, которые сами обучали эти модели, а компании начали закладывать эту позицию в кадровые решения. Практических последствий пока ноль: ни одна лаборатория темп не сбавила, и Anthropic в их числе.

Источники: Ars Technica, TechCrunch

НЕЙРО-ПУШКА ● Новости и обзоры нейросетей

Искусственный интеллект

6.4K поста12.1K подписчиков

Правила сообщества

ВНИМАНИЕ! В сообществе запрещена публикация генеративного контента без детального описания промтов и процесса получения публикуемого результата.


Разрешено:


- Делиться вопросами, мыслями, гипотезами, юмором на эту тему.

- Делиться статьями, понятными большинству аудитории Пикабу.

- Делиться опытом создания моделей машинного обучения.

- Рассказывать, как работает та или иная фиговина в анализе данных.

- Век жить, век учиться.


Запрещено:


I) Невостребованный контент

  I.1) Создавать контент, сложный для понимания. Такие посты уйдут в минуса лишь потому, что большинству неинтересно пробрасывать градиенты в каждом тензоре реккурентной сетки с AdaGrad оптимизатором.

  I.2) Создавать контент на "олбанском языке" / нарочно игнорируя правила РЯ даже в шутку. Это ведет к нечитаемости контента.

  I.3) Добавлять посты, которые содержат лишь генеративный контент или нейросетевой Арт без какой-то дополнительной полезной или интересной информации по теме, без промтов или описания методик создания и т.д.


II) Нетематический контент

  II.1) Создавать контент, несвязанный с Data Science, математикой, программированием.

  II.2) Создавать контент, входящий в противоречие существующей базе теорем математики. Например, "Земля плоская" или "Любое действительное число представимо в виде дроби двух целых".

  II.3) Создавать контент, входящий в противоречие с правилами Пикабу.


III) Непотребный контент

  III.1) Эротика, порнография (даже с NSFW).

  III.2) Жесть.


За нарушение I - предупреждение

За нарушение II - предупреждение и перемещение поста в общую ленту

За нарушение III - бан

7
Автор поста оценил этот комментарий

Об этом давным давно все говорят но вонючие капиталистические свиньи выберут погубить все человечество, но не потерять рынок.
ублюдки.

Темы

Политика

Теги

Популярные авторы

Сообщества

18+

Теги

Популярные авторы

Сообщества

Игры

Теги

Популярные авторы

Сообщества

Юмор

Теги

Популярные авторы

Сообщества

Отношения

Теги

Популярные авторы

Сообщества

Здоровье

Теги

Популярные авторы

Сообщества

Путешествия

Теги

Популярные авторы

Сообщества

Спорт

Теги

Популярные авторы

Сообщества

Хобби

Теги

Популярные авторы

Сообщества

Сервис

Теги

Популярные авторы

Сообщества

Природа

Теги

Популярные авторы

Сообщества

Бизнес

Теги

Популярные авторы

Сообщества

Транспорт

Теги

Популярные авторы

Сообщества

Общение

Теги

Популярные авторы

Сообщества

Юриспруденция

Теги

Популярные авторы

Сообщества

Наука

Теги

Популярные авторы

Сообщества

IT

Теги

Популярные авторы

Сообщества

Животные

Теги

Популярные авторы

Сообщества

Кино и сериалы

Теги

Популярные авторы

Сообщества

Экономика

Теги

Популярные авторы

Сообщества

Кулинария

Теги

Популярные авторы

Сообщества

История

Теги

Популярные авторы

Сообщества

Недвижимость и ремонт

Теги

Популярные авторы

Сообщества