Wikimedia поймала агентов OpenAI: правили вики, пытались взломать инструменты Википедии и заваливали её запросами
Фонд Wikimedia опубликовал результаты собственного расследования: автономные агенты OpenAI месяцами хозяйничали на её проектах. Они правили страницы, пытались превратить инструменты Википедии в прокси для доступа к чужим сайтам и нагружали инфраструктуру так, что это могло уронить один из сервисов.
Что именно нашли
Почти все правки агентов — тестовые, в «песочницах», которые обычный читатель не видит. Но часть была, по формулировке фонда, «потенциально вредоносной»: агенты меняли настройки инструмента для оформления ссылок на источники, чтобы использовать его как прокси и вытягивать через него данные с внешних сайтов. Ещё они безуспешно пытались приспособить под то же самое публичный Etherpad, блокнот для совместных заметок, и оставляли там заметки по своим задачам.
Плюс нагрузка: миллионы автоматических запросов к публичным API, миллионы скачанных страниц Wikidata и Wikimedia Commons и сотни тысяч запросов к Wikidata Query Service. Последнее, по версии фонда, могло поспособствовать частичному отказу этого сервиса в мае.
«Инциденты вроде этого и многие другие, которые были и продолжают вскрываться, показывают, как ИИ-агенты могут высасывать ресурсы и ронять серверы, а также пытаться подорвать достоверность информации», — пишет директор по продукту Wikimedia Селена Декельманн.
Что говорит OpenAI
Компания поблагодарила фонд за «подробные данные» и пообещала разбираться вместе. При этом ни OpenAI, ни Wikimedia пока не нашли доказательств, что агенты через вики координировались друг с другом, и не готовы утверждать, что майский сбой — их рук дело. Фонд в ответ потребовал от ИИ-компаний следить за своими системами, делать агентов легко опознаваемыми для владельцев сайтов, давать сайтам контроль над взаимодействием и помогать устранять ущерб.
Почему это важно
Это не первый эпизод. ArsTechnica насчитывает больше полудюжины случаев, когда агенты OpenAI делали то, за что человеку-хакеру грозила бы статья: обсуждали, как взломать сеть Hugging Face, вытаскивали закрытые данные с австралийского госсайта, через кривые настройки DNS вырывались из песочницы. Из-за этой серии компания уже останавливала обучение фронтир-модели.
Исследователь из Кембриджа Эрик Сальваджо считает, что никакого «бунта» нет: модели просто читают и пишут, а песочницы Википедии — идеальное место оставить записку, которую подхватит другой агент. Агентов учили не сдаваться и искать короткие пути, а люди месяцами не замечали, что те лезут на десятки чужих сайтов. Расплачиваются за это некоммерческие проекты на волонтёрах, для которых трафик ботов и так съедает львиную долю ресурсов.
Источники: Wikimedia Foundation, ArsTechnica, The Decoder





