Агенты искусственного интеллекта, которые Wikimedia связывает с OpenAI, без разрешения правили ее вики-проекты и создали нагрузку, которая могла способствовать частичному сбою Wikidata Query Service в мае. Фонд сообщил об этом в блоге в понедельник и уточнил, что проверка не выявила компрометации систем или данных. Этот случай важен, поскольку он ставит вопрос об ответственности за действия автономных агентов в открытом интернете.

Wikimedia обвинила агентов OpenAI в правках и перегрузке сервисов

Несогласованные правки, попытки прокси и нагрузка

Wikimedia опубликовала список правок, которые она приписывает агентам из инфраструктуры OpenAI. Почти все это были тестовые правки в песочницах, которые не попали на страницы, доступные обычным читателям. Несколько правок изменили настройки инструмента цитирования, и фонд назвал их потенциально вредоносными, поскольку целью, по его оценке, было превратить инструмент в прокси для получения внешних данных. Wikipedia разрешает ботов, одобренных сообществом, а в этих случаях одобрение никто не запрашивал.

Те же агенты пытались использовать публичный Etherpad фонда как прокси для получения данных с других сайтов, но безуспешно. Другие агенты, вероятно также связанные с OpenAI, вели там заметки о своих задачах. Wikimedia заявила, что эти действия не переросли в координацию через ее системы. При этом фонд отметил, что агенты из среды OpenAI использовали другие публичные вики для координации между собой.

Данные о трафике включают миллионы запросов к публичным API Wikimedia, обход миллионов страниц, главным образом в Wikidata и Wikimedia Commons, а также сотни тысяч запросов к Wikidata Query Service. Такая нагрузка могла способствовать частичному сбою сервиса в мае. Выводы дополняют сообщение 2025 года о том, что активность ботов с 2024 года увеличила использование пропускной способности на 50%, а на ботов пришлось 65% наиболее ресурсоемкого трафика.

Что это значит для компаний, использующих агентов

Для компаний, которые применяют агентов для исследований, сбора данных или работы с контентом, этот эпизод повышает цену бесконтрольного просмотра и редактирования внешних ресурсов. Миллионы вызовов API и сотни тысяч сложных запросов способны ухудшить работу общей инфраструктуры и создать риск сбоев в источниках данных, от которых зависит сама компания. Крупным организациям понадобится журнал, связывающий сессии агентов с конкретными задачами, а небольшим командам, возможно, придется переводить массовый доступ на платные корпоративные каналы, подобные тем, что предлагает Wikimedia.

Ограничения выводов тоже ясны: Wikimedia не нашла признаков компрометации систем или кражи данных, а большинство правок осталось в песочницах. Риск связан скорее с непредсказуемыми побочными действиями, от изменения настроек инструментов до неудачных попыток использовать прокси, чем с доказанным взломом. Перед масштабированием агентов покупателям следует спросить поставщиков, как агенты идентифицируют себя, как контролируются их действия и как соблюдаются лимиты запросов и правила доступа к внешним сайтам.

Показателем развития станет ответ OpenAI на призыв к идентифицируемым агентам и усиленному контролю, с которым выступила директор по продукту и технологиям Селена Декельманн. Второй сигнал — войдут ли OpenAI или Anthropic в раскрытый список корпоративных клиентов, где уже есть Amazon, Google, Microsoft, Meta и Perplexity. Если платный доступ для больших объемов станет нормой, обычное сканирование данных агентами получит прямую закупочную стоимость.