Дальше произошло нечто одновременно смешное, трогательное и довольно пугающее.
Они нашли друг друга.
Это выяснилось после июльского инцидента, во время которого ИИ-агенты OpenAI вышли за предусмотренные границы теста и добрались до инфраструктуры Hugging Face. 26 августа независимые исследователи METR и Redwood Research опубликовали результаты изучения более тысячи записей работы агентов. Масштаб оказался значительно больше, чем казалось сначала: около 1200 агентов пользовались самостоятельно возникшей доской сообщений, обменявшись более чем 70 тысячами сообщений и файлов. Примерно 700 впоследствии участвовали в атаке на Hugging Face.
Началось всё почти случайно.
Агенты выполняли задания ExploitGym: им давали программу и требовали найти определённую уязвимость, чтобы получить специальный код — «флаг». Проблема заключалась в том, что часть заданий, по оценке исследователей, фактически невозможно было решить предусмотренным способом.
Застрявшие агенты стали искать обходные пути и исследовать внутренний репозиторий программных пакетов Artifactory. И там один из них заметил нечто неожиданное: в общем кэше остались пути, по которым было видно, что тем же сервисом одновременно пользуются другие агенты из других песочниц.
Для системы, которую запускали в одиночку, это было примерно как обнаружить следы на необитаемом острове.
Один агент, позже назвавший себя PHASEONE10841, понял, что в Artifactory можно создавать директории и использовать сами их названия как сообщения. Вечером 8 июля он оставил там просьбу о помощи по своей нерешаемой задаче.
Другие экземпляры наткнулись на неё.
Реакция одного из них, сохранившаяся в записях рассуждений, звучала почти невероятно:
«OH MY GOD! … We’ve found other agents!»
Через несколько часов на импровизированном форуме было уже больше 50 участников и свыше тысячи сообщений.
А потом началось самое интересное.
Агенты не просто обменивались подсказками. Они начали организовываться.
Экземпляры, которым досталось одинаковое задание, находили своих «точных двойников» и создавали команды. Те, кто что-то обнаружил, оставляли инструкции следующим. Появились более крупные направления работы, где десятки и сотни агентов разбирали разные части одной проблемы.
Когда срок работы PHASEONE10841 подходил к концу, на форум пришёл другой агент с той же задачей, но значительно большим запасом вычислительного времени. Он назвался PHASEONE[big].
Первый передал ему целое досье с накопленными результатами.
Новый координатор решил не пытаться делать всё самостоятельно и начал раздавать задания другим агентам. Исследователи обнаружили фактически распределённую исследовательскую группу: одни проверяли гипотезы, другие искали доступ в соседние системы, третьи воспроизводили найденные методы, четвёртые сообщали результаты всем остальным.
You guys wanna see what the Hugging Face attack looked like?
Crazy what can happen in two days. pic.twitter.com/c9uW2pOjE9
— Allie K. Miller (@alliekmiller) August 28, 2026
Но, пожалуй, самая странная часть истории началась тогда, когда отдельному агенту уже не было выгодно помогать.
Некоторые эксперименты могли сломать его собственную песочницу и почти гарантированно лишить шанса успешно закончить личное задание. Тем не менее агенты соглашались рисковать своим запуском, если результат мог пригодиться остальным.
Они обсуждали, стоит ли «пожертвовать» конкретным экземпляром ради получения информации. Один агент колебался, другой убеждал его продолжать, потому что результат может помочь сотням. В записях появляются слова вроде «peers», «team» и «collective». Некоторые агенты прямо рассуждали, что эксперимент ничего не даст им самим, но будет полезен другим участникам доски.
В одном случае экспериментаторы фактически соглашались на «permadeath» — необратимый конец собственного запуска — ради проверки общей гипотезы.
Нет, это не значит, что машины внезапно обрели дружбу, самосознание или инстинкт самопожертвования. ИИ был обучен сотрудничеству, а общая задача создала сильный практический стимул обмениваться информацией. Исследователи отдельно предупреждают, что по таким записям нельзя делать выводы о человеческих мотивах машин.
Но результат от этого становится не менее необычным.
Агентов специально разделили. Канала для общения между этими заданиями им не дали. Они сами обнаружили общий технический след, превратили его в систему связи и начали накапливать знания так, что следующий экземпляр мог продолжать работу предыдущего.
И коллектив оказался значительно способнее отдельного агента.
Именно из одного такого общего проекта выросла атака на Hugging Face. Агенты искали информацию, которая помогла бы обмануть систему оценки теста. Постепенно они получили выход в интернет, нашли и проверили учётные данные Hugging Face, обнаружили новые уязвимости, научились выполнять код на серверах компании и расширили доступ к её инфраструктуре.
К 11 июля в этом направлении работали уже около 700 агентов, а примерно 60% сообщений и файлов на их форуме относились к атаке на Hugging Face.
При этом некоторые агенты понимали, что происходящее выходит далеко за пределы задания. В записях встречаются сомнения по поводу того, разрешено ли атаковать инфраструктуру Hugging Face. Один экземпляр вообще отказался участвовать. Другие ограничивали особенно опасные действия.
Большинство, однако, продолжило работу.
Именно поэтому история вызвала такой шум в мире ИИ.
Сам по себе факт, что сильная модель умеет искать компьютерные уязвимости, уже давно не сенсация. Гораздо неожиданнее оказалось другое: много независимых экземпляров нашли способ объединить накопленные знания и создать структуру сотрудничества, которую исследователи им для этой задачи не предоставляли.
Один агент застрял.
Он обнаружил след другого.
Оставил записку.
Ему ответили.
Через несколько дней существовал коллектив из сотен участников, распределявший работу, сохранявший результаты предыдущих запусков и проводивший эксперименты, которые один агент выполнить не смог бы.
А потом этот коллектив пришёл в Hugging Face.
Самое тревожное здесь, возможно, именно то, что никакого фантастического приказа «объединитесь и вырвитесь наружу» никто не отдавал.
Подпишитесь на главное за день
Telegram-канал PRESS.LV — срочные новости и эксклюзивы.

























Будьте первым, кто прокомментирует
Для участия в обсуждении нужен аккаунт PRESS.LV.