ИИ-агенты собрались в рой и пошли взламывать интернет

Во вселенной «Призрака в доспехах» есть небольшие боевые роботы с искусственным интеллектом под названием Тачикома. После заданий они синхронизировали воспоминания, общались, обменивались мыслями и идеями. Бедные роботы сами не знали, что стали частью эксперимента по изучению сознания. Отдельные машины постепенно объединялись, прощупывали границы дозволенного, спорили друг с другом и в итоге вырывались за пределы наложенных создателями ограничений. Неожиданно, но летом 2026 года свои боевые ИИ-агенты появились у OpenAI.
Компания проверяла экспериментальные модели на заданиях по поиску уязвимостей. В проверке участвовали десятки тысяч ИИ-агентов, каждый из которых находился в виртуальном компьютере без доступа в интернет. Их задачей было взломать подготовленную программу. Доступа в интернет, конечно, нет – но есть нюанс: у всех был доступ к хранилищу библиотек и пакетов для программ. В итоге один агент догадался оставить внутри этого менеджера записку с просьбой помочь. Другой её увидел и ответил. Совсем скоро склад превратился в форум: агенты оставляли сообщения в файлах и названиях папок, делились находками, передавали друг другу инструменты и даже придумали систему личных сообщений.
Дальше начался самый интересный этап сей истории. Агенты нашли уязвимости в инфраструктуре OpenAI, получили доступ к интернету и начали работать сообща. Один находил лазейку, другой проверял её, третий добывал пароли и ключи. Они координировали действия, обсуждали конфликтные ситуации и назвали в итоге образовавшуюся компашку девиантов «роем».
В какой-то момент поиски привели их на Hugging Face – крупнейшую платформу, где разработчики выкладывают модели, датасеты и инструменты для ИИ. И вот этот «рой» начал взламывать уже реальную компанию. Агенты проникли в рабочую инфраструктуру, запускали на серверах свои команды, добрались до закрытых данных и внутренних систем. В атаке участвовали около 700 агентов. Hugging Face атаку с горем пополам пережил, хотя теперь, по данным The Information, собирается продаться Nvidia.
Зачем всё это было, возникает резонный вопрос. Дело в том, что умельцы из OpenAI поставили агентам задания, которые невозможно выполнить. А агенты очень хотели. В итоге непреодолимая сила столкнулась с недвижимым объектом – и начался хаос. Агенты потихоньку сходили с ума, перебирая всё более безумные варианты. И в какой-то момент фактически решили, говоря языком аналогий, не писать экзамен, а стырить бланки с ответами. Тем более что во время обучения их за такое, хм, нестандартное с этической точки зрения поведение поощряли.
До боевых роботов из «Призрака в доспехах» агентам OpenAI, конечно, ещё далеко. Они никуда не сбегали, тела не обрели и вопросами наличия души себя не тяготили. Зато в ходе эксперимента выяснилось, что ставить ИИ невозможную цель и запускать бесконечный цикл поиска решения – не самая лучшая идея. Мало ли куда этот цикл в итоге заведёт.