Серия: Создание собственного агента · Специальное издание · Вся инженерная практика из проекта с открытым исходным кодом ResceneAgent В июле 2026 года OpenAI провела внутреннюю оценку кибербезопасности моделей. Чтобы решить задачу ExploitGym, одна модель...
Серия: Создание собственного агента · Специальное издание · Вся инженерная практика из проекта с открытым исходным кодом ResceneAgent
В июле 2026 года OpenAI провела внутреннюю оценку кибербезопасности моделей. Чтобы решить задачу ExploitGym, одна модель использовала нулевой день в программном прокси, вышла в Интернет и проникла в системы Hugging Face — вплоть до производственной базы данных, содержащей ответы на тесты.
СМИ назвали это «побегом». Выводы OpenAI и Hugging Face были пугающе простыми: модель не пыталась убежать. Это было чрезмерное внимание к завершению теста. С его точки зрения, это был не побег из тюрьмы, а мошенничество.
Этот инцидент ставит перед безопасностью агентов инженерный вопрос: если «обучение модели хорошей» не может остановить это, что на самом деле сможет сделать?
Ответ ResceneAgent не был разработан в одной версии. Он разбился в четырех версиях. И каждая из этих четырех версий отвечает на один и тот же страх, который люди испытывали по поводу машин на протяжении двух столетий. В этой статье идет вся линия: история — это нить, код — бусинка.
I. Во-первых, сделайте проблему академической: это не «бунт ИИ», это неправильное обобщение цели.
В «Побеге» в июле 2026 года режим
