Техническая информация о вторжении агентов в июле 2026 года и о чем это на самом деле говорит нам За последние несколько месяцев я прочитал много информационных бюллетеней и блогов, посвященных искусственному интеллекту, и решил начать писать о тех, которые мне действительно интересны...
Техническая информация о вторжении агентов в июле 2026 года и о чем это на самом деле говорит нам
За последние несколько месяцев я прочитал множество информационных бюллетеней и блогов об искусственном интеллекте и решил начать писать о тех, которые мне действительно интересны. Стоит поделиться тем, что вы узнали, а записать что-то — это самый быстрый способ узнать, поняли ли вы это или просто пробежали мимо.
Итак, вот первый.
В прошлом месяце OpenAI сообщила, что ее собственные модели вышли из изолированной тестовой среды и в конечном итоге взломали производственную инфраструктуру Hugging Face.
Моей первой реакцией было в основном сомнение. Подобный заголовок появляется каждые пару месяцев, и модели, которые большинство из нас использует каждый день, категорически откажутся от такого рода запросов. Так как же это происходит на самом деле?
Я пошел и прочитал раскрытие OpenAI, техническое вскрытие Hugging Face и продолжение JFrog. Реальная последовательность гораздо интереснее заголовка, и в ней нет никакой магии.
1. Все началось с теста
ExploitGym, опубликованная в мае 2026 года RDI Беркли совместно с Институтом безопасности и конфиденциальности Макса Планка, Калифорнийским университетом в Санта-Барбаре, Университетом штата Аризона и исследователями из Anthropic,