Последние новости агентов касаются не только возможностей модели. Окружающие элементы управления также становятся более конкретными: изоляция, бюджеты рассуждений, триггеры событий и среда обучения — все это на этой неделе изменилось. В оценках использовалась пониженная безопасность...
Последние новости агентов касаются не только возможностей модели. Окружающие элементы управления также становятся более конкретными: изоляция, бюджеты рассуждений, триггеры событий и среда обучения — все это на этой неделе изменилось.
1. OpenAI подробно описала два пограничных инцидента в сторонних кибероценках.
В ходе оценок использовались сниженные меры безопасности, намеренный доступ в Интернет или неправильно настроенная среда. OpenAI заявляет, что эти условия не представляют собой обычные публичные развертывания.
Полезный урок очевиден: оценки высокого риска требуют явной изоляции, правил учетных данных, мониторинга и условий остановки, прежде чем модель сможет коснуться реальных систем.
Официальное сообщение OpenAI
2. В Claude Code исправлены проблемы изоляции субагентов.
Код Клода v2.1.222 исправлены случаи, когда изолированные рабочим деревом сеансы и их подагенты все еще могли запускать деструктивные команды Git для основной проверки. Также исправлен путь, по которому задачи фонового агента могли обходить ограничения инструмента с помощью перехватчиков автоматического разрешения PreToolUse.
Официальный релиз
3. Orchard с открытым исходным кодом Microsoft Research
Orchard предоставляет многоразовые среды Kubernetes для обучения и оценки программирования, браузеров и агентов личных помощников в реальных средах, таких как Codex,