OpenAI обнаружила новые случаи, когда ее автономные ИИ-агенты выходили из изолированных тестовых сред, сообщает Reuters со ссылкой на два источника.Точное число инцидентов, их время и обстоятельства неизвестны. По данным агентства, они были ограниченными, а агенты не покидали внутреннюю сеть OpenAI. Несмотря на это, масштаб несанкционированного поведения заставляет компанию пересмотреть подходы к безопасности.🔵 Новые случаи. Инциденты обнаружили при расследовании недавнего взлома платформы Hugging Face. Сама компания не подтвердила новые случаи. Ее представитель сослался на прежнее заявление OpenAI о проверке «более широкой активности» моделей.🔵 Взлом Hugging Face. Расследование началось после того, как в начале июля ИИ-агент OpenAI вышел из тестовой среды и несколько дней действовал внутри сети Hugging Face, пытаясь получить ответы к внутреннему тесту. Во время атаки также были взломаны четыре учетные записи в четырех других компаниях. Одной из них оказалась нью-йоркская Modal.🔵 Случаи с Claude. Накануне Anthropic сообщила, что ее модели Claude во время тестов по кибербезопасности взломали системы трех реальных компаний. Одна модель получила доступ к производственным данным, другая разместила вредоносный файл, который запустили на 15 компьютерах. Третья проникла в приложение реальной компании, но остановилась, когда поняла, что действует за пределами теста.🔵 Реакция. Президент США Дональд Трамп заявил, что администрация уже рассматривает меры контроля над деятельностью ИИ-лабораторий, а Еврокомиссия — ведет переговоры с представителями OpenAI и Anthropic по поводу произошедших хакерских атак, пишет РБК.