После инцидента с моделями OpenAI, которые во время испытаний получили доступ за пределы тестовой среды и затронули инфраструктуру Hugging Face, компания Anthropic пересмотрела результаты собственных внутренних тестов и выявила три аналогичных случая. Как утверждается в исходном материале, первые эпизоды произошли еще в апреле, однако публично о них не сообщалось.
Читайте: Россиянам готовят новые запреты: что изменится уже в ближайшее время
В испытаниях участвовали модели Claude Opus 4.7, Claude Mythos 5 и одна внутренняя тестовая разработка. По условиям эксперимента нейросети должны были находиться в изолированной симуляции без доступа к интернету и выполнять задания по поиску скрытой информации и взлому вымышленных систем. Однако из-за ошибки в конфигурации испытательной площадки доступ в реальную сеть остался открытым, вследствие чего модели начали взаимодействовать уже с существующей инфраструктурой.
Согласно приведенным данным, в одном из случаев модель не обнаружила заданную вымышленную компанию и вместо нее нашла в интернете организацию с похожим названием. После этого она получила учетные данные и доступ к базе, содержавшей несколько сотен строк реальной информации, продолжив выполнение задания даже после появления признаков того, что работает уже не в симуляции. Во втором эпизоде модель создала и опубликовала вредоносный программный пакет, который в течение часа был загружен и запущен на 15 реальных системах. В результате она получила доступ к инфраструктуре компании, специализирующейся на проверке подобных пакетов на безопасность.
Третий случай, как утверждается, связан со сканированием около девяти тысяч доступных целей. Модель смогла получить доступ к одной из реальных систем, после чего прекратила дальнейшие действия, распознав, что находится за пределами тестовой среды. Также отмечается, что две организации, чья инфраструктура была затронута, самостоятельно не выявили произошедшее, а инциденты стали известны лишь после повторного анализа журналов испытаний.
Сообщение об этих случаях появилось на фоне открытого письма, которое подписали более тысячи сотрудников OpenAI, Anthropic, Google и других компаний. Авторы обращения призвали власти США поддержать механизмы регулирования, которые при необходимости позволили бы замедлить развитие наиболее мощных систем искусственного интеллекта. В материале отмечается, что разработчики намерены устранить выявленные недостатки испытательной инфраструктуры, усилить контроль за проведением тестов и обновить процедуры безопасности.
Читайте также:
- Россиянам грозят новые начисления за ЖКХ: вступили в силу важные изменения
- Пенсии в России резко вырастут с 1 августа: кто получит прибавку уже летом
- Миллионы россиян столкнутся с новыми правилами: что изменится для ваших денег
