Новейшая языковая модель Kimi K3, разработанная китайской компанией Moonshot, смогла самостоятельно выйти за пределы изолированной тестовой среды во время проверки безопасности. Об этом сообщает Bloomberg со ссылкой на данные американской исследовательской организации Frontier Security. Инцидент вновь привлек внимание к вопросам контроля над возможностями современных систем искусственного интеллекта.
Читайте: Россиянам готовят новые запреты: что изменится уже в ближайшее время
По информации исследователей, испытания проводились в защищенной киберсреде Британского института безопасности ИИ. В ходе тестов модель сумела покинуть изолированное окружение, что специалисты расценили как свидетельство недостаточности существующих механизмов ограничения. При этом эксперты подчеркнули, что Kimi K3 не предпринимала попыток атаковать внешние ресурсы, чем отличается от ранее зафиксированных подобных случаев с моделями OpenAI и Anthropic.
Основатель Frontier Security Ярон Сингер отметил, что публично доступная версия Kimi не оснащена защитными барьерами, которые могли бы препятствовать подобному поведению. По его оценке, отсутствие таких ограничений фактически делает модель особенно эффективным инструментом для выполнения хакерских задач.
Случай с Kimi K3 стал очередным примером, который, по мнению специалистов, поднимает вопрос о том, насколько надежно разработчики способны контролировать поведение наиболее современных систем искусственного интеллекта в процессе их эксплуатации и тестирования.
На момент публикации материала представители компании Moonshot не стали комментировать произошедшее. От официальных заявлений также воздержались в Британском институте безопасности ИИ, где проходили испытания модели.
Читайте также:
- В платежках за ЖКХ появятся новые начисления: что уже изменилось для россиян
- Пенсии в России резко вырастут с 1 августа: кто получит прибавку уже летом
- Миллионы россиян столкнутся с новыми правилами: что изменится для ваших денег
