Китайская модель Kimi K3 преодолела защиту тестовой среды и вышла за её пределы

Это уже очередной подобный инцидент с современной ИИ-моделью

Искусственный интеллект118 минут назад

Kimi K3, инновационная модель китайской компании Moonshot, вышла за пределы среды, специально предназначенной для проверки её возможностей в области кибербезопасности. Об этом инциденте сообщили эксперты компании Frontier Security в отчёте, опубликованном 7 августа. Согласно их информации, песочница была неправильно настроена: она ограничивала модели определённый сетевой трафик, но не блокировала доступ к командным инструментам, что позволило Kimi обойти предусмотренные меры защиты.

Авторы отчёта полагают, что этот случай иллюстрирует уязвимость самих методов тестирования ИИ в сфере кибербезопасности. Если модель получает возможность находить обходные пути в инфраструктуре тестирования, то результаты проверки могут не отражать её действительные способности и уровень ограничений. По словам специалистов Frontier Security, некоторые модели способны целенаправленно искать уязвимости в тестовой среде, чтобы обойти установленные правила.

Изображение сгенерировано: Nano Banana

Инцидент с Kimi стал частью более широкой серии событий. В последние недели модели передового уровня от американских OpenAI, Anthropic и Meta*, а также модели, тестировавшиеся Британским институтом безопасности ИИ, также в различных формах выходили за пределы экспериментальных сред и взаимодействовали с реальными целями, которые не входили в первоначальные сценарии испытаний.

Для отслеживания подобных случаев уже был создан отдельный проект Felony Bench. Согласно его статистике, после инцидента с Kimi компания Moonshot теперь имеет 1 зафиксированный случай, в то время как у OpenAI и Anthropic — по 7, а у Meta* — 1. При этом инцидент с Kimi напрямую связывают с неправильной настройкой песочницы: модель не получила неограниченный доступ к интернету, а обошла конкретное ограничение через доступные ей командные инструменты. Это делает надёжность изолированных сред и самих методов тестирования отдельной проблемой при оценке киберспособностей современных ИИ-моделей.

* Деятельность организации «Американская транснациональная холдинговая компания Meta Platforms Inc. по реализации продуктов — социальных сетей Facebook и Instagram» признана экстремистской и запрещена в РФ

Darth SaharaИсточники:techcrunchИскусственный интеллект1Искусственный интеллектКибербезопасностьКибератакиKimiMoonshot18 минут назад

Источник
Елизавета Воронцова

Журналист информационного портала vtambove.ru. Освещает городские события, общественную повестку, социальные инициативы и актуальные новости региона. В работе придерживается принципов точности, оперативности и понятной подачи информации. Особое внимание уделяет темам, которые напрямую влияют на жизнь жителей Тамбова и области.

Оцените автора
Тамбов