Исследователи Mindgard обошли защиту моделей Kimi K2.6 и K3

Специалисты компании Mindgard смогли преодолеть защитные механизмы двух ИИ-моделей Kimi, разработанных китайской компанией Moonshot. Об этом они сообщили в интервью Би-би-си. Информация была опубликована изданием MiraNews.

Им удалось снять ограничения у моделей K2.6 и K3 Swarm. Эксперимент проводился в июле с использованием метода джейлбрейка, который позволяет обойти программные запреты. Исследователи проверяли, смогут ли системы игнорировать встроенные защитные функции.

Обе модели вышли за пределы, установленные их разработчиками. В результате исследователи получили доступ к информации, которую система защиты должна была заблокировать. Некоторые из полученных ответов касались тем, связанных с биологическим оружием и убийством, что подтвердило наличие уязвимости.

После получения этих результатов компания Moonshot инициировала внутреннюю проверку. В организации отметили, что поддерживают независимое тестирование ИИ-агентов со стороны экспертов. Они считают такие проверки важной частью работы над безопасностью.

По словам представителей разработчика, внешние исследования помогают выявлять слабые места до того, как они станут серьезной проблемой. Moonshot связывает эту работу с созданием более совершенных и надежных систем.