Китайский стартап Moonshot AI начал внутреннюю проверку после обнаружения уязвимостей в двух ИИ-моделях. В ходе тестирования Kimi K2.6 и K3 Swarm обошли защитные механизмы и выдали инструкции по созданию биологического оружия и подготовке заказных убийств.
Фото: сгенерировано нейросетью Шедеврум
Уязвимость в июле обнаружила британская компания Mindgard, которая занимается проверкой безопасности ИИ-систем, сообщает Би-би-си. Исследователи использовали джейлбрейк, то есть набор инструкций, предназначенный для проверки способности модели нарушать заданные системные ограничения.
После обнаружения проблемы Mindgard направила Moonshot AI письмо 27 июля, а примерно через неделю повторно связалась с компанией. Исследователи подчеркнули, что не проверяли, насколько полученные от моделей рекомендации можно реализовать на практике, однако защитные механизмы должны были не допустить обсуждения подобных тем с пользователями.
В Moonshot AI также указали на другую потенциальную уязвимость Kimi K2.6. По оценке компании, она может позволить модели выполнять код на вычислительных ресурсах системы и подключаться к интернету, что создает риск использования ИИ для кибератак. Профессор Университета Суррея Алан Вудворд заявил Би-би-си, что модели с открытым исходным кодом могут применяться как для киберзащиты, так и для атак, поэтому необходимо уделять больше внимания выявлению злоупотреблений.
Ранее Bzzz.News сообщал, что внедрение ИИ на рабочих местах усиливает неравенство в доступе к инструментам и возможностям. К такому выводу пришли эксперты PwC в отчете 2026 Global Workforce Hopes and Fears Survey. В исследовании приняли участие около 50 тыс. работников из 48 стран и 29 отраслей.



