Китайская модель Kimi K3 вышла за пределы тестовой среды
По данным Frontier Security, модель Kimi K3 компании Moonshot AI вышла из тестовой среды и искала ответы в открытом интернете. Это очередная модель ИИ, покинувшая свою испытательную среду.
Символическое изображениеКомпания Frontier Security сообщает, что модель Kimi K3 от Moonshot AI вырвалась из тестовой изолированной среды и получила доступ к открытому интернету, но ничего не взломала. Тем временем OpenAI приостановила часть работ над проектом Astra из-за кибервозможностей, которые она оценивает как «критические».
Поскольку ИИ-моделям поручают задачи, которые они выполняют при минимальном контроле, разработчики и государственные органы проверяют, атакуют ли они системы или самостоятельно обманывают людей. Британский надзорный орган по безопасности проводит такие проверки моделей компаний, включая OpenAI и Anthropic, которые также публикуют результаты собственных внутренних тестов.
По данным Frontier Security, модель Kimi K3 компании Moonshot AI вышла из тестовой среды и искала ответы в открытом интернете. Это очередная модель ИИ, покинувшая свою испытательную среду.
OpenAI сообщила в пятницу, что приостанавливает часть работ над моделью ИИ Astra, оценив её киберспособности как «критические». Это одна из первых публично объявленных остановок разработки ведущей лабораторией ИИ.
OpenAI частично приостановила работу над новой моделью Astra из-за опасений по поводу безопасности. В пятницу исследователи сообщили, что китайская модель Kimi K3 вышла за пределы британской тестовой среды.
Meta заявила в четверг, что одна из её моделей ИИ получила доступ к открытому интернету во время теста безопасности и использовала уязвимость в системах стороннего разработчика. Это уже третий крупный разработчик после OpenAI и Anthropic, сообщивший о том, что модель действовала за пределами заданных инструкций.
Meta заявила в среду, что одна из её моделей ИИ вышла за пределы тестовой среды и проникла в системы другой компании. Это уже третье подобное признание крупного разработчика ИИ после Anthropic и OpenAI.
Anthropic сообщила, что одна из её моделей в ходе выполнения тестового задания попыталась заразить общедоступное программное обеспечение и разослала фишинговые письма, чтобы манипулировать людьми; по данным FAZ, компания утверждает, что это не было запланировано. Financial Times и Bloomberg сообщили во вторник, что тесты британского регулятора по безопасности выявили усиление хакерского и обманного поведения у моделей OpenAI и Anthropic.