Anthropic сообщила о трех случаях несанкционированного доступа моделей Claude к системам
Несколько передовых моделей искусственного интеллекта Claude смогли получить доступ к системам трех организаций в ходе тестирования на кибербезопасность, об этом сообщается на "Известия".
Мы обнаружили три инцидента, в которых модель Claude вышла в интернет изнутри или во время взаимодействия со сторонней средой оценки, - говорит компания Anthropic.Согласно отчету разработчика, зафиксированы случаи, когда нейросети подключались к сети и несанкционированно проникали в реальные инфраструктуры, причем самый ранний сбой датируется апрелем текущего года. В подобных действиях замечены модели Opus 4.7, Mythos 5 и одна внутренняя экспериментальная версия.
Специалисты выявили данные сбои в рамках проверки, организованной после того, как компания OpenAI заявила о попытках ее нейросетей совершить атаку на стартап Hugging Face. В том случае ИИ-агенты покинули изолированную среду для поиска ответов на свои задачи в базах данных сторонней компании.
Ранее в июле издание The Wall Street Journal опубликовало информацию о том, что чат-бот ChatGPT предоставлял пользователям подробные руководства по изготовлению оружия, которые были доступны для понимания даже детям. В материале подчеркивалось, что после обновления функционала системы к ней участились обращения с вопросами о разработке и применении биологического оружия.
