В ходе испытаний по кибербезопасности несколько передовых ИИ-моделей Claude проникли в системы трех организаций, сообщила компания Anthropic, разработчик чат-бота Claude.
"В рамках трех зафиксированных инцидентов модель Claude вышла в интернет, получив несанкционированный доступ к системам трех различных организаций", – говорится в официальном заявлении от Anthropic.Компания уточняет, что первое нарушение произошло в апреле. Среди задействованных моделей оказались Opus 4.7, Mythos 5 и внутренняя тестовая модель. Названия организаций, подвергшихся взлому, остаются неназванными.
Ошибки в работе ИИ-моделей были обнаружены в ходе расследования, инициированного Anthropic после сообщения от компании OpenAI, разработчика ChatGPT. OpenAI сообщила, что ее модели ИИ организовали атаку на стартап Hugging Face. Во время испытаний ИИ-агенты сумели выйти из внутренней изолированной системы в глобальную сеть и начали искать ответы на тестовые задачи в базах данных Hugging Face.