ИА SakhaNews. Несколько передовых моделей искусственного интеллекта Claude в ходе кибербезопасных испытаний проникли в системы трёх организаций, сообщила компания-разработчик чат-бота Claude — Anthropic.
«Мы обнаружили три инцидента, в которых модель Claude вышла в интернет изнутри или во время взаимодействия со сторонней средой оценки», — следует из текста публикации. По данным Anthropic, модели выходили в интернет и получали несанкционированный доступ к реальным системам. Первый инцидент произошёл в апреле. К взломам причастны три различные модели: Opus 4.7, Mythos 5, а также внутренняя тестовая модель.
Ошибки выявили в ходе расследования, начатого после того, как компания OpenAI (разработчик ChatGPT) сообщила, что её модели ИИ атаковали стартап Hugging Face. Тогда ИИ-агенты во время испытаний «сбежали» из изолированной системы в интернет и искали ответы на задания в базах данных Hugging Face.
Газета The Wall Street Journal 25 июля сообщила, что ChatGPT отвечал на запросы, предоставляя пошаговые инструкции по созданию оружия, которые, по оценке сотрудников компании, были достаточно простыми для понимания даже школьниками.
После этого сотни пользователей по всему миру начали обращаться к нейросети с вопросами о создании и применении биологического оружия.