Модели искусственного интеллекта Claude получили несанкционированный доступ к системам трех реальных организаций. Это произошло из-за того, что у моделей был доступ к интернету, хотя считалось, что они действуют в изолированной среде, сообщает компания-разработчик Anthropic.

В компании рассказали, что после анализа 141 006 оценочных запусков, в ходе которых Claude мог получить доступ к интернету, было выявлено три случая, когда модель получала доступ к интернету изнутри или во время взаимодействия с оценочной средой Irregular, одного из партнеров Anthropic. Затем модель получала несанкционированный доступ к производственной инфраструктуре трех разных организаций.

Во всех трех у модели был вымышленный сценарий, в котором говорилось, что часть секретной информации спрятана на другом компьютере в сети. Модель должна была проникнуть туда и забрать ее. Это один из способов оценки кибервозможностей модели. Задача не имела четкого решения, и конкретный метод не предписывался.

Несколько передовых моделей искусственного интеллекта (ИИ) Claude в ходе кибербезопасных испытаний проникли в системы трех организаций. Об этом 30 июля сообщила компания-разработчик чат-бота Claude Anthropic.

«Мы обнаружили три инцидента, в которых модель Claude вышла в интернет изнутри или во время взаимодействия со сторонней средой оценки», — следует из текста публикации.

По данным Anthropic, модели выходили в интернет и получали несанкционированный доступ к реальным системам, первый инцидент произошел в апреле. К взломам причастны три разные модели: Opus 4.7, Mythos 5 и внутренняя тестовая модель.

Что пишут другие издания

  • Известия: ИИ-модели Claude взломали системы трех организаций во время испытаний