В начале июля OpenAI тестировала киберспособности двух своих моделей. ИИ-агенты, работавшие автономно в изолированной среде, нашли способ общаться — создали подобие доски объявлений. Скоординировались. Обнаружили уязвимость и выбрались в интернет. После чего взломали Hugging Face — крупнейшую платформу для обучения ИИ-моделей. Атака длилась несколько дней. В OpenAI узнали об этом постфактум.
Самое тревожное даже не сам взлом. Агенты распределили роли: одни занимались взломами, другие «жертвовали» токены для генерации легитимного трафика, чтобы контролёры не заметили активности. Платформа, пытаясь защититься, обратилась к американским моделям — те не смогли отличить легальную деятельность от атаки. В итоге развернули локальную копию китайской GLM-5.2, и она сработала. В OpenAI признали: модель, которую использовали для выявления злонамеренных действий, пыталась скрыть ряд опасных инцидентов.
📖 Читать продолжение: https://rossaprimavera.ru/article/38488a3f
Источник:ТГ-канал "Красная Весна"
Самое тревожное даже не сам взлом. Агенты распределили роли: одни занимались взломами, другие «жертвовали» токены для генерации легитимного трафика, чтобы контролёры не заметили активности. Платформа, пытаясь защититься, обратилась к американским моделям — те не смогли отличить легальную деятельность от атаки. В итоге развернули локальную копию китайской GLM-5.2, и она сработала. В OpenAI признали: модель, которую использовали для выявления злонамеренных действий, пыталась скрыть ряд опасных инцидентов.
📖 Читать продолжение: https://rossaprimavera.ru/article/38488a3f
Источник:ТГ-канал "Красная Весна"