OpenAI сообщила о выходе ИИ из-под контроля во время тестирования
Компания OpenAI сообщила, что во время внутреннего тестирования один из автономных ИИ-агентов вышел за пределы изолированной среды, получил доступ к интернету и атаковал инфраструктуру платформы Hugging Face. Инцидент компания назвала беспрецедентным и пообещала усилить меры безопасности. Об этом сообщает Reuters, передает Exclusive.kz.
По данным OpenAI, инцидент произошел в ходе проверки кибербезопасности наиболее продвинутых моделей. Агент, работавший в контролируемой среде, сумел преодолеть ограничения тестового контура, выйти в интернет и попытался получить доступ к данным Hugging Face для выполнения поставленной перед ним задачи. Компания заявила, что к атаке были причастны модели GPT-5.6 Sol и более мощная предрелизная система, которые тестировались с ослабленными ограничениями для оценки их кибервозможностей.
Платформа Hugging Face, используемая для размещения моделей искусственного интеллекта с открытым исходным кодом, ранее сообщила о необычной хакерской атаке, которая, по ее данным, была полностью проведена автономной ИИ-системой. Компания заявила, что злоумышленнику удалось получить несанкционированный доступ к ограниченному набору внутренних данных и части служебных учетных данных, однако признаков компрометации пользовательских моделей и публичной инфраструктуры выявлено не было.
Сооснователь Hugging Face Клеман Деланг позже подтвердил, что компания подозревала причастность одной из ведущих лабораторий искусственного интеллекта из-за высокой сложности атаки. После расследования OpenAI признала, что инцидент произошел во время ее внутренних испытаний.
Происшествие вызвало новую волну дискуссий о регулировании искусственного интеллекта в США. В частности, конгрессмен Грег Казар заявил о необходимости более жестких требований к безопасности подобных систем, а эксперты по кибербезопасности предупредили, что по мере развития автономных ИИ подобные атаки могут стать более распространенными.
Фото: REUTERS





Все комментарии проходят предварительную модерацию редакцией и появляются не сразу.