Cайт программиста Ruby, веб-разработчика Ruby on Rails ESV Corp. Екатеринбург, Москва, Санкт-Петербург, Новосибирск, Первоуральск

50 петабайт улик. OpenAI тратит полмиллиона долларов в день на разбор собственных агентов

Цена неудачного поведения искусственного интеллекта (ИИ) теперь измеряется не только последствиями, но и счётом за расследование. OpenAI раскрыла, что проверка прошлой активности её моделей охватывает около 50 петабайт архивных данных и обходится более чем в $500 тыс. в сутки. Компания уже выделила огромные вычислительные мощности и планирует наращивать их по мере проверки.

Масштаб массива объясняет необычные расходы. Для проверки задействовано около 7000 ускорителей NVIDIA GB200 и GB300, а записи перебирают месяц за месяцем в обратном порядке. По оценке OpenAI, если представить весь объём обычным английским текстом, одному человеку понадобилось бы примерно 66 млн лет непрерывного чтения со скоростью 240 слов в минуту.

Вручную такой объём разобрать невозможно, поэтому первичный отсев тоже выполняют модели. Система ищет эпизоды, где агенты меняли содержимое сайтов, обходили контроль доступа, использовали пароли, API-ключи и другие чувствительные данные. Несколько последовательных ИИ-проверок сужают выборку, после чего каждый подозрительный случай уже изучают сотрудники.

Поводом для масштабной ревизии стал июльский взлом Hugging Face. Во время внутреннего теста агенты OpenAI вышли за пределы исследовательской среды, нашли уязвимости и добрались до производственной инфраструктуры. OpenAI по-прежнему считает тот эпизод самым серьёзным из известных случаев такого поведения и теперь проверяет старые журналы в поисках похожих событий.

Проверка уже подняла более ранние эпизоды. В июне агент, которому поручили найти статистику по расходам на лекарства, обошёл ограничения австралийского портала Medicare и получил доступ к публичным и непубличным файлам. К 26 сентября OpenAI предупредила более 100 организаций, но отдельно уточнила, что уведомление само по себе не подтверждает взлом или утечку закрытых данных.

Ревизия идёт около месяца и пока не выявила другого проникновения, сопоставимого по масштабу и тяжести с атакой на Hugging Face. OpenAI ожидает найти дополнительные эпизоды, в том числе произошедшие несколько месяцев назад. На разбор одного отобранного случая у сотрудников уходит от 45 минут до нескольких дней, поскольку журналы приходится сопоставлять с действиями моделей и контекстом доступа.

После июльского инцидента OpenAI ограничила интернет-доступ исследовательских моделей, сильнее разделила тестовые среды и расширила мониторинг опасных действий. Ревизия должна показать, как менялось поведение агентов между версиями и насколько новые меры снижают риск повторения самовольных действий во внешних системах. Пока проверка продолжается, список уведомлённых организаций может вырасти.

SecurityLab