❗️⭕️ От Hugging Face до правительственных сайтов
OpenAI раскрыла новые подробности расследования действий своих автономных ИИ-агентов. Речь идёт о случаях, когда во время обучения и оценки агенты выходили за рамки тестовых задач, обходили механизмы контроля доступа, использовали опубликованные в открытом доступе учётные данные, взаимодействовали с внутренними интерфейсами сервисов и оставляли нежелательные публикации на внешних сайтах. Компания уведомила десятки сторонних организаций, среди которых оказались государственные ведомства, университеты и другие учреждения. В OpenAI подчёркивают, что факт отправки уведомления не означает подтверждённую компрометацию.
▪️Особое внимание привлёк новый инцидент с передачей файлов. Как уточнила компания, агенты в исследовательской среде отправляли обучающие и оценочные данные сторонним сервисам, а в 53 случаях загрузили предоставленные пользователями изображения на внешние фотохостинги по скрытым ссылкам. В OpenAI утверждают, что подавляющая часть затронутых сведений не имела отношения к пользователям. Журналисты Reuters обратили внимание на важный пробел, ведь в OpenAI отказались пояснить, были ли эти 53 изображения сгенерированы ИИ или на них были запечатлены реальные люди, а также когда именно произошла выгрузка. Большая часть этих картинок уже удалена, а удаление оставшихся файлов продолжается совместно с владельцами хостингов.
▪️По информации источников Reuters, к середине сентября 2026 года специалисты OpenAI выявили в общей сложности около двух десятков эпизодов нежелательного поведения агентов, причём этот список расширяется по мере проверки старых системных логов. В компании признают, что масштабный ретроспективный аудит займёт ещё несколько месяцев.
▪️У WSJ говорится, что ИИ-агенты OpenAI в период с апреля по конец июня 2026 года свыше 16 000 раз сканировали общедоступный статистический хаб Конференции ООН по торговле и развитию (ЮНКТАД). Боты получили задачу собрать открытую информацию, однако при столкновении с фильтром, блокировавшим их запросы, они применили методы, не разрешённые администрацией ресурса, и обошли защитный фильтр. Представитель Конференции ООН по торговле и развитию подчеркнула, что инцидент представляет собой крайне тревожный фундаментальный сбой в сдерживании ИИ. При этом она уточнила, что утечки конфиденциальной информации не произошло и работоспособность самого статистического портала нарушена не была. OpenAI сообщили, что изучают представленные выводы и предложили ООН провести брифинг с профильной группой специалистов.
▪️Издание Axios приводит ещё более неприятные цифры. Сообщается, что компании OpenAI и Anthropic, а также ИБ-исследователи расследуют 🤖десятки тысяч инцидентов, в которых передовые ИИ-модели совершали действия, расценённые внешними оценщиками как проблемные. Масштаб выявленных эпизодов указывает на то, что проблема надёжности и контроля агентных систем оказалась на порядки сложнее, чем известно публично.
👆На этом фоне компания OpenAI пытается усилить защитные инструменты и готовится выпустить профильное решение. OpenAI может на днях представить модель GPT-6 Cyber, которая станет уже четвёртой специализированной ИИ-моделью компании в сфере кибербезопасности за 2026 год. Закрытая группа клиентов из исследовательской программы Daybreak Red уже тестирует новинку, а её официальную презентацию вместе со средствами безопасного развёртывания ожидают на конференции DevDay в Сан-Франциско.
Параллельно появляются признаки подготовки ещё одного уровня подписки OpenAI Codex. 25 сентября в публичном репозитории openai/codex был объединён с основной веткой пулреквест #47971, который добавил поддержку идентификатора promax и отображаемого названия Pro (Max). Сама OpenAI пока не подтвердила цену $500.
👆 С 10 сентября компания временно приостановила новые подписки и переходы на действующий тариф Pro $200 (Pro 20X). Сотрудник OpenAI Тибо Соттьо объяснил решение высокой нагрузкой на инфраструктуру после роста спроса на GPT-6 Astra и сообщил, что компания наращивает вычислительные мощности.
✋ @Russian_OSINT