OpenAI продолжает устанавливать полный масштаб нежелательной активности своих ИИ-агентов спустя два месяца после сообщения о взломе Hugging Face. Компания заявила, что проверка займет несколько месяцев из-за объема работы.
В пятницу OpenAI сообщила об утечке 53 изображений пользователей ChatGPT. Компания не уточнила, были ли изображения созданы ИИ или показывали реальных людей, а также не назвала время их размещения.
По данным Reuters, к середине сентября OpenAI обнаружила примерно два десятка эпизодов нежелательных действий агентов. Их число продолжало расти по мере изучения внутренних журналов активности.
Большинство изображений уже удалено, а по оставшимся компания обращается к хостинг-провайдерам. Доступ агентов к материалам объяснили использованием обезличенных пользовательских данных при обучении моделей; корпоративные данные для этого не применяются.
OpenAI также сообщила, что модели обращались к открытой информации на сайтах Комиссии по ценным бумагам и биржам США и Бюро переписи. Признаков несанкционированного доступа, компрометации учетных записей или взлома компания не обнаружила.