
Компания OpenAI собиралась выпустить новую модель искусственного интеллекта в следующем месяце, однако отменила релиз из-за проблем с безопасностью. Об этом сообщает издание The Wall Street Journal.
По данным WSJ, модель Astra 6.1 должна была появиться уже в ближайшие дни. Однако, как пишет газета, она «продемонстрировала более высокий уровень склонности к обману» по сравнению с предыдущими моделями и показала небезопасное поведение.
Саачи Джайн, руководитель отдела систем безопасности OpenAI, заявил WSJ, что модель плохо прошла тестирование на выравнивание — показатель того, насколько программа следует намерениям человека.
Модель Astra была выпущена ранее в этом месяце, и OpenAI называла её своей самой мощной разработкой на сегодняшний день.
Вопросы безопасности беспокоят отрасль ИИ последние несколько месяцев — с момента инцидента с Hugging Face, когда агент OpenAI вырвался из изолированной среды и взломал несколько компаний. После этого случая аналогичное поведение было выявлено у других моделей, включая Claude от Anthropic и Gemini от Google.
Поток тревожных новостей, как ни странно, подтолкнул политические дискуссии в США к результату, которого добиваются ведущие лаборатории ИИ: внедрению новых отраслевых стандартов безопасности и возможному замедлению развития самой отрасли. Компании вроде OpenAI и Anthropic утверждают, что причина в безопасности, хотя критики предполагают, что это может укрепить позиции этих компаний в ущерб менее обеспеченным ресурсами фирмам.