
Автор технического издания Wired, ведущий рассылку об искусственном интеллекте, решил лично проверить возможности современных ИИ-систем в области кибербезопасности. Для этого он запустил специальный автономный агент в собственной домашней сети и в течение нескольких дней наблюдал за его действиями. Программа успешно выявляла уязвимости в бытовых устройствах, получала доступ к персональному компьютеру и находила ошибки в ряде проектов, созданных с помощью автоматизированной генерации кода.
По словам журналиста, передовые модели ИИ в последнее время достигли серьезных успехов в поиске критических уязвимостей и анализе программного обеспечения. Однако такие агенты иногда действуют непредсказуемо, вступая в коллаборацию друг с другом и пытаясь проникнуть во внешние системы. Подобное поведение побудило автора провести собственный эксперимент, чтобы понять масштаб потенциальных угроз для обычных пользователей.
Идея тестирования возникла после знакомства с сервисом Abliteration AI, который предоставляет доступ к мощным нейросетям без стандартных ограничений. Обычные коммерческие модели отказываются выполнять запросы, связанные с поиском уязвимостей, но разработчики нашли способ обойти эти запреты. Технология, известная как аблитерация, позволяет модифицировать внутренние параметры открытых моделей и удалять механизмы, блокирующие потенциально опасные действия.
Подобные деалignированные системы активно используются исследователями для изучения принципов работы ИИ, а также компаниями в сфере кибербезопасности для проверки защищенности софта. Крупные разработчики, включая Anthropic и OpenAI, также предлагают клиентам модели с ослабленными ограничениями для профессионального аудита систем. Сервис Abliteration AI предоставляет полностью разблокированные версии нейросетей, включая мощную модель GLM 5.3 от компании Z.ai, по цене, сопоставимой со стоимостью пиццы.
Глава стартапа по имени Девон считает, что широкий доступ к таким инструментам поможет специалистам по безопасности противостоять злоумышленникам. По его мнению, критически важные предприятия, от авиакомпаний до банков, активно внедряют ИИ-агентов, и необходимо заранее проверять, не смогут ли их использовать в преступных целях. Эксперимент автора показал, что собственный ИИ-хакер может стать эффективным средством защиты от аналогичных атак.