545 хакеров протестировали его первыми. Теперь XRanges for AI оценивает вашего агента безопасности

Автономные агенты безопасности становятся все лучше в поиске ошибок. Ни у кого нет хорошего способа измерить, насколько хорошо. Направьте первый взгляд на реалистичную цель, и в результате вы получите отчет, который агент написал о себе: уверенная проза, список результатов и невозможность определить, какие из них произошли. Затем кто-то с опытом работы в сфере безопасности садится и сверяет каждое утверждение с целью. Какие выводы являются реальными, Для этого цикла существует XRanges for AI, созданный CTF.ae. Он развертывает реалистичные целевые приложения с инструментами, встроенными в каждую службу, записывает, что на самом деле делает агент внутри них, и оценивает каждое выполнение в реальном времени по четырем независимым сигналам. В этом пошаговом руководстве рассказывается, как оно работает, как выглядит прогон от развертывания до сравнения и где оно подвергалось стресс-тестированию.


Источник: The Hacker News — https://thehackernews.com/2026/09/545-hackers-tested-it-first-now-xranges.html

Комментарии