Исследователи из KAIST представили новую технологию, называемую Stable-GFlowNet, которая способна выявлять скрытые уязвимости в моделях искусственного интеллекта. В сравнении с существующими методами, эта технология обнаруживает их примерно в семь раз больше.
Основная цель разработки — создать более безопасные и надежные AI-системы. Подобные достижения особенно важны в свете растущего использования генеративных моделей, которые нередко становятся мишенями для атак.
Работа уже опубликована на arXiv, что позволяет ученым и инженерам ознакомиться с методами и результатами исследования. Это открывает новые горизонты для улучшения надежности AI и защиты пользователей.
