Microsoft AI опубликовала проект «Кодекса поведения гуманистического ИИ» для своих моделей MAI, в котором излагаются правила безопасности для наступательных кибервозможностей, ограничения на автономные агенты ИИ, а также специальный обзор для кибербезопасности и других специализированных применений. Согласно кодексу поведения, моделям запрещено создавать работающий код эксплойта, инструменты для атак, методологии планирования и определения целей, процедуры вторжения, методы уклонения, оперативное руководство или другую помощь, которая могла бы сделать возможным или улучшить кибератаку. Microsoft заявляет, что эти ограничения применяются независимо от того, как сформулирован запрос. Это правило подпадает под то, что Microsoft называет «Абсолютными ограничениями», и гарантирует, что ни компании, внедряющие его модели, ни их конечные пользователи не смогут его обойти. Технический гигант проводит грань между пониманием атаки или работой по защите от нее и получением практических средств для ее осуществления. В этих пределах модели MAI все еще могут помочь в разрешенных и законных оборонительных работах. Сюда входит обнаружение уязвимостей, анализ вредоносного ПО, разработка и тестирование экспериментальной концепции эксплойта, а также общеобразовательные материалы о том, как работают атаки. Код также обрабатывает инструкции, поступающие через внешний контент. В документе говорится, что власть над поведением модели передается только через цепочку командования. Сюда входит сам кодекс поведения, затем политики, установленные компаниями, внедряющими модель (операторами), а затем предпочтения отдельных пользователей.
Источник: SecurityWeek — https://www.securityweek.com/microsoft-ai-code-of-conduct-sets-cyberattack-boundaries-chain-of-command-safety-constraints/
Комментарии