Обширная сеть промежуточных серверов позволяет пользователям в Китае получать доступ к передовым моделям искусственного интеллекта в США, не раскрывая свою личность и местонахождение, что, вероятно, позволяет обойти потенциальные ограничения доступа и мониторинг. Исследователи компании недавно выявили более 80 000 ретрансляционных серверов LLM, которые действуют как посредники между пользователями и поставщиками ИИ. Серверы ретрансляции позволяют операторам объединять учетные данные для нескольких учетных записей AI и направлять запросы пользователей через серверы к пограничным службам, включая Anthropic, OpenAI, Google и xAI. «Передающая станция нарушает предположение, от которого зависит все элементы управления пограничной модели: учетная запись, отправляющая запрос, принадлежит стороне, получающей ответ», — написал Фишер. «Атрибуция учетных записей, измерение использования, ограничения скорости, обнаружение злоупотреблений, региональная доступность и условия, которые регулируют все из них, применяются к тому, кто владеет учетными данными». По его словам, ретрансляционные серверы опровергают это предположение и позволяют осуществлять мошенничество в огромных масштабах. Команда Cymru первоначально выявила в общей сложности 10 867 перегрузочных станций в 457 автономных системах или ASN, но после дальнейших раскопок увеличила это число до более чем 80 000 реле. Компания исследовала кластер ретрансляционных серверов, размещенных у нескольких поставщиков виртуальных частных серверов в США, и обнаружила более 4000 IP-адресов в Китае и Гонконге, подключающихся к ним. За восьмидневный период эти адреса отправили на ретрансляционные станции около 14 ТБ данных и получили взамен более 7 ТБ. Некоторые из одних и тех же реле подключены как к китайским поставщикам искусственного интеллекта, так и к западным компаниям, включая Anthropic, OpenAI, Google и xAI. По словам команды Cymru, трафик, который она наблюдала, направляемый непосредственно на Anthropic API, был особенно примечателен своим огромным объемом. За восемь дней пользователи загрузили в Anthropic около 81 ГБ данных через всего 17 ретрансляционных серверов и загрузили около 1,4 ГБ в ответах. Команда Cymru интерпретировала соотношение загрузки и выгрузки 58:1 как потенциально соответствующее крупномасштабным попыткам дистилляции модели, когда злоумышленники используют результаты пограничной модели в качестве обучающих данных для разработки более дешевой и менее функциональной модели, имитирующей ее поведение. «Китайские пользователи и организации, как минимум, нарушают ограничения доступа к сервису, а также могут легко украсть выходные данные для клонирования своих собственных версий», — сказал Фишер.
Источник: Dark Reading — https://www.darkreading.com/cyber-risk/relays-masking-chinese-access-frontier-ai-models
Комментарии