Можно ли украсть нейросеть через её ответы? США говорят, что Китай делает это массово

leer en español

16473
Можно ли украсть нейросеть через её ответы? США говорят, что Китай делает это массово

Шесть компаний якобы собрали миллиарды токенов из Claude, GPT, Gemini и Grok.

image

Чтобы перенести сильные стороны дорогой нейросети в собственную модель, по версии американских спецслужб, не обязательно красть исходный код или веса. Достаточно миллионы раз обращаться к чужой системе, собирать ответы и превращать полученный массив в учебные данные.

NSA, FBI и CISA обвинили DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun и Z.AI в промышленных кампаниях по копированию возможностей американских ИИ-моделей. Американские ведомства утверждают, что с конца 2024 года китайские компании извлекли миллиарды токенов в ходе миллионов запросов к Claude, GPT, Gemini и Grok. Вашингтон допускает, что китайские власти знали о такой деятельности.

В основе схемы лежит дистилляция моделей. Более компактную систему обучают на ответах мощной нейросети, чтобы передать ей часть знаний, поведения и навыков. Сам метод широко применяют легально, например, для выпуска облегчённых версий собственных моделей. Претензии США связаны с другим сценарием, когда конкурент массово собирает ответы закрытых систем вопреки ограничениям владельца.

По версии американских ведомств, DeepSeek использовала американские модели при разработке R1 и V3, целенаправленно собирая данные о рассуждениях, работе с API, агентных функциях и оценке качества ответов. Moonshot AI якобы применяла данные Claude Fable 5 при обучении Kimi K3, а ответы GPT-4o помогли при создании Kimi K2. Alibaba, как утверждают авторы предупреждения, дистиллировала Claude и GPT-5 для улучшения семейства Qwen.

Масштабирование такой схемы требует гораздо больше, чем обычного аккаунта в чат-боте. Американские службы описали поддельные учётные записи, сторонние агрегаторы API, облачные платформы и серый рынок прокси, которые называют «transfer stations». Через посредников разработчики якобы обходили региональные ограничения и затрудняли определение настоящего источника запросов. После блокировки одного канала автоматические системы переключались на другой.

Отдельный интерес представляли рассуждения моделей. Ведомства утверждают, что специально составленные запросы заставляли системы описывать предполагаемые промежуточные шаги решения задачи. Такие данные ценнее простых ответов, поскольку позволяют обучать другую модель не только правильному результату, но и подходам к программированию, математике и сложным агентным операциям.

Американские службы считают, что масштабная дистилляция сокращает сроки разработки и позволяет китайским компаниям экономить на вычислениях, электроэнергии и фундаментальных исследованиях. Авторы совместного предупреждения связывают ускоренное развитие китайских моделей также с ростом военных и наступательных кибервозможностей. Публичный документ представляет позицию американских ведомств, а не установленный судом факт промышленной кражи.

Китай отверг претензии. Представитель МИД Мао Нин заявила, что успехи страны в сфере ИИ связаны с собственной научной и технологической базой, и призвала Вашингтон отказаться от обвинений. Новый спор возник накануне запланированных переговоров США и Китая по рискам ИИ и визита Си Цзиньпина в Соединённые Штаты позднее в сентябре, что дополнительно повышает политическую цену конфликта.

Претензии к китайским лабораториям появились не впервые. В феврале Anthropic заявила, что DeepSeek, Moonshot AI и MiniMax провели более 16 млн взаимодействий с Claude примерно через 24 тысячи мошеннических аккаунтов, пытаясь перенести возможности модели в собственные разработки.

Летом спор сосредоточился вокруг Moonshot AI. После выпуска Kimi K3 американские власти заявили, что компания могла в промышленном масштабе собирать ответы Claude Fable 5, причём на тот момент публичных технических доказательств обвинения Вашингтон не представил.

Разработчики американских моделей уже ищут способы сделать массовое копирование менее выгодным. Anthropic, например, встроила в Claude Code механизмы для выявления подозрительной дистилляции, но такие средства защиты сами вызвали споры о слежке и прозрачности работы ИИ-сервисов.

Рекламодатель
ООО «СерчИнформ»
ИНН: 7704306397
searchinform.ru↗
ИИ-ассистент СерчИнформ