Американские спецслужбы заявили, что шесть китайских разработчиков искусственного интеллекта использовали американские модели для ускоренного обучения собственных систем. В совместном отчёте названы DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun и Z.ai.
По версии Агентства национальной безопасности США, ФБР и Агентства по кибербезопасности CISA, китайские компании извлекли миллиарды токенов в ходе миллионов запросов к моделям Claude, GPT, Gemini и Grok.
Американские ведомства утверждают, что кампании проводились как минимум с конца 2024 года и, вероятно, были известны китайским властям. Китай отверг обвинения и заявил, что США пытаются сохранить монополию на рынке искусственного интеллекта.
Что такое дистилляция ИИ-моделей
Дистилляция — распространённый способ обучения, при котором более компактная модель учится на ответах более крупной и производительной системы.
Большая модель выступает в роли «учителя»: она генерирует ответы, программный код, объяснения или примеры решения задач. Эти данные используются для обучения другой модели — «ученика».
Технология сама по себе не считается незаконной. Компании используют дистилляцию для уменьшения моделей, снижения стоимости вычислений и переноса возможностей в специализированные продукты.
Претензии американских ведомств связаны с предполагаемым масштабом операций и способами получения данных. В отчёте утверждается, что китайские разработчики обходили региональные ограничения, создавали множество аккаунтов, совместно использовали премиальные подписки и направляли запросы через посредников.
В документе такие посредники называются «трансферными станциями». Они перепродают доступ к американским моделям через API, скрывая происхождение запросов и сведения о реальных пользователях.

Какие возможности могли извлекать компании
Авторы отчёта утверждают, что DeepSeek использовала ответы американских моделей при разработке R1 и V3. Запросы якобы были направлены на получение данных о рассуждениях, программировании, работе ИИ-агентов и выполнении специализированных заданий.
Moonshot AI, по версии американских ведомств, собирала данные Claude, GPT, Gemini и Grok для обучения семейства Kimi. Отдельно упоминаются программирование, математика, анализ данных, компьютерное зрение и управление внешними инструментами.
Alibaba обвиняется в использовании результатов Claude и GPT для совершенствования моделей Qwen. В документе говорится о клиентских диалогах, генерации виртуальных персонажей, программировании и работе автономных агентов.
Похожие обвинения предъявлены MiniMax, StepFun и Z.ai.
Американские ведомства утверждают, что разработчики применяли автоматизированные системы, способные переключаться между разными сервисами после блокировки аккаунтов. Некоторые кампании продолжались от нескольких дней до нескольких месяцев и включали тысячи или миллионы однотипных запросов.
При этом опубликованный документ содержит выводы спецслужб и описание обнаруженных схем, но не даёт полного массива исходных журналов и запросов, который позволил бы независимо проверить каждое обвинение.

Китай считает обвинения попыткой ограничить конкуренцию
Министерство торговли Китая назвало заявления США безосновательными. Ведомство подчеркнуло, что дистилляция применяется разработчиками по всему миру, включая американские компании.
Пекин считает, что Вашингтон использует технологические ограничения для сохранения лидерства своих корпораций. Китайская сторона пригрозила ответными мерами, если обвинения станут основанием для новых санкций.
Министерство иностранных дел Китая заявило, что успехи национальных ИИ-компаний являются результатом собственной технологической разработки, и призвало США отказаться от «необоснованных обвинений».
DeepSeek, Alibaba, Moonshot AI и Z.ai не предоставили Associated Press отдельные комментарии по существу опубликованного отчёта.
Почему спор идёт вокруг стоимости обучения
Создание передовой ИИ-модели требует больших вычислительных мощностей, данных и работы исследователей. Дистилляция позволяет сократить часть этих расходов: разработчику не нужно самостоятельно воспроизводить весь процесс, если он может собрать качественные ответы уже готовой системы.
В отчёте отдельно оспаривается известная оценка стоимости обучения DeepSeek V3 в $5,6 млн. Американские ведомства считают её неполной, поскольку в неё не включена стоимость данных, которые компания могла получить через обращения к чужим моделям.
Однако $5,6 млн изначально относились к отдельному этапу вычислительного обучения V3, а не ко всем расходам DeepSeek на исследования, оборудование, сотрудников и создание предыдущих версий. Поэтому эта сумма и до нынешних обвинений не отражала полной стоимости разработки компании.
Спор фактически идёт о том, где заканчивается обычное обучение на синтетических данных и начинается несанкционированное извлечение коммерческих возможностей конкурента.
Что теперь могут сделать США
NSA, ФБР и CISA рекомендуют американским ИИ-компаниям отслеживать необычно интенсивное использование новых аккаунтов, круглосуточные автоматические запросы и одновременную работу через разные API-площадки.
Разработчикам также предложено изменять ответы для аккаунтов, заподозренных в массовой дистилляции, и обмениваться информацией о таких операциях с конкурентами и государственными структурами.
Следующим этапом могут стать новые ограничения доступа китайских компаний к американским моделям и облачной инфраструктуре. Но усиление блокировок способно ускорить развитие собственных китайских платформ и независимых вычислительных технологий.
Для Казахстана этот конфликт тоже имеет практическое значение. Страна одновременно использует американские вычислительные ускорители и сотрудничает с китайскими технологическими компаниями. Подробнее о положении Казахстана между двумя экосистемами RAEM рассказывал в материале о выборе чипов и развитии национальной ИИ-инфраструктуры.
Источники: совместный отчёт NSA, CISA и ФБР, Associated Press.