NSA、CISA、FBI 責める (PDF) 中国の AI 企業数社 「工業用」蒸留キャンペーンの実施 ChatGPT、Claude、Gemini、Grok などの米国の主要モデルに対して。少なくとも 2024 年の時点では、企業はアカウント、API、プロキシ、クラウド プロバイダー、サードパーティ アグリゲーターからの数百万件のリクエストを自社のモデルの機能を抽出するよう指示していると報告されています。 「中国のAI企業は、AI開発戦略の単なる補完以上の業界規模のナレッジマイニングキャンペーンを通じて、米国のAI企業のモデルの機能や能力を定期的に活用している。」サイバースクープは次のように報じている。 たとえば、DeepSeek は米国国境モデルを使用して、4 つの異なるバージョンの Claude、2 つのバージョンの Gemini、5 つのバージョンの ChatGPT、および Grok 4 を含む R1 モデルと R3 モデルの合成トレーニング データを生成しました。これらのモデルは、代理店のパフォーマンス、Q&A の最適化、クリエイティブ ライティングなどの分野で DeepSeek の機能をトレーニングするのに役立ちました。
別の中国企業Moonshot AIは、キミK2とキミK3モデルをトレーニングするために、Anthropicの現行モデルで最も先進的な市販モデルであるFable 5を含む18の異なるアメリカ製モデルを処理したとされている。同社は、エージェントベースの思考、コーディングとデータ分析、コンピュータービジョン、拡張ロジックフレームワーク、視覚処理などの分野で高度な機能を引き出すために、何百万ものアプリケーションを使用してきました。
中国の AI 企業は、検出を回避するためにリクエストを複数のチャネルにルーティングする複雑なツールとシステムのセットを運用しています。この勧告では、複数のアカウント、モデル、プラットフォームにリクエストを分散すること、ローカル API、リモート クラウド プロバイダー、サードパーティ アグリゲータを使用してユーザーのメタデータを改ざんすること、プロキシやグレー テクノロジー マーケットを使用して地理的制限、使用条件、境界モデルに組み込まれた保証を回避することなど、中国企業で見られる一般的な戦術を列挙しています。