Anthropicは、生物兵器や通常兵器の開発を支援する可能性のある「悪意のある活動」に同社のAIモデルを使用する試みを特定し、阻止したと述べた。

同社のAIモデル「Claude」は、ロシアやイランの宣伝機関に関連したサイバースパイ活動にも使用されている。 最新の人類脅威インテリジェンスレポートによると。

過去 8 か月間に発覚した懸念すべき事件は、偽の出会い系アプリやホテルの Wifi 詐欺から、反体制派を特定することを目的とした監視まで多岐にわたりました。

この暴露は、Anthropic社の上級セキュリティ研究者がAIが人類にもたらす潜在的な危険性について警告した後に発表された。

アンスロピックはまた、中国のAI企業がクロードの能力を再現しようとしていると非難した。

同社は最新情報をリリースしました 脅威インテリジェンスレポート外部の は木曜日、「当社のサービスに対する悪意のある悪用を暴露する責任」があると考えたため、そうしたことを行ったと述べた。

長い報告書には、そのテクノロジーが政府支援の疑いのあるグループ、犯罪者、スパイウェアベンダー、国営宣伝機関、政治的動機のある個人によって悪用された例が列挙されている。

クロードのHaiku、Sonnet、Opusモデルの「悪意のある使用」は、2025年12月から2026年8月の間に停止したと言われています。

いずれのケースも、蒸留の 1 つのインスタンスを除いて、Claude Fable や強力な Mythos クラス モデルの悪用には関与していませんでした。蒸留とは、より大型で高価なモデルを使用して小型の AI モデルをトレーニングするプロセスです。

アンスロピックは、サイバー作戦と影響力、監視、詐欺となりすまし、兵器開発に自社のモデルが使用されていることを明らかにするとともに、生物兵器の開発を促進する可能性のある方法で人工AIを使用する科学者をブロックしたと述べた。

報告書は「生物兵器の開発を支援する可能性のある方法で私たちのモデルを使用した攻撃者の5つの事例」に焦点を当てている。

生物学の悪用は「AIのフロンティアモデルの最も深刻なリスクの1つ」だと同誌は述べている。適切な保護策がなければ、そのような機能は「壊滅的な結果をもたらす可能性がある」とアントロピック氏は述べた。

「生物兵器の開発に使用できるのと同じデータが、ワクチンの開発や病気の治療にも使用できる」とアントロピック氏は述べた。

Anthropic社の脅威インテリジェンス責任者、ジェイコブ・クライン氏が発表した。 ニューヨークタイムズ外部の それは「極めてデリケートな状況」だった。

「漫画の中で『みんなを殺すための生物兵器を作りたい』なんて言う人はいないでしょう」と彼は言う。

報告書はまた、クロードが「銃器、ミサイル、武装無人機、爆弾、その他の軍需品を含む通常兵器、およびそれらを制御する照準および制御システムのソフトウェアを開発する」ために使用された6つの事例についても言及している。



Source link