人間的 は木曜日、悪意を持った人々によるその利用の試みを阻止したと発表した。 人工知能 生物兵器につながる可能性のあるサイバー攻撃、監視、研究などの活動に対して。
アントロピックによると、 AI モデルがより強力になるにつれて、複雑なサイバー攻撃には高度なスキルは必要なくなり、個人が単独で行動する場合でも、わずか 1 年前には不可能だった脅威を生み出すことができます。 同社は、兵器製造にも利用される可能性のある生物学的研究を制限するため、最新モデルにはより厳格な安全対策を組み込んだと述べた。
「ここで私たちが共有する事例は典型的な悪用の例ではなく、むしろ私たちがこれまでに特定した最も顕著で新しい脅威活動の例です。」Anthropicは2025年3月以来3回目となる報告書の中で、AIの悪用について概説したと述べた。報告書にはアンスロピックが検出したとする悪意のあるコードとAI命令の断片が含まれており、政府や競合するAI企業に対し、同様の悪用を特定し防止するよう促している。
「私たちがこの研究結果を公開するのは、当社のサービスの悪意のある利用を暴露する責任があると考えているからです。モデルの機能が向上するにつれて、AI開発者や社会擁護者がモデルをより安全にするための措置を講じない限り、そのリスクは増大するでしょう」と同社は述べた。
この秋に株式公開を予定しているAIスタートアップ企業からの広範なレポートは、その2日後に発表された。 研究者の一人が辞任を発表した Anthropic とその競合他社が AI の開発において責任を持って行動していないことへの懸念からです。研究者は、テクノロジーが人間の制御を回避する可能性について、業界内外で表明された懸念に同調した。
クロードはウイルスをより有害にするために協力するように頼まれた
2025 年 12 月から 2026 年 8 月にかけて、アントロピックの研究者らは、スパイウェア ベンダーや「政治的動機を持つ個人」からプロパガンダを広める国家支援団体に至るまで、さまざまな主体による悪用を検出しました。
同社の報告書の調査結果の中には、生物兵器につながる可能性のある研究に身元不明の人々が同社のモデルを使用しようとした事例も含まれている。ある例では、Anthropic は、クロードからの科学的資金の補助金申請書の作成を支援する要求を自社のシステムがブロックしたと主張しました。
「申請書で参照されている研究は、チクングニヤウイルスに関する機能獲得研究(すなわち、生物を遺伝的に改変して新しいまたは改良された生物学的特性を生み出す研究)で構成されていた。この機能獲得研究は、ウイルスの伝播性と免疫回避特性に焦点を当てていた」と報告書は述べている。
チクングニア熱は蚊が媒介するウイルスで、激しい痛みや発熱などの衰弱性の症状を引き起こします。この要請には、ウイルスをますます有害にするために変異を強化することを目的とした研究に対する助成金の提案が含まれていた。アントロピックによれば、こうした研究は「確かに」より良いワクチンや治療法の開発に利用される可能性があるが、「病原体をより危険なものにするために利用される可能性もある」という。
Anthropicは、自社のモデルが害を及ぼさないことを保証できないと述べている
Anthropic がその報告書に含めた事例では、最新かつ最も強力な「Claude Fable」または「Mythos」クラスのモデルが使用されていることが判明していません。ただし、Anthropic が「あるモデルの機能を抽出し、それを許可なく別のモデルに複製するための産業規模の秘密キャンペーン」と説明した「違法蒸留」の 1 件を除きます。
Anthropic は、2025 Claude Opus 4 や Claude Sonnet 4.5 などの以前のモデルは、「危険な生物学的研究を行う専門ユーザーを大幅に支援できる閾値をはるかに下回っていた」と述べました。
「その結果、これらのモデルに適用されるセキュリティ対策はそれほど厳格ではなく、初心者が既知の生物兵器を再現するのに役立つ可能性のあるコンテンツへのアクセスを防ぐことに主に焦点を当てた」と報告書は述べている。 「しかし、広範囲にわたる複雑な科学研究タスクを支援できる現在のモデルについては、証拠はもはや決定的ではなく、同じ保証を提供することはできません。」
このため、Anthropic は、Claude Fable 5 などの最新モデルに「広範な二重用途の生物学的研究クエリへのアクセスを制限する、より厳格なセキュリティ対策」を導入したと報告書は述べています。
企業がますます強力な人工知能モデルを組み込む中、専門家らは政府に対し、業界自体の規制に依存するのではなく、このテクノロジーを規制するよう求めている。
コーネル大学のコンピューターサイエンス准教授、ジョン・シックスタン氏は、AnthropicやOpenAIのような企業にとって、どの行動が安全でどの行動が安全でないかを判断し、「民主的または熟議的な監視なしに社会規模で価値判断」を行うことが期待されているため、これは不快な状況であると述べた。
この報告書は研究者からの重大な警告を受けて出された
Anthropic はまた、一般人のものと思われる数百のソーシャル メディア アカウントを作成し、1 週間にわたって同じ政治的意見を広めるコンテンツを投稿したグループも発見しました。同社は、ロシア、イラン、トルコ、ペルシャ湾岸地域全体、南アジア、アフリカ、ヨーロッパから検出されたこの種の9件の症例について詳しく説明した。
ソーシャルメディア企業は、投稿がすでに広まった後でもプラットフォーム上での影響力操作を検出できますが、「Claude では、操作がまだ発展途上でも検出できます。」
Anthropic は、研究者の 1 人である Jacob Coxon 氏の発言を受けてこのレポートを発表しました。 辞任を発表する 同社とその主なライバルであるOpenAIが「自らを改善できる超知性を目指して突っ走っており、私たちの生活をもてあそんでいる」のではないかと懸念している。コクソン氏は投稿の中で、同僚の中には今、AIが今10年末までに人類の生命に脅威をもたらす可能性があると信じている人もいると警告した。
しかし、Anthropic は、特定した悪意のある活動をすべてブロックし、その経験をセキュリティ対策を強化するために活用し、政府当局や業界パートナーと情報を共有したと述べています。