概要
Anthropicは、自社の「Frontier Red Team(フロンティア・レッドチーム)」による調査結果として、最新のAIモデルが国家安全保障に関わる可能性のあるリスクについて、どのような進歩を見せているかをまとめた記事を公開しました。公式情報によると、この内容は2025年3月19日付でAnthropicの公式サイトに掲載されたものです。サイバーセキュリティと生物学(バイオセキュリティ)の2分野について、過去1年・4回のモデルリリースにわたる評価結果が紹介されています。
何が発表・更新されたのか
公式情報では、Claudeモデルがサイバーセキュリティ分野で「CTF(Capture The Flag、脆弱性を見つけて攻撃する模擬演習)」の成績を1年で高校生レベルから大学生レベルまで伸ばしたと報告されています。さらに最新モデルのClaude 3.7 Sonnetは、公開ベンチマーク「Cybench」で約3割の課題を解けるようになり、1年前の約5%から大きく向上したとしています。
生物学分野では、ウイルス学のトラブルシューティング能力を測る評価(VCT)で、専門家の水準を下回っていた状態から、これを上回る水準にまで進歩したことが報告されています。ただし、科学的な図表を読み解く能力は依然として人間の専門家に及ばないとされています。
一方で、実際に生物兵器の取得・計画に関する小規模な統制実験を実施したところ、モデルは初心者に一定の「後押し(uplift)」を与えたものの、最も高得点だった計画にも、実際には失敗につながる重大な誤りが含まれていたと説明されています。
なぜ重要なのか
公式情報では、AIモデルはサイバーセキュリティや生物学の一部領域で「早期警告サイン」と呼べる急速な能力向上を示している一方、現時点では国家安全保障に大きなリスクをもたらす水準には達していないと結論づけています。つまり、リスクが「今すぐ」ではなく「今後の進歩次第で」高まる可能性がある、という位置づけです。企業や組織がAI活用を検討する上でも、こうした能力向上のスピード感を知っておくことは、リスク管理の観点から参考になります。
誰に関係があるのか
この情報は、AI政策・ガバナンスに関心のある企業の法務・リスク管理担当者、AIセキュリティに関わるエンジニア、公共政策関係者にとって参考になる内容です。一般の業務担当者にとっては直接的な業務影響は小さいものの、AIの安全性に関する業界動向を把握する材料になります。
仕事や業務でどう使えるのか
公式情報は主にAIの安全性評価に関する内容であり、具体的な業務ツールとしての使い方は示されていません。ただし、社内でAI活用のリスク方針を検討する際や、AIベンダーの安全対策への取り組み姿勢を確認する材料として、参考情報になります。
注意点
公式情報上では、日本での提供状況や対象プランの詳細は確認できませんでした。また、この記事は2025年3月時点の調査結果に基づくものであり、最新のモデルにおける能力とは異なる可能性があります。記載されている実験は小規模な統制環境で行われたものであり、実世界でのリスクの大きさを直接示すものではない点にも留意が必要です。
公式情報
Progress from our Frontier Red Team(Anthropic公式サイト)
関連キーワード
- Claude
- Anthropic
- AIセキュリティ
- 生成AI
- AIモデル評価





