Anthropicはサイバー検証プログラム(CVP)を拡張し、セキュリティ専門家向けに高度なサイバー能力と緩和されたブロック分類器を提供する3つの区分を設けた。上位モデルはどの区分でも使える。
AnthropicのCVP拡張が示す三つの区分
Anthropicは10月6日、サイバー検証プログラム(Cyber Verification Program、CVP)の拡張版を発表した。適格なセキュリティ専門家に対し、高度なサイバー能力と、ブロックを緩めた分類器を開放する。プログラムは三つのアクセス区分に分かれ、チームは自分の業務範囲に合う区分を申請する。
三つの区分はこうだ。「Defense Access」は防御業務向け。「Red Team Access」はそこに認可されたペネトレーションテストとレッドチーミングを加える。「Specialized Access」はさらにその上に位置づけられる。
どの区分でも、最も能力の高いモデルを利用できる。Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1、そして今後登場する新モデルだ。今回の拡張は、これまでの「Project Glasswing」とCVPという二つの取り組みを統合したものでもある。
Anthropicが区分ごとに想定する利用者
Defense Accessは、防御側の仕事を想定している。SOC(セキュリティ運用センター)やインシデント対応、マルウェアのリバースエンジニアリング、脆弱性の分析と検証が含まれる。対象は、企業、非営利団体、大学、政府機関のセキュリティチームのほか、地域の病院や自治体の公共事業といった重要インフラの運用者、小規模なセキュリティ企業、オープンソースのメンテナー、脆弱性報告の実績がある個人研究者だ。Anthropicは数日以内の回答を目指すとしている。
Red Team Accessは、上の防御用途に、認可されたペネトレーションテストとレッドチーミングを足す。社内のレッドチーム、政府のレッドチーム、セキュリティ・ペネトレーションテスト企業が対象だ。ただし、テストが認可されたシステムに対してのみ攻撃的テストを行える。物理的な危害や大規模な混乱を招く行為、たとえばランサムウェアの配備や物理システムの破壊、高リスクな安全システムへの侵入テストは、この区分でもリアルタイムでブロックされる。
AnthropicのCVP、レッドチーム区分が変えること
ここが実務で効いてくる部分だ。Anthropicは評価結果を公開している。CyScenarioBenchで、Claude Opus 5.5のDefense Access区分では、安全装置が50タスク中46件をブロックした。同じモデルのRed Team Access区分ではブロックがゼロで、50件中34件を完了した。安全装置を一切かけない場合と同じ完了率になる。
つまり、防御の仕事しかしない区分では、正当な作業まで止まりやすい。レッドチームの許可を得た区分では、それが解ける。誤検知に悩むセキュリティチームにとって、区分の違いは作業が進むか止まるかの差になる。
Glasswingが残した実績と数字
拡張の土台には、Project Glasswingの実績がある。Anthropicによれば、パートナー企業は2026年4月から7月の間に、少なくとも12万9千件の検証済み脆弱性を発見した。自社のオープンソーススキャンでも、4月から10月に5500件を追加で見つけている。このうち3万3000件以上が、すでに重大または高深刻度と評価された。
Anthropicはこれを過小評価だと説明する。数字はGlasswingパートナーの一部からの調査データに基づくからだ。実際の影響は少なくとも5倍に上る可能性があるという。複数のパートナーは、Claude Mythosモデルがなければ同じ数の脆弱性を見つけるのに数カ月から数年かかったと語ったという。
数字は魅力的だが、出所を忘れてはいけない。これらはAnthropicとそのパートナーの報告に基づくもので、独立した第三者が検証したものではない。
AnthropicのCVPを申請するには
CVPはClaude Platformのほか、Google CloudのVertex AI、Microsoft Foundryで利用できる。Amazon Bedrockでは、Enterprise Frontier Safeguardsの対象顧客に限られる。既存のCVPメンバーは以前のモデルの設定を維持しつつ、更新後のプログラムで新モデルへのアクセスを自動的に評価される。
申請はAnthropicのポータルから行う。審査では申請者の確認と、区分ごとに必要なセキュリティ管理の証明が求められる。自分の区分で通るはずの作業がブロックされた場合は、誤検知の報告フォームから申し立てができる。
判断のポイントは、自分の業務が防御だけか、認可された攻撃テストまで含むかだ。前者ならDefense Access、後者ならRed Team Accessが入口になる。どちらの区分でも最上位モデルは使えるので、選ぶ基準は利用できるモデルではなく、許可される作業の範囲になる。






