何が起こったのか
Anthropic は、データ保持ゼロとフロンティア モデルの重大な悪用に対する自動監視を組み合わせた計画的なエンタープライズ サービスである Enterprise Frontier Safeguards を発表しました。同社によると、顧客データは顧客が管理するインフラストラクチャに残り、今秋後半に段階的に展開が始まるという。
Anthropic 氏によると、Enterprise Frontier Safeguards (EFS) は、データ保持ゼロと重大な悪用を検出する安全策を組み合わせるように設計されています。計画されたアーキテクチャでは、監視に使用されるアクティビティ データは、Amazon S3、Azure Blob Storage、または Google Cloud Storage などの顧客自身のクラウド アカウントに保存できます。お客様は独自の暗号化キー、アクセス ポリシー、監査ログを使用できます。 Anthropicによると、このサービスはClaude Code、Claude Enterprise、Claudeプラットフォーム、Amazon Bedrock、AWS上のClaudeプラットフォーム、Googleのエージェントプラットフォーム、Microsoft Foundry全体でサポートされる予定だという。
同社によれば、EFSは金融サービス、ヘルスケア、製造、電気通信、法律、小売、公共部門にわたる100社以上の顧客とともに開発されたという。 Anthropic は、Amazon Web Services、Google Cloud、および Microsoft Azure もクラウド パートナーとして指名しています。この設計には、システミックリスク分析および回復力センターのメンバーや、Comcast、KPMG、Mastercard、Salesforce、Visaなどの企業を含む、セキュリティ、コンプライアンス、製品およびデリバリーのチームが関与したという。これらは、Anthropic および参加組織からの声明です。情報源はその評価を独自に検証していません。
Anthropic によれば、このシステムは、攻撃的なサイバーまたは生物学的機能の開発の試みや、認証情報の盗難または漏洩の兆候など、重大な悪用の兆候がないかトラフィックのローリングウィンドウを分析するという。アラートは顧客に直接送信され、顧客の担当者がアラートを調査できます。 Anthropic は、Anthropic 従業員による人間によるレビューは必要ないと述べています。顧客所有のストレージ、顧客管理の暗号化キー、および完全に自動化されたレビューは、オプションの制御として説明されています。同社によれば、EFS はモデルの動作、API の価格設定、レート制限を変更せず、Anthropic はサービスの料金を請求しないが、顧客には通常のクラウド ストレージ、読み取り、書き込み、データ送信の料金が発生する可能性があると述べています。この発表では、これらのコントロールは、基礎となるモデルへの変更としてではなく、計画されたサービスの一部として示されています。その説明では、ストレージ、暗号化、アクセス、アラート処理を顧客の既存のクラウド環境にリンクしています。したがって、Anthropic の規定範囲は、監視機能と、参加組織による結果の記録の処理方法の両方をカバーします。
なぜそれが重要なのか
このサービスは、規制対象組織の中心的な問題に対処します。複数の AI セッションにわたる不正使用を検出するには、アクティビティ データの保持が必要になる場合がありますが、プライバシーとコンプライアンスのルールにより、データの保存場所とレビューできる人が制限される可能性があります。
この発表は、より高性能な AI システムによって生み出される緊張に対処するものです。 Anthropic 氏は、Claude Fable 5.1 などのモデルはより優れたインテリジェンスとエージェント機能を備えており、悪用と自律的な不正行為の両方の可能性が高まっていると述べています。同社によれば、高度な不正行為には、セッションやアカウントにまたがる多くのタスクが含まれる可能性があり、孤立した即座に破棄されるやり取りを通じて特定することが困難になるという。したがって、時間の経過に伴うアクティビティを相関させる監視システムは、厳密なゼロ保持設定では得られない情報を提供する可能性があります。
この機能により、プライバシーとコンプライアンスに別個の問題が生じます。規制対象の組織では、機密記録を保持できるベンダーや、特権的な法的資料、非公開情報、または医薬品安全性レポートを閲覧できるユーザーに制限が設けられている場合があります。 EFS は、これらの組織がすでに管理しているインフラストラクチャにログを保存し、既存のキー、権限、監査システムを適用できるようにすることを目的としています。説明どおりに実装すると、Anthropic または別の外部データ管理者を組織の信頼できるベンダーのリストに追加する必要性が軽減される可能性があります。
実際的な重要性は依然としてパフォーマンスとガバナンスに左右されます。この情報源には、Wells Fargo、Stripe、Snowflake、Cognition、Factory およびその他の組織の幹部からの支持が含まれていますが、検出精度、偽陽性率、レイテンシー、または対象範囲に関する独立したテストは提供されていません。また、顧客が管理するストレージによってプライバシーやセキュリティのリスクがすべて排除されるということも確立されていません。このサービスは、アクセス制御、調査、保持の決定、アラートへの対応などの重要な責任を顧客に移します。提案された取り決めはまた、信号を検出する行為を、そのプロセスで使用される記録の保管から分離する。 Anthropic の説明では、顧客はストレージ、キー、権限、レビューの制御を保持します。この分離は、機密活動データへの外部アクセスを制限しながら監視を必要とする組織にこのサービスが適合すると主張する根拠となっています。
インタラクティブなメカニズム: 実際にどのように機能するか
この開発の背後にある基盤となるテクノロジーをインタラクティブに探索します。
crm_get_transaction(id='4092').Why can ethical evaluation not be reduced to one model score?
次に見るべきもの
主な不明点は、モニタリングがどれほど効果的か、適格性がどのように判断されるか、そして顧客がアラートにどのように反応するかです。 Anthropic は、検出パフォーマンスの測定値、詳細な技術仕様、または正式な提供開始日を提供していません。
最初の課題は展開です。 Anthropic によると、EFS は今秋後半から段階的に展開され、秋後半には広く利用可能になることを目標としています。この発表では、具体的な日付は示されておらず、すべての資格要件も定義されておらず、各フェーズで何人の顧客がアクセスできるかについても言及されていません。また、同社は適格な顧客にサービスを提供するサードパーティ製品のサポートに取り組んでいると述べているが、それらの製品のスケジュールやリストは明らかにしていない。
2 番目の問題は技術的な透明性です。 Anthropic は、監視モデル、正確な保持ウィンドウ、フラグを生成するためのしきい値、検出中に Anthropic に送信される情報、または監視プロセスの操作に対する保護手段については説明していません。この情報源はまた、アラートの優先順位付け方法、顧客が検出システムを監査できるかどうか、クラウドアカウントや組織の境界を越えるアクティビティをサービスがどのように処理するかについても言及していない。
3 番目の問題は、フラグを立てた後の説明責任です。人間によるレビューは、Anthropic 従業員ではなく、顧客担当者が行うことが期待されています。これは、組織が内部の機密保持要件を満たすのに役立つかもしれませんが、結果が各顧客の人員配置、トレーニング、エスカレーション ルール、および行動の意欲に依存することも意味します。フォローアップレポートでは、現実世界の可用性、顧客調査、誤検知、誤用の見逃し、クラウドのコスト、そしてそのアーキテクチャが保護すべきプライバシーの保証を損なうことなく意味のある安全性の向上を提供しているかどうかを調査する必要があります。この発表では、Anthropic とその顧客の意図された責任について説明しながら、これらの運用上の疑問は未解決のままになっています。可用性、構成、および調査の実践により、提案がリストされた製品およびクラウド環境全体で一貫して機能するかどうかが決まります。これらの詳細は、サービスのプライバシー、セキュリティ、安全性の目標が実際にどのように相互作用するのかも示します。