Claude 网络验证计划

Anthropic 会对前沿 Claude 模型应用实时网络安全防护措施,以防止其在恶意网络操作中被滥用。Anthropic 的网络验证计划 (CVP) 是一种信任框架,可让经过验证的组织使用 Claude 模型执行合法的防御性网络安全任务,同时解除默认的双重用途限制。

本文档介绍了 CVP 在 Gemini Enterprise Agent Platform 上的运作方式、支持的模型,以及如何为项目注册和配置模型。

网络安全保障措施的运作方式

Anthropic 的实时评估分类器会检查提示和补全内容,以防范与网络安全相关的风险。这些保护措施将活动分为两个层级:

  • 禁止的用途:风险较高的恶意活动,几乎或完全没有合法的防御应用,例如勒索软件开发、命令和控制 (C2) 基础设施生成、恶意软件编写或自动大规模数据渗漏。系统会永久屏蔽所有用户的违规活动。网络验证计划绝不会解除对禁止活动的限制。
  • 高风险双重用途:对授权安全运维至关重要,但威胁行为者也可能会滥用的活动。例如,漏洞发现、可利用性分析、概念验证漏洞验证、红队演练和攻击者攻击路径模拟。双重用途活动默认处于屏蔽状态,但已通过验证的组织可以通过网络验证计划调整这些安全措施。

如需详细了解 Anthropic 的使用政策,请参阅 Claude 的实时网络安全防护措施

支持的模型

Agent Platform 上的网络验证计划支持以下 Anthropic 模型:

  • Claude Opus 4.7、Claude Opus 4.8 和 Claude Sonnet 5:需要启用高级 AI 功能 (advancedAiEnabled: true)。
  • Claude Opus 5:需要同时启用高级 AI 功能 (advancedAiEnabled: true) 和与 Anthropic 共享数据 (dataSharingEnabledProvider: ANTHROPIC)。

准备工作

在加入网络验证计划之前,请确保您满足以下前提条件:

  • 启用了 Agent Platform API 的 Google Cloud 项目。
  • 项目中的以下 Identity and Access Management (IAM) 权限:

    • 如需接受《高级 AI 安全附录》,您需要拥有 aiplatform.consents.update 权限,该权限包含在 Agent Platform Administrator (roles/aiplatform.admin) 角色中。
    • 如需配置发布商模型设置,您需要拥有 aiplatform.endpoints.setPublisherModelConfig 权限,该权限包含在 Agent Platform Administrator (roles/aiplatform.admin) 角色中。
  • 了解数据保留:将模型注册到 CVP 后,该模型会根据 Google 的《高级 AI 安全附录》被指定为“高级 AI”。根据 Anthropic 的安全政策,发送给启用 CVP 的模型的提示和回答会保留最多 30 天,以用于滥用行为监控。如需了解详情,请参阅高级 AI 安全

  • 数据共享了解情况(仅限 Claude Opus 5):对于使用 CVP 的 Claude Opus 5,Anthropic 要求启用数据共享以进行滥用行为监控。如需注册 Claude Opus 5,您必须同意数据保留,并配置与 Anthropic 的数据共享。如需了解详情,请参阅记录和分享请求与响应

如何加入

在 Agent Platform 上加入网络验证计划的过程分为三个步骤:

  1. 在Google Cloud 控制台中接受《高级 AI 安全附录》
  2. 填写 Anthropic 的网络用例申请表单
  3. 使用 setPublisherModelConfig API 在每个目标模型和位置启用高级 AI,如果使用 Claude Opus 5,请启用数据共享。

第 1 步:接受《高级 AI 安全附录》

获得授权的管理员必须针对每个 Google Cloud 项目接受一次《高级 AI 安全附录》。

如需接受附加条款,请执行以下操作:

  1. 在 Google Cloud 控制台中,前往 Model Garden

    转到 Model Garden

  2. 选择符合条件的 Claude 模型。请参阅支持的模型

  3. 在模型详情页面上,找到网络验证计划(可选)卡片。

  4. 点击注册步骤,展开注册核对清单。

  5. 第 1 步:接受《高级 AI 安全附录》中,查看该附录,然后选中确认复选框,表明您有权约束组织遵守该附录。

  6. 点击接受

第 2 步:填写 Anthropic 的网络使用情形表单

您安全团队的授权代表必须直接向 Anthropic 提交申请:

  1. 前往 Anthropic 网络使用情况表单
  2. 平台部分中,选择 Google Cloud
  3. 输入所需信息。
  4. 描述您的防御性安全工作流程和用例(例如,授权的渗透测试、漏洞研究或安全运营)。
  5. 提交表单。

第 3 步:在模型上启用高级 AI

接受《高级 AI 安全附录》并获得 Anthropic 的批准后,请在您要用于防御性网络安全工作的每个 Claude 模型上配置所需设置。配置必须按项目、位置、发布商和模型应用。

对于 Claude Opus 4.7、Claude Opus 4.8 和 Claude Sonnet 5

v1beta1 端点上调用 setPublisherModelConfig 以启用 advancedAiEnabled

curl -X POST \
  -H "Authorization: Bearer $(gcloud auth print-access-token)" \
  -H "Content-Type: application/json" \
  "https://aiplatform.googleapis.com/v1beta1/projects/PROJECT_ID/locations/global/publishers/anthropic/models/MODEL_ID:setPublisherModelConfig" \
  -d '{
    "publisherModelConfig": {
      "claudeFeatureConfig": {
        "advancedAiEnabled": true
      }
    },
    "updateMask": "claudeFeatureConfig.advancedAiEnabled"
  }'

替换以下内容:

  • PROJECT_ID:您的 Google Cloud 项目 ID。
  • MODEL_ID:Claude 模型标识符(例如 claude-opus-4-8claude-sonnet-5)。

对于 Claude Opus 5

对于 Claude Opus 5,Anthropic 要求同时启用 advancedAiEnabled 和与 Anthropic 共享数据 (dataSharingEnabledProvider):

curl -X POST \
  -H "Authorization: Bearer $(gcloud auth print-access-token)" \
  -H "Content-Type: application/json" \
  "https://aiplatform.googleapis.com/v1beta1/projects/PROJECT_ID/locations/global/publishers/anthropic/models/claude-opus-5:setPublisherModelConfig" \
  -d '{
    "publisherModelConfig": {
      "claudeFeatureConfig": {
        "advancedAiEnabled": true
      },
      "dataSharingEnabledProvider": "ANTHROPIC"
    },
    "updateMask": "claudeFeatureConfig.advancedAiEnabled,dataSharingEnabledProvider"
  }'

请将 PROJECT_ID 替换为您的 Google Cloud 项目 ID。

重要的 API 注意事项

  • 使用 v1beta1setPublisherModelConfig 方法在 v1beta1 API 表面上受支持。
  • 始终包含 updateMaskupdateMask 字段至关重要。如果您省略 updateMask,则调用会替换整个 PublisherModelConfig 对象,从而无意中清除其他设置,例如 loggingConfigdataSharingEnabledProvider
  • 长时间运行的操作:此方法会返回 google.longrunning.Operation。轮询该操作,直到返回 done: true
  • 配置范围:发布商模型配置的范围为每个项目、位置、发布商和模型。如果您在多个区域中使用模型,请配置每个端点。

验证模型配置

如需验证是否已为特定模型启用高级 AI,请调用 fetchPublisherModelConfig 方法:

curl -X GET \
  -H "Authorization: Bearer $(gcloud auth print-access-token)" \
  "https://aiplatform.googleapis.com/v1beta1/projects/PROJECT_ID/locations/global/publishers/anthropic/models/MODEL_ID:fetchPublisherModelConfig"

如果为 Claude Opus 4.7、Claude Opus 4.8 和 Claude Sonnet 5 启用了高级 AI,则响应如下:

{
  "claudeFeatureConfig": {
    "advancedAiEnabled": true
  }
}

如果 Claude Opus 5 已启用高级 AI,则响应如下:

{
  "claudeFeatureConfig": {
    "advancedAiEnabled": true
  },
  "dataSharingEnabledProvider": "ANTHROPIC"
}

问题排查

本部分介绍了如何解决您在加入或使用网络验证计划时可能会遇到的常见问题。

在网络安全任务方面,请求仍会被屏蔽

如果您的提示继续触发安全措施拒绝:

  1. 确认活动类别:验证任务是否为合法的两用任务,而不是禁止的用例。所有用户都无法在 CVP 下解除对禁止活动的永久封禁, 例如勒索软件代码编写或恶意软件开发。
  2. 验证 Anthropic 审批情况:确认 Anthropic 已针对贵组织的 CVP 申请发送审批确认电子邮件。
  3. 检查项目是否一致:确保推理请求源自您在 Anthropic 申请中提交的 Google Cloud 项目 ID,并且该项目 ID 对应的附录已被接受。
  4. 确认模型级配置:对您要调用的确切模型 ID 和区域调用 fetchPublisherModelConfig,以确认 advancedAiEnabled: true 处于有效状态(对于 Claude Opus 5,则为 dataSharingEnabledProvider: ANTHROPIC)。模型配置的范围限定为每个模型、每个位置和每个项目。
  5. 提交误报申诉:如果您认为系统错误地屏蔽了合法的防御性提示,请使用 Anthropic 的网络屏蔽报告和申诉表单提交申诉。

接受附录时权限遭拒

如果您在尝试接受 Model Garden 中的附录时收到权限错误,请确保您的账号具有 aiplatform.consents.update 权限。请与您的项目管理员联系,让对方为您分配 Agent Platform Administrator 角色 (roles/aiplatform.admin)。

API 响应中缺少字段

如果调用 fetchPublisherModelConfig 返回一个空对象 ({}),则表示尚未对相应模型应用任何自定义发布商模型设置。使用适当的 updateMask 重新运行 setPublisherModelConfig

后续步骤