太平洋算力
面向实验室团队旧金山 · 新加坡

发布前 安全评估。

发布前的危险能力评估,以及后续复现、诊断和复测。访问与范围按评估任务商定,并取决于可用资源。

实验室免费参与发布评估。

模型由你控制,配套评估由我们支持。

实验室端

目标模型

权重留在此处

请求响应

Pacific Compute

评估算力
  • 攻击模型
  • 评分模型
  • 并行实验
  • 方法开发

通过接口开展评估时,模型由实验室托管,访问权限也由实验室控制。未发布权重默认留在你方,仅在可信合作安排下授予更深入的访问权限。我们的算力运行配套评估工作。

实验室控制的租户环境

实验室控制的租户环境旨在让你的工程师掌控分区、模型密钥及获准用户。工作开始前,我们直接与你的实验室商定配置、权重保管和安全要求。

太平洋算力面向实验室团队

让发现转化为行动。

3–4周,从商定启动起

评估按目标三周、最长四周规划,从商定启动到交付发现并完成约定复测。

评估发现仅向实验室指定团队私下交付。参与不以公开结果或公开确认合作为条件。

发现报告包含什么

问题
模型版本、访问方式及所调查的安全问题。
测试覆盖
已完成测试、试验次数、条件及未测试内容。
发现
附支持证据的观察结果,包括阴性结果或无法得出结论的结果。
局限
不确定性、评分核查及证据无法证明的事项。
复现与复测
复现记录、约定范围内的复测结果,或无法复测的原因。
资源
算力与接口用量、人员时间、存储与传输,以及核对后的成本。

发现问题之后。

实验室决定如何应对。 可应实验室要求对后续候选版本复测。

在极少数情况下,如果评估发现需要紧急缓解的危险问题,我们可以在集群中由实验室控制的分区内支持有限的监督微调,随后重新评估。

评估材料仅按与实验室约定的用途和期限保留。最少必要的运营记录另行处理。

资助方不获得实验室评估发现或运营记录的访问权。

安全范围与保密 ↗