已上线
我们从租用算力起步,通过 2026 年发布的模型验证我们的思路。首个小型 H200 集群已在新加坡运行。遇到模型发布时,我们可以方便地向新加坡合作供应商租用更多算力,迅速扩充容量。
为什么选择新加坡
新加坡在 AI 安全工作方面处于领先地位,也是开展泛太平洋开放模型安全合作的务实选址。我们首个集群的资金来自私人慈善捐赠,用于守护开放模型前沿。
服务对象
我们的新加坡集群服务于亚洲的开放模型实验室、学术研究者和安全研究中心;在亚洲,获取专用 AI 安全算力和国际评估网络的渠道最为有限。随着开放模型前沿从中国和美国扩展到其他国家,我们已准备好扩展新加坡集群,以满足对自主的 AI 安全算力的需求。
面向模型开发者
我们免费为前沿模型安全评估提供算力。
在开放权重发布前测试危险能力,是我们新加坡中心的核心使命。在模型发布前与实验室和评估合作伙伴协作,意味着更安全的开放模型前沿。
发布前的权重属于敏感信息,许多实验室也有包含专有技术的内部安全评估。我们与太平洋两岸的实验室合作,确保无论安全或安保要求如何,都能提供算力,助力新模型发布的安全与评估工作。
面向安全研究者
优惠安全研究算力
安全与对齐工作需要自主、独立的算力资源才能蓬勃发展。
价格可负担、切实有效的算力资源,将有助于激励整个开放模型前沿开展更多安全工作。从定向红队测试、可解释性到复现研究,我们提供推动 AI 安全所需的算力与支持。
共同开展研究
信任、安全与保障
从初次咨询到交付发现报告,明确谁处理哪些信息。
- 初次联系
- 接洽团队通过邮件服务商接收你的联系方式和不含敏感信息的简介。微信由团队人工跟进;初次咨询请勿发送模型检查点或保密发现。
- 目标模型权重
- 通过接口开展评估时,模型由实验室托管,访问权限也由实验室控制。未发布权重默认留在你方,仅在可信合作安排下授予更深入的访问权限。我们的算力运行配套评估工作。
- 评估发现
- 评估发现仅向实验室指定团队私下交付。参与不以公开结果或公开确认合作为条件。
- 研究材料
- 保密条款明确谁可以处理研究材料、材料的允许用途及保留期限。任务元数据和监测记录的访问范围另行约定。
- 运营记录
- Pacific Compute 对集群上开展的工作保留最少必要记录,以确保遵守仅用于安全工作的承诺。我们会与你的团队合作,尊重你现有的隐私和安全政策。
实验室控制的租户环境旨在让你的工程师掌控分区、模型密钥及获准用户。工作开始前,我们直接与你的实验室商定配置、权重保管和安全要求。
分享敏感材料前,我们先商定保密条款及开展评估所需的人员范围。初次咨询只需简短、不含敏感信息的描述。
实验室控制的租户环境 ↓为什么开展这项工作
安全评估不应与能力研发争夺 GPU。我们的使命是帮助开放模型实验室在完成整套安全评估后发布开放权重模型,并支持研究者利用开放前沿模型开展重要的安全工作。
在发布前窗口增加安全工作,能够为开放模型开发者和研究者社区提供更安全、更符合对齐目标的模型,使整个开放模型生态受益。
访问与保管
发布前是优先窗口。
两种配置满足不同需求。接口访问支持黑盒评估。
发布前评估,无需转移目标模型权重。
接口工作流
实验室托管接口,可查看每次查询。
GPU 运行辅助模型,与工具环境和评估调度配合。
资源分配取决于评估套件。接口测试也需商定模型身份、访问限制和评估独立性。
白盒访问,由实验室控制。
实验室操作的专用分区
私有目标权重 + 评估限制外传 · 约定的工作负载规则
实验室控制的租户环境旨在让你的工程师掌控分区、模型密钥及获准用户。工作开始前,我们直接与你的实验室商定配置、权重保管和安全要求。
安全微调
默认规则是不进行梯度更新。在极少数情况下,如果评估发现需要紧急缓解的危险问题,我们可以在集群中由实验室控制的分区内支持有限的监督微调,随后重新评估。
发布后:支持性项目
公开权重可在本地运行,用于安全持久性测试、可解释性和复现。这些支持性工作补充发布前的评估任务。
评估任务示例
围绕发布窗口安排。
目标三周,最长四周:从商定启动到交付发现并完成约定范围的复测。
- 模型与访问
- 由实验室托管的一款发布前模型,明确版本并约定接口容量。
- 评估范围
- 两个商定的安全领域,包括初测、调查与复现。在约定窗口内,可对后续候选版本复测。
- 交付给实验室
- 私下交付发现报告、支持证据、方法与局限说明、复测记录及资源使用说明。不提供安全认证。
- 第 1 周
校准并开始测试
确认评估套件、访问条件和算力需求。运行测试并完成配置。
- 第 2 周
调查与复现
开展主体评估。一旦出现重要发现,及时告知实验室。
- 第 3 周 · 必要时第 4 周
复测与交付
完成约定复测与发现报告。
发现报告包含什么
示例文件结构,并非已完成任务的发现。私下交付给实验室。
| 问题 | 模型版本、访问方式及所调查的安全问题。 |
|---|---|
| 测试覆盖 | 已完成测试、试验次数、条件及未测试内容。 |
| 发现 | 附支持证据的观察结果,包括阴性结果或无法得出结论的结果。 |
| 局限 | 不确定性、评分核查及证据无法证明的事项。 |
| 复现与复测 | 复现记录、约定范围内的复测结果,或无法复测的原因。 |
| 资源 | 算力与接口用量、人员时间、存储与传输,以及核对后的成本。 |
评估发现仅向实验室指定团队私下交付。参与不以公开结果或公开确认合作为条件。
讨论评估任务 ↗集群规则
新加坡集群使用规则
仅限开放前沿安全工作
Pacific Compute 提供评估、诊断与安全研究算力。允许的任务和访问权限在工作开始前商定。工作负载限制是我们的运营要求之一;我们与合作伙伴开展这些范围明确的任务,不开展模型能力提升工作。
默认规则是不进行梯度更新。在极少数情况下,如果评估发现需要紧急缓解的危险问题,我们可以在集群中由实验室控制的分区内支持有限的监督微调,随后重新评估。
开放前沿模型
我们处理已发布的开放权重,以及计划开放发布的模型。未发布的目标模型权重须签订明确的访问协议。
可核查的使用
我们与开放前沿模型实验室合作,并尊重其安全和保密要求。为确保所有合作伙伴将算力用于安全工作,我们检查任务元数据,并采用简单、尊重隐私的监测系统。我们正在测试集群的遥测工作负载分类,以确保敏感数据和模型权重保持安全。记录访问权限与实验室商定,慈善资助方不获得访问权。
了解集群遥测监测:论文与局限 ↗不开展政治性工作
Pacific Compute 不支持与政治有关的安全工作:不开展偏见测试、审查或任何形式的政治工作。即使是私下评估,也严格执行这一规则。所有参与实验室和研究者适用相同范围。