费用
所需费用。
| 工作 | 用户价格 | 条款 |
|---|---|---|
| 前沿开放模型的发布评估 | 对实验室免费 | 每项评估全包 20 万美元,由慈善资金资助 |
| 为前沿开放模型的第三方评估提供算力 | 每 H200 GPU 小时 $1.55 | 低于公开的 H200 报价 |
| 学术、安全研究中心及独立安全研究 | 按成本或低于成本 | 分配取决于计划工作和可用资源 |
| 事件调查 | 另行商定 | 资源允许时提供 GPU 支持 |
算力按每 H200 GPU 小时计费。访问方式、范围和容量在工作开始前商定;在发布窗口期内,发布前评估优先。
比 2026 年 9 月 28 日 H200 按需租用价格中位数(每 GPU 小时 $2.47;GPU Finder,31 条单 GPU 报价)低 37%。当天有现货的 H200 最低价为 PrimeIntellect 的 $2.00;Runpod Secure Cloud 报价 $4.59。AI 安全算力应有的价格 ↗
发布评估
如何用 20 万美元 评估一个模型。
一项较大规模任务包括基准测试、复现、定向对抗测试、诊断和复测。每次重大模型发布的预算为 20 万美元,较小规模迭代的费用则低得多。
从商定启动到交付发现并完成约定范围的复测,我们的目标是三周。
我们记录每项已完成评估的 GPU 小时数、排队时间和成本,并在对所合作的模型和实验室进行匿名化处理后公开这些指标。我们持续关注限制最大的环节(硬件、实验室接口、研究人员时间、评估复杂度),并努力解决这些瓶颈。
查看评估流程一项范围明确的评估
- 评估算力与实验环境已包含
- 研究与交付人员已包含
- 调查、复现与约定范围内的复测已包含
- 存储与数据传输已包含
- 分摊的运营成本与应急预算已包含
- 私下交付的发现与资源使用说明已包含
评估全包价格$200k
风险与注意事项
算力具有可替代性。免费评估可能腾出实验室自身预算,用于能力开发。使用限制和监测可降低特定风险,但不能消除这一间接影响。
评估也可能帮助实验室改进模型。当我们预期安全收益超过能力提升带来的收益时,我们接受这一权衡。我们的判断是,这些模型很可能仍会发布,而发布前增加审视,有望在尚有时间应对时揭示风险。