数据与方法
理解每个数字的含义。
本网站图表的来源、定义与局限。观测数据和规划估算分别呈现。
01
发布追踪
此快照查询 42 个 Hugging Face 组织 ID,读取 6,977 个仓库。保留至少 250 赞的 text-generation、image-text-to-text 及 any-to-any 模型,排除特定量化版本和衍生格式。
系列归并参数规模、精度、检查点和指定发布后缀。Flash、Pro、Coder、Vision 等产品层级分别保留。最早仓库创建日期用作发布日期近似值,系列中最高点赞数决定受欢迎程度分组。
| 阈值 | 过去 365 天 |
|---|---|
| 250+ | 113 |
| 500+ | 76 |
| 1,000+ | 42 |
这些是嵌套门槛,三个数不能相加。点赞反映受欢迎程度,不是能力。新发布模型积累点赞的时间更短;未扫描仅在 ModelScope 发布的模型;系列匹配使用启发式规则。月度图排除快照所在的不完整月份。
一手来源:Hugging Face API ↗02
评估覆盖
审查参考模型卡、技术报告、发布文章和独立评估报告。每个已审查条目被赋予证据支持的最高公开等级。最高等级不描述该模型经历的所有评估。
- T3独立评估
- 由独立方开展、方法公开的危险能力评估。这不代表测试全面,也不代表模型安全。
- T2开发者评估
- 开发者开展的危险能力评估。开发者并非独立评估方。
- T1开发者文档
- 有模型卡或常规安全披露,但来源审查中未找到符合标准的危险能力评估。
- T0未找到评估
- 完成来源审查后,未发现符合标准的评估或安全披露。这不证明其不存在。
- —尚未审阅
- 审查尚未完成。绝不计为 T0,也不计为缺少评估。
为什么是 42 个系列、40 条记录?
42 个高关注系列中,17 个进入记录、4 个不满足前沿范围规则、21 个待审查。19 条已编码记录包括 18 条具体发布版本与 1 条 Qwen3.6 系列;Gemma 4 有多个检查点记录。MiniMax-M2 现已正确列为待审查,不能继承 MiniMax-M2.5 的审查。
“独立评估”描述模型评估方:独立于开发者,公布方法与相关结果。“内部二次核查”描述记录审查:19 条记录中有 12 条于 9 月 1 日经 AI 辅助的第二次来源核查。两种标签均不代表数据集已获第三方审计。
V2 重新核查六条 T3 记录的定级报告及已编码记录的全部 57 个引用链接,修正了系列匹配、日期与重定向来源。此项工作仍属于内部审查,尚无外部审计签字;不完整的否定结论和检查点歧义继续明确标示。
查看附来源的记录 ↗追溯一条记录
Qwen3.5-122B-A10B
查看来源
论文摘要列明了受控自主复制实验中的 Qwen3.5-122B-A10B。
摘要 · arXiv v1 ↗按规则分类
T3 分类记录方法公开且有相关自主性结果的独立评估。这是我们的来源编码,并非作者给出的评级或审计背书。
查看规则 ↗核对记录
同一记录用于台账行、首页方块与下载数据。不能从这一项研究推断其他领域的覆盖或模型整体安全。
model-qwen3-5-122b-a10b
来源位置核查于 2026 年 9 月 8 日。数据集保留 9 月 1 日快照及原有分类;本追溯示例不是外部审计。
03
成本估算
当前评估全包价格为 20 万美元,包含交付人员、算力、存储与传输、调查与约定复测,以及分摊运营成本和应急预算,确定于 2026 年 9 月 7 日。这是项目定价,并非供应商报价、实测均值或外部审计成本模型。
资金计划为 2026 年初期筹款 400 万美元、2027 年项目预算 1,200 万美元。这些是目标,并非已落实资助。详细分配、评估承载能力与资金结转正在核算。此前的直接工作负载区间已不再适用,不能作为全包成本明细的依据。下载数据中未知金额用 null 表示,而不是零。
查看全包范围 ↗04
术语
- 开放权重
- 可下载并运行的模型参数。访问与许可条款可能不同;“开放权重”不等于无限制的开源。
- 危险能力评估
- 测试模型是否会实质性促成严重伤害,例如生物、网络或自主任务领域。每项测试范围有限,不涵盖所有可能用途。
- 黑盒 / 白盒
- 黑盒测试使用输入和输出,通常通过接口进行。白盒工作还访问权重或激活等模型内部信息。
- 评估任务
- 围绕模型开展、范围明确的评估、复现和跟进工作。不同于发布系列、台账条目或 GPU 作业。
05
下载与引用
下载文件包含公开字段和来源链接,不含内部编码笔记。复用图表时请保留快照日期和方法说明。
Pacific Compute Ledger, 2026-09-01, snapshot 17df23f. https://pacificcompute.org/ledger.
数据快照: 2026年9月1日如需建议更正,请发送模型、拟修改的说法及一手来源至 [email protected].