独立模型榜

模型能力排行榜

把人类偏好、推理、编程与开放权重评测分开呈现,提供可追溯的模型选型参考。

正式模型
34
已同步来源
4
审核池
71
多来源公开快照 · 不把不同 benchmark 原始分数直接相加快照时间: 2026/8/17

至少两个独立来源后才计算 ToolCenter 综合参考分。

至少两个独立公开来源

综合参考分怎么计算

综合参考分使用标准化百分位,不替代任何官方榜单,也不代表某个来源的官方总分。

人类偏好35%
推理能力25%
编程与 Agent25%
知识与稳定性15%

至少两个独立来源后才计算 ToolCenter 综合参考分。