基元律动|多模型 AI API 与 OpenSquilla 智能路由

tokenrhythm.studio · 已测 10 个模型 · 更新于 11天前

47.8
综合评分
前往该中转站 查看完整测评明细

评分概览

综合分 = 能力 40% + 性能 40% + 一致性 20%,来自本站统一测评(能力题 + 一致性专项)。
47.8
综合评分
26.0
能力分(40%)
67.5
性能分(40%)
52.0
一致性分(20%)
0.61s
首字最快用时
3.80s
首字平均用时
1,000.0
每秒最大 tokens
130.1
平均每秒 tokens
10.54秒
平均延迟
kimi-k2.7-code
最佳模型
测评预警 kimi-k2.7-code:成功率低于 85%;qwen3.8-max:成功率低于 85%;qwen3.8-max:最低维度低于 35 分;glm-5.2:题目通过率 30%,低于 75%;glm-5.2:最低能力维度 0 分,低于 30 分;glm-5:题目通过率 30%,低于 75%;glm-5:最低能力维度 0 分,低于 30 分;qwen3.8-flash:题目通过率 20%,低于 75%;qwen3.8-flash:最低能力维度 0 分,低于 30 分;deepseek-v4-pro:题目通过率 11.11%,低于 75%;deepseek-v4-pro:最低能力维度 0 分,低于 30 分;deepseek-v4-flash:题目通过率 10%,低于 75%;deepseek-v4-flash:最低能力维度 0 分,低于 30 分;glm-5.3-flash:题目通过率 10%,低于 75%;glm-5.3-flash:最低能力维度 0 分,低于 30 分;deepseek-v4-pro-0813:题目通过率 10%,低于 75%;deepseek-v4-pro-0813:最低能力维度 0 分,低于 30 分;deepseek-v4-flash-0731:题目通过率 10%,低于 75%;deepseek-v4-flash-0731:最低能力维度 0 分,低于 30 分。以上为测评预警,不等同于安全或诈骗结论。

各模型测评明细(10 个)

每个模型展示其最新一次统一测评结果,点击模型名可查看完整测评报告(含一致性专项逐项明细)。
模型综合分能力分性能分一致性分 平均延迟首字最快首字平均每秒最大
tokens
kimi-k2.7-code Kimi / Moonshot · 成功 70%(7/10) 70.8 66.7 87.2 46.4 7.76秒 · 中 0.86秒 2.51秒 105.9
qwen3.8-max 通义千问 / Qwen · 成功 70%(7/10) 56.3 68.9 65.2 13.1 10.25秒 · 中 1.34秒 2.86秒 52.6
glm-5.2 GLM / ChatGLM · 成功 30%(3/10) 52.7 26.7 81.0 48.0 9.15秒 · 中 0.76秒 1.27秒 119.4
glm-5 GLM / ChatGLM · 成功 30%(3/10) 47.3 31.1 63.3 47.7 19.16秒 · 高 1.11秒 2.01秒 93.3
qwen3.8-flash 通义千问 / Qwen · 成功 20%(2/10) 46.8 19.6 71.2 52.5 6.58秒 · 中 0.64秒 0.91秒 84.7
deepseek-v4-pro DeepSeek · 成功 11%(1/9) 45.4 10.0 72.7 61.8 8.30秒 · 中 1.59秒 2.42秒 1,000.0
deepseek-v4-flash DeepSeek · 成功 10%(1/10) 44.1 11.1 73.1 52.2 4.89秒 · 快 0.61秒 2.21秒 1,000.0
glm-5.3-flash GLM / ChatGLM · 成功 10%(1/10) 44.1 8.7 70.6 61.8 7.04秒 · 中 0.74秒 1.51秒 100.5
deepseek-v4-pro-0813 DeepSeek · 成功 10%(1/10) 37.0 8.7 45.7 76.0 16.62秒 · 高 2.84秒 10.96秒 1,000.0
deepseek-v4-flash-0731 DeepSeek · 成功 10%(1/10) 33.5 8.7 44.7 61.0 15.65秒 · 高 2.61秒 11.31秒 432.0

返回排行榜

Ai速测 · 仅作能力评测与导航参考,不代表任何商业推荐 · 数据由社区提交