api.b.ai

api.b.ai · 已测 6 个模型 · 更新于 11天前

40.3
综合评分
前往该中转站 查看完整测评明细

评分概览

综合分 = 能力 40% + 性能 40% + 一致性 20%,来自本站统一测评(能力题 + 一致性专项)。
40.3
综合评分
4.6
能力分(40%)
56.4
性能分(40%)
79.3
一致性分(20%)
0.22s
首字最快用时
1.76s
首字平均用时
1,000.0
每秒最大 tokens
94.6
平均每秒 tokens
0.92秒
平均延迟
glm-5.3
最佳模型
测评预警 glm-5.3:题目通过率 0%,低于 75%;glm-5.3:最低能力维度 0 分,低于 30 分;kimi-k3:题目通过率 0%,低于 75%;kimi-k3:最低能力维度 0 分,低于 30 分;deepseek-v4-pro:题目通过率 0%,低于 75%;deepseek-v4-pro:最低能力维度 0 分,低于 30 分;glm-5.3-flash:题目通过率 10%,低于 75%;glm-5.3-flash:最低能力维度 0 分,低于 30 分;qwen3.8-flash:题目通过率 20%,低于 75%;qwen3.8-flash:最低能力维度 0 分,低于 30 分;deepseek-v4-flash:题目通过率 0%,低于 75%;deepseek-v4-flash:最低能力维度 0 分,低于 30 分。以上为测评预警,不等同于安全或诈骗结论。

各模型测评明细(6 个)

每个模型展示其最新一次统一测评结果,点击模型名可查看完整测评报告(含一致性专项逐项明细)。
模型综合分能力分性能分一致性分 平均延迟首字最快首字平均每秒最大
tokens
glm-5.3 GLM / ChatGLM · 成功 0%(0/10) 50.0 0.0 75.0 100.0 0.42秒 · 快 0.22秒 0.29秒 1,000.0
kimi-k3 Kimi / Moonshot · 成功 0%(0/10) 50.0 0.0 75.0 100.0 0.32秒 · 快 0.23秒 0.23秒 1,000.0
deepseek-v4-pro DeepSeek · 成功 0%(0/10) 50.0 0.0 75.0 100.0 0.32秒 · 快 0.64秒 0.64秒 1,000.0
glm-5.3-flash GLM / ChatGLM · 成功 10%(1/10) 32.0 8.5 40.6 61.8 1.73秒 · 快 1.51秒 1.53秒 72.4
qwen3.8-flash 通义千问 / Qwen · 成功 20%(2/10) 31.5 19.2 52.5 14.0 1.36秒 · 快 0.64秒 0.85秒 131.6
deepseek-v4-flash DeepSeek · 成功 0%(0/10) 28.2 0.0 20.5 100.0 1.39秒 · 快 7.02秒 7.02秒 110.6

返回排行榜

Ai速测 · 仅作能力评测与导航参考,不代表任何商业推荐 · 数据由社区提交