跳到主要内容

已发布集合

Grok 和 Gemini 在 deepswe 中 medium effort 更高分

开发者选择推理档位时不能只看等级,需同时验证得分、成本和速度。

更新
编辑
Frontline Lab
内容数量
1
来源数量
1
时间范围
2026-08-18
主要标签
模型 · 模型评测 · Grok 和 Gemini · Google · xAI

已发布证据

每条内容都保留摘要,并提供回到来源语境的路径。

X

Grok 和 Gemini 在 deepswe 中 medium effort 更高分

推文称,最新版 grok 和 Gemini 在 deepswe 测评中出现推理等级倒挂,medium effort 得分高于 high/xhigh,同时价格更低、速度更快。

为什么重要开发者选择推理档位时不能只看等级,需同时验证得分、成本和速度。

原始来源