Grok 4 — 已退役模型
此模型已结束服务,无法再通过 BazaarLink 使用;下方仍保留历史规格与独立评测。
技术规格
独立第三方评测
所有分数来自 Artificial Analysis 的独立第三方评测,BazaarLink 不参与测试过程。
智商 27
编码
数学 93
MMLU 87
GPQA 88
本模型类别最强
综合智商
#155于 630 个模型中
整合多项学术 benchmark
智商
27
前 25%本模型27
类别最强57
中位数11
数学
93
—本模型93
类别最强99
中位数53
MMLU Pro
87%
—本模型87%
类别最强90%
中位数75%
GPQA
88%
—本模型88%
类别最强94%
中位数69%
LiveCodeBench
82%
—本模型82%
类别最强42%
中位数42%
HLE
24%
—本模型24%
类别最强53%
中位数7%
SciCode
46%
—本模型46%
类别最强60%
中位数34%
IFBench
54%
—本模型54%
类别最强83%
中位数44%
τ²-Bench Telecom
75%
—本模型75%
类别最强99%
中位数46%
AA-LCR
68%
—本模型68%
类别最强76%
中位数40%
Terminal-Bench Hard
38%
—本模型38%
类别最强66%
中位数14%
编码能力 Top 5Coding Index 排行榜
2Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)
?/claude-fable-5-1-xhigh81$10 / $503Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)
?/claude-fable-5-1-high79$10 / $504GPT-5.6 Sol (xhigh)
openai/gpt-5-6-sol-xhigh78$4 / $20常见问题
我还能使用已退役的 Grok 4 吗?
不能。Grok 4 已退役,本页仅保留作为历史参考,请改用本页链接的可用替代模型。
中转站完整性检测
- 已测试 endpoint
- 1 次
- 独立 hosts
- 1
- 模型家族指纹一致率
- 0%
- 检测到异常
- 1 次
- 数据范围
- 过去 90 天
BazaarLink Probe 会验证声称提供该模型的 endpoint,并将与基准不符的行为标记为异常。
查看完整检测报告 →