Mercury 2 — 現在利用できません
BazaarLink では現在このモデルを提供していません。このページは過去の仕様と評価の参照用に保持されています。
Technical specifications
独立第三者ベンチマーク
以下のスコアはすべて独立第三者機関 Artificial Analysis の評価によるもので、BazaarLink はテスト過程に関与していません。
知能 21
コーディング 31
数学
MMLU
GPQA 77
このモデルカテゴリ最強
コーディング能力
#111198 モデル中
LiveCodeBench / SciCode などのタスク
総合知能
#209573 モデル中
複数の学術ベンチマークを統合
初回トークン遅延
#541586 モデル中
AA 全球 p50:3.79 秒
知能
21
中位このモデル21
カテゴリ最強61
中央値15
コーディング
31
中位このモデル31
カテゴリ最強78
中央値37
GPQA
77%
—このモデル77%
カテゴリ最強94%
中央値69%
HLE
16%
—このモデル16%
カテゴリ最強53%
中央値7%
SciCode
39%
—このモデル39%
カテゴリ最強60%
中央値33%
IFBench
70%
—このモデル70%
カテゴリ最強83%
中央値44%
τ²-Bench Telecom
71%
—このモデル71%
カテゴリ最強99%
中央値46%
AA-LCR
36%
—このモデル36%
カテゴリ最強76%
中央値40%
Terminal-Bench Hard
27%
—このモデル27%
カテゴリ最強66%
中央値14%
コーディング能力 Top 5Coding Index ランキング
1GPT-5.6 Sol (xhigh)
openai/gpt-5-6-sol-xhigh78$5 / $304GPT-5.6 Sol (high)
openai/gpt-5-6-sol-high77$5 / $305Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)
anthropic/claude-opus-5-xhigh77$5 / $25よくある質問
Mercury 2 は BazaarLink でまだ利用できますか?
いいえ。Mercury 2 は現在利用できません。このページにある利用可能な代替モデルをご確認ください。
中継先の整合性チェック
このモデルの検証データはまだありません。
BazaarLink Probe はこのモデルを提供すると主張する endpoint を検証し、基準と異なる挙動を異常として記録します。
完全な検証レポートを見る →