Llama 3.1 Nemotron Ultra 253b V1 — Model dihentikan
Model ini telah dihentikan dan tidak lagi tersedia melalui BazaarLink. Spesifikasi historis dan benchmark independen tetap tersedia.
Spesifikasi teknis
Benchmark pihak ketiga independen
Semua skor berasal dari evaluasi pihak ketiga independen Artificial Analysis; BazaarLink tidak terlibat dalam proses pengujian.
Kecerdasan 8
Coding
Matematika 64
MMLU 83
GPQA 73
Model iniTerbaik di kategori
Kecerdasan keseluruhan
#444dari 638 model
Gabungan berbagai benchmark akademik
Kecerdasan
8
Kelas menengahModel ini8
Terbaik di kategori53
Median12
Matematika
64
—Model ini64
Terbaik di kategori99
Median53
MMLU Pro
83%
—Model ini83%
Terbaik di kategori90%
Median75%
GPQA
73%
—Model ini73%
Terbaik di kategori94%
Median69%
LiveCodeBench
64%
—Model ini64%
Terbaik di kategori42%
Median42%
HLE
8%
—Model ini8%
Terbaik di kategori53%
Median7%
SciCode
35%
—Model ini35%
Terbaik di kategori60%
Median34%
IFBench
38%
—Model ini38%
Terbaik di kategori83%
Median44%
τ²-Bench Telecom
11%
—Model ini11%
Terbaik di kategori99%
Median46%
AA-LCR
7%
—Model ini7%
Terbaik di kategori76%
Median40%
Terminal-Bench Hard
2%
—Model ini2%
Terbaik di kategori66%
Median14%
Top 5 — CodingPapan peringkat Coding Index
2Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback)
?/claude-fable-5-1-xhigh81$10 / $503Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback)
?/claude-fable-5-1-high79$10 / $504GPT-5.6 Sol (xhigh)
openai/gpt-5-6-sol-xhigh78$4 / $20AASumber: Artificial Analysis · Evaluasi pihak ketiga independen; tidak dipengaruhi BazaarLinkLihat evaluasi lengkap di AA →
Pertanyaan umum
Apakah model Llama 3.1 Nemotron Ultra 253b V1 yang dihentikan masih dapat digunakan?
Tidak. Llama 3.1 Nemotron Ultra 253b V1 telah dihentikan dan halaman ini hanya untuk referensi historis. Gunakan alternatif aktif yang ditautkan.
Pemeriksaan integritas endpoint relai
Belum ada data pemeriksaan integritas untuk model ini.
BazaarLink Probe memverifikasi endpoint yang mengaku menyediakan model ini dan menandai perilaku yang berbeda dari acuan.
Lihat laporan integritas lengkap →Model dan tautan terkait
Model dan tautan terkait