Tüm modeller

Grok 4.5

xAI · 7 ölçülmüş yayın

Model kimliği
x-ai/grok-4.5
Geliştirici
xAI

Benchmark sonuçları

3 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#18
Matematik Puanı
213,25 / 217,00
Net
37,75
Maliyet
$0.52
Token
98.216
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
medium
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

3 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#33
TDE-SB1 Puanı
212,50 / 220,00
Net
37,50
Maliyet
$0.31
Token
64.526
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
high
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

3 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#23
Fen Puanı
212,50 / 220,00
Net
37,50
Maliyet
$0.18
Token
43.763
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
low
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

3 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#37
SB2 Puanı
216,25 / 220,00
Net
38,75
Maliyet
$0.16
Token
41.491
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
low
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a
Ulusal sınav

2026 TYT

Sıra
#2
TYT Puanı
491,75 / 500,00
Net
117,50
Maliyet
$1.74
Token
331.624
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
16384
Akıl yürütme düzeyi
high
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a
Mesleki sınav

TUS · TTBT

Sıra
#18
TTBT Neti
69,50 / 72,00
Maliyet
$0.27
Token
67.237
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
16384
Akıl yürütme düzeyi
medium
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

Uzun bağlam

16K–512K bağlam kalite eğrisi

PUAN
82,7
Gönderilen hücre
25/30
Format ihlali
0

Uzun bağlam PUAN'ı 0–100 aralığındadır ve sınav puanıyla toplanmaz.

ContextCurve sonuçlarını aç