Tüm modeller

Gemini 3.1 Pro

Google · 7 ölçülmüş yayın

Model kimliği
google/gemini-3.1-pro-preview
Geliştirici
Google

Benchmark sonuçları

3 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#24
Matematik Puanı
213,25 / 217,00
Net
37,75
Maliyet
$0.61
Token
58.350
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
low
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

3 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#4
TDE-SB1 Puanı
220,00 / 220,00
Net
40,00
Maliyet
$0.37
Token
40.073
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
medium
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

3 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#3
Fen Puanı
216,25 / 220,00
Net
38,75
Maliyet
$0.34
Token
37.465
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
low
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

3 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#21
SB2 Puanı
220,00 / 220,00
Net
40,00
Maliyet
$0.24
Token
29.282
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
low
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a
Ulusal sınav

2026 TYT

Sıra
#9
TYT Puanı
487,62 / 500,00
Net
116,25
Maliyet
$3.36
Token
309.872
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
16384
Akıl yürütme düzeyi
high
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a
Mesleki sınav

TUS · TTBT

Sıra
#9
TTBT Neti
70,75 / 72,00
Maliyet
$0.47
Token
49.474
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
16384
Akıl yürütme düzeyi
medium
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

Uzun bağlam

16K–512K bağlam kalite eğrisi

PUAN
83,0
Gönderilen hücre
30/30
Format ihlali
1

Uzun bağlam PUAN'ı 0–100 aralığındadır ve sınav puanıyla toplanmaz.

ContextCurve sonuçlarını aç