Tüm modeller

Claude Opus 5

Anthropic · 7 ölçülmüş yayın

Model kimliği
anthropic/claude-opus-5
Geliştirici
Anthropic

Benchmark sonuçları

5 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#12
Matematik Puanı
213,25 / 217,00
Net
37,75
Maliyet
$0.31
Token
23.735
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
low
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

5 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#2
TDE-SB1 Puanı
220,00 / 220,00
Net
40,00
Maliyet
$0.23
Token
25.139
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
medium
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

5 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#21
Fen Puanı
212,50 / 220,00
Net
37,50
Maliyet
$0.17
Token
21.427
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
low
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

5 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#26
SB2 Puanı
220,00 / 220,00
Net
40,00
Maliyet
$0.51
Token
36.382
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
xhigh
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a
Ulusal sınav

2026 TYT

Sıra
#7
TYT Puanı
487,62 / 500,00
Net
116,25
Maliyet
$1.82
Token
125.442
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
16384
Akıl yürütme düzeyi
high
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a
Mesleki sınav

TUS · TTBT

Sıra
#5
TTBT Neti
70,75 / 72,00
Maliyet
$0.26
Token
28.167
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
16384
Akıl yürütme düzeyi
medium
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

Uzun bağlam

16K–512K bağlam kalite eğrisi

PUAN
50,7
Gönderilen hücre
30/30
Format ihlali
2

Uzun bağlam PUAN'ı 0–100 aralığındadır ve sınav puanıyla toplanmaz.

ContextCurve sonuçlarını aç