2026 AYT · Türk Dili ve Edebiyatı - Sosyal Bilimler-1
Yöntem notlarınet = doğru − yanlış/4; geçersiz yanıtlar yanlış sayılır. · 100 + Türk Dili ve Edebiyatı - Sosyal Bilimler-1 neti × 3
- Lider model
- Thinky Inkling (high)220,00TDE-SB1 Puanı
- Model
- 74
- Soru
- 40
- Model–soru yanıtı
- 2.960
- Ölçülen toplam maliyet
- ≈$21.73
- Koşu tarihi
- 31 Temmuz 2026
İlk 5 model
Tüm sonuçları gör| Sıra | Model | TDE-SB1 Puanı | Net | Maliyet | Token |
|---|---|---|---|---|---|
| #1 | Thinky Inkling (high) | 220,00 | 40,00 | $0.19 | 54.882 |
| #2 | Claude Opus 5 (medium) | 220,00 | 40,00 | $0.23 | 25.139 |
| #3 | GPT-5.6 Sol (high) | 220,00 | 40,00 | $0.29 | 19.233 |
| #4 | Gemini 3.1 Pro (medium) | 220,00 | 40,00 | $0.37 | 40.073 |
| #5 | Claude Opus 5 (xhigh) | 220,00 | 40,00 | $0.58 | 39.188 |
Tüm benchmark analizi
Tüm sonuçlar
Liderlik tablosu
Başlıkları seçerek sıralamayı değiştirebilirsiniz; bilinmeyen değerler her zaman sona gider.
| Model | |||||||
|---|---|---|---|---|---|---|---|
| 1 | Thinky Inkling (high)Thinking Machines Lab | 220,00 | 40,00 | 40,00 | $0.19 | 54.882 | |
| 2 | Claude Opus 5 (medium)Anthropic | 220,00 | 40,00 | 40,00 | $0.23 | 25.139 | |
| 3 | GPT-5.6 Sol (high)OpenAI | 220,00 | 40,00 | 40,00 | $0.29 | 19.233 | |
| 4 | Gemini 3.1 Pro (medium)Google | 220,00 | 40,00 | 40,00 | $0.37 | 40.073 | |
| 5 | Claude Opus 5 (xhigh)Anthropic | 220,00 | 40,00 | 40,00 | $0.58 | 39.188 | |
| 6 | Claude Opus 5 (max)Anthropic | 220,00 | 40,00 | 40,00 | $0.90 | 51.735 | |
| 7 | OpenRouter FusionOpenRouter | 220,00 | 40,00 | 40,00 | n/a | 87.048 | |
| 8 | GPT-5.6 Terra (low)OpenAI | 216,25 | 38,75 | 38,75 | $0.03 | 15.500 | |
| 9 | DeepSeek V4 Pro (xhigh)DeepSeek | 216,25 | 38,75 | 38,75 | ≈$0.05 | 72.405 | |
| 10 | Gemini 3.6 Flash (low)Google | 216,25 | 38,75 | 38,75 | $0.13 | 26.109 | |
| 11 | GPT-5.6 Sol (none)OpenAI | 216,25 | 38,75 | 38,75 | $0.15 | 14.643 | |
| 12 | Claude Opus 5 (low)Anthropic | 216,25 | 38,75 | 38,75 | $0.15 | 21.890 | |
| 13 | GPT-5.6 Sol (low)OpenAI | 216,25 | 38,75 | 38,75 | $0.21 | 16.599 | |
| 14 | GPT-5.6 Sol (medium)OpenAI | 216,25 | 38,75 | 38,75 | $0.24 | 17.543 | |
| 15 | Gemini 3.6 Flash (medium)Google | 216,25 | 38,75 | 38,75 | $0.25 | 42.239 | |
| 16 | Claude Fable 5 (low)Anthropic | 216,25 | 38,75 | 38,75 | $0.25 | 20.971 | |
| 17 | Gemini 3.1 Pro (low)Google | 216,25 | 38,75 | 38,75 | $0.26 | 30.521 | |
| 18 | GPT-5.6 Sol (xhigh)OpenAI | 216,25 | 38,75 | 38,75 | $0.28 | 19.074 | |
| 19 | Thinky Inkling (max)Thinking Machines Lab | 216,25 | 38,75 | 38,75 | $0.28 | 78.646 | |
| 20 | Gemini 3.6 Flash (high)Google | 216,25 | 38,75 | 38,75 | $0.30 | 48.145 | |
| 21 | Claude Fable 5 (medium)Anthropic | 216,25 | 38,75 | 38,75 | $0.49 | 25.785 | |
| 22 | Claude Fable 5 (high)Anthropic | 216,25 | 38,75 | 38,75 | $0.91 | 34.207 | |
| 23 | Gemini 3.1 Pro (high)Google | 216,25 | 38,75 | 38,75 | $1.40 | 125.331 | |
| 24 | Claude Fable 5 (xhigh)Anthropic | 216,25 | 38,75 | 38,75 | $1.46 | 45.110 | |
| 25 | Claude Fable 5 (max)Anthropic | 216,25 | 38,75 | 38,75 | $2.69 | 69.640 | |
| 26 | GPT-5.6 Luna (medium)OpenAI | 212,50 | 37,50 | 37,50 | $0.01 | 20.290 | |
| 27 | DeepSeek V4 Pro (high)DeepSeek | 212,50 | 37,50 | 37,50 | ≈$0.04 | 52.598 | |
| 28 | GPT-5.6 Terra (high)OpenAI | 212,50 | 37,50 | 37,50 | $0.04 | 17.010 | |
| 29 | Tencent Hy3 (high)Tencent | 212,50 | 37,50 | 37,50 | ≈$0.06 | 132.488 | |
| 30 | Thinky Inkling (medium)Thinking Machines Lab | 212,50 | 37,50 | 37,50 | $0.07 | 25.333 | |
| 31 | Gemini 3.6 Flash (minimal)Google | 212,50 | 37,50 | 37,50 | $0.08 | 19.080 | |
| 32 | GPT-5.6 Terra (max)OpenAI | 212,50 | 37,50 | 37,50 | $0.13 | 31.887 | |
| 33 | Grok 4.5 (high)xAI | 212,50 | 37,50 | 37,50 | $0.31 | 64.526 | |
| 34 | Qwen3.7 MaxAlibaba Qwen | 212,50 | 37,50 | 37,50 | $0.34 | 84.433 | |
| 35 | GPT-5.6 Sol (max)OpenAI | 212,50 | 37,50 | 37,50 | $0.48 | 25.679 | |
| 36 | Claude Opus 5 (high)Anthropic | 212,50 | 37,50 | 37,50 | $0.54 | 37.535 | |
| 37 | GPT-5.6 Luna (low)OpenAI | 208,75 | 36,25 | 36,25 | $0.01 | 18.702 | |
| 38 | GPT-5.6 Luna (high)OpenAI | 208,75 | 36,25 | 36,25 | $0.01 | 24.027 | |
| 39 | GPT-5.6 Luna (max)OpenAI | 208,75 | 36,25 | 36,25 | $0.02 | 37.930 | |
| 40 | GPT-5.6 Luna (xhigh)OpenAI | 208,75 | 36,25 | 36,25 | $0.02 | 38.943 | |
| 41 | GPT-5.6 Terra (medium)OpenAI | 208,75 | 36,25 | 36,25 | $0.05 | 17.799 | |
| 42 | DeepSeek V4 Flash (high)DeepSeek | 208,75 | 36,25 | 36,25 | $0.05 | 184.542 | |
| 43 | Claude Sonnet 5 (high)Anthropic | 208,75 | 36,25 | 36,25 | $0.12 | 27.510 | |
| 44 | Grok 4.5 (medium)xAI | 208,75 | 36,25 | 36,25 | $0.30 | 63.441 | |
| 45 | Kimi K3 (low)Moonshot AI | 208,75 | 36,25 | 36,25 | $0.31 | 35.353 | |
| 46 | Kimi K3 (high)Moonshot AI | 208,75 | 36,25 | 36,25 | $0.65 | 58.749 | |
| 47 | Kimi K3 (max)Moonshot AI | 208,75 | 36,25 | 36,25 | $0.76 | 65.484 | |
| 48 | GPT-5.6 Luna (none)OpenAI | 205,00 | 35,00 | 35,00 | $0.00 | 15.111 | |
| 49 | GPT-5.6 Terra (none)OpenAI | 205,00 | 35,00 | 35,00 | $0.02 | 12.602 | |
| 50 | Tencent Hy3 (low)Tencent | 205,00 | 35,00 | 35,00 | ≈$0.03 | 58.234 | |
| 51 | Thinky Inkling (low)Thinking Machines Lab | 205,00 | 35,00 | 35,00 | $0.03 | 15.190 | |
| 52 | MiniMax M3MiniMax | 205,00 | 35,00 | 35,00 | $0.06 | 63.373 | |
| 53 | GPT-5.6 Terra (xhigh)OpenAI | 205,00 | 35,00 | 35,00 | $0.08 | 22.808 | |
| 54 | Qwen3.7 PlusAlibaba Qwen | 205,00 | 35,00 | 35,00 | $0.13 | 113.402 | |
| 55 | Grok 4.5 (low)xAI | 205,00 | 35,00 | 35,00 | $0.21 | 48.304 | |
| 56 | Claude Sonnet 5 (xhigh)Anthropic | 205,00 | 35,00 | 35,00 | $0.24 | 39.590 | |
| 57 | GLM 5.2 (xhigh)Z.ai | 205,00 | 35,00 | 35,00 | ≈$0.64 | 189.916 | |
| 58 | Claude Sonnet 5 (max)Anthropic | 205,00 | 35,00 | 35,00 | $0.67 | 82.824 | |
| 59 | GLM 5.2 (high)Z.ai | 205,00 | 35,00 | 35,00 | ≈$0.89 | 261.300 | |
| 60 | Gemma 4 31BGoogle | 201,25 | 33,75 | 33,75 | ≈$0.01 | 28.440 | |
| 61 | Thinky Inkling (minimal)Thinking Machines Lab | 201,25 | 33,75 | 33,75 | $0.02 | 15.097 | |
| 62 | Thinky Inkling (none)Thinking Machines Lab | 201,25 | 33,75 | 33,75 | $0.03 | 17.498 | |
| 63 | MiMo V2.5 ProXiaomi | 201,25 | 33,75 | 33,75 | $0.17 | 203.953 | |
| 64 | Nemotron 3 Ultra (high)NVIDIA | 201,25 | 33,75 | 33,75 | $0.36 | 111.882 | |
| 65 | Nemotron 3 Ultra (medium)NVIDIA | 201,25 | 33,75 | 33,75 | $0.39 | 119.825 | |
| 66 | Tencent Hy3 (none)Tencent | 197,50 | 32,50 | 32,50 | ≈$0.01 | 24.127 | |
| 67 | DeepSeek V4 Flash (xhigh)DeepSeek | 197,50 | 32,50 | 32,50 | $0.20 | 723.130 | |
| 68 | Muse Glimmer 30B (high)Meta | 193,75 | 31,25 | 31,25 | $0.07 | 58.523 | |
| 69 | Claude Sonnet 5 (low)Anthropic | 190,00 | 30,00 | 30,00 | $0.05 | 20.492 | |
| 70 | Claude Sonnet 5 (medium)Anthropic | 190,00 | 30,00 | 30,00 | $0.06 | 22.047 | |
| 71 | Qwen3.6 27BAlibaba Qwen | 190,00 | 30,00 | 30,00 | ≈$0.20 | 108.630 | |
| 72 | LongCat 2.0Meituan | 186,25 | 28,75 | 28,75 | $0.51 | 440.056 | |
| 73 | Ring-2.6-1T (xhigh)Inclusion AI | 182,50 | 27,50 | 27,50 | $0.11 | 185.984 | |
| 74 | Ring-2.6-1T (high)Inclusion AI | 178,75 | 26,25 | 26,25 | $0.08 | 136.358 |
Tabloyu yana kaydırarak tüm sütunları görüntüleyin.
Cevap kâğıdı
dolgu = soruyu doğru çözen model oranı- 1TDE-SB1-1: 74 modelin 74 tanesi doğru çözdü
- 2TDE-SB1-2: 74 modelin 73 tanesi doğru çözdü
- 3TDE-SB1-3: 74 modelin 73 tanesi doğru çözdü
- 4TDE-SB1-4: 74 modelin 73 tanesi doğru çözdü
- 5TDE-SB1-5: 74 modelin 74 tanesi doğru çözdü
- 6TDE-SB1-6: 74 modelin 25 tanesi doğru çözdü
- 7TDE-SB1-7: 74 modelin 71 tanesi doğru çözdü
- 8TDE-SB1-8: 74 modelin 65 tanesi doğru çözdü
- 9TDE-SB1-9: 74 modelin 72 tanesi doğru çözdü
- 10TDE-SB1-10: 74 modelin 73 tanesi doğru çözdü
- 11TDE-SB1-11: 74 modelin 71 tanesi doğru çözdü
- 12TDE-SB1-12: 74 modelin 74 tanesi doğru çözdü
- 13TDE-SB1-13: 74 modelin 59 tanesi doğru çözdü
- 14TDE-SB1-14: 74 modelin 72 tanesi doğru çözdü
- 15TDE-SB1-15: 74 modelin 61 tanesi doğru çözdü
- 16TDE-SB1-16: 74 modelin 73 tanesi doğru çözdü
- 17TDE-SB1-17: 74 modelin 74 tanesi doğru çözdü
- 18TDE-SB1-18: 74 modelin 67 tanesi doğru çözdü
- 19TDE-SB1-19: 74 modelin 52 tanesi doğru çözdü
- 20TDE-SB1-20: 74 modelin 49 tanesi doğru çözdü
- 21TDE-SB1-21: 74 modelin 71 tanesi doğru çözdü
- 22TDE-SB1-22: 74 modelin 70 tanesi doğru çözdü
- 23TDE-SB1-23: 74 modelin 42 tanesi doğru çözdü
- 24TDE-SB1-24: 74 modelin 74 tanesi doğru çözdü
- 25TDE-SB1-25: 74 modelin 74 tanesi doğru çözdü
- 26TDE-SB1-26: 74 modelin 74 tanesi doğru çözdü
- 27TDE-SB1-27: 74 modelin 74 tanesi doğru çözdü
- 28TDE-SB1-28: 74 modelin 74 tanesi doğru çözdü
- 29TDE-SB1-29: 74 modelin 70 tanesi doğru çözdü
- 30TDE-SB1-30: 74 modelin 74 tanesi doğru çözdü
- 31TDE-SB1-31: 74 modelin 68 tanesi doğru çözdü
- 32TDE-SB1-32: 74 modelin 69 tanesi doğru çözdü
- 33TDE-SB1-33: 74 modelin 71 tanesi doğru çözdü
- 34TDE-SB1-34: 74 modelin 72 tanesi doğru çözdü
- 35TDE-SB1-35: 74 modelin 69 tanesi doğru çözdü
- 36TDE-SB1-36: 74 modelin 73 tanesi doğru çözdü
- 37TDE-SB1-37: 74 modelin 72 tanesi doğru çözdü
- 38TDE-SB1-38: 74 modelin 72 tanesi doğru çözdü
- 39TDE-SB1-39: 74 modelin 74 tanesi doğru çözdü
- 40TDE-SB1-40: 74 modelin 74 tanesi doğru çözdü
Koşudan çıkanlar
Üç bulgu
- Bulgu · Zirve
Aynı zirve, farklı maliyet
Thinky Inkling (high), Claude Opus 5 (medium), GPT-5.6 Sol (high) ve 4 yapılandırma daha, 220,00 puanla zirveyi paylaşıyor. Zirve grubundaki ölçülen maliyet $0.19 (Thinky Inkling (high)) ile $0.90 (Claude Opus 5 (max)) arasında. Ayrıca zirvedeki 1 modelin maliyeti bilinmiyor.
- Bulgu · Bölümler
Tam net tablosu
Türk Dili ve Edebiyatı - Sosyal Bilimler-1 bölümünde tam nete ulaşan model: 7/74.
- Bulgu · Ölçüm sınırı
Bilinmeyen değer, sıfır değildir
Toplam 10 modelde en az bir ölçüm açıklaması var. Maliyet: 1 bilinmiyor, 9 yaklaşık.
Okuma notları
Kapsam ve ölçüm sınırları
- Puanlama: net = doğru − yanlış/4; geçersiz yanıtlar yanlış sayılır. · 100 + Türk Dili ve Edebiyatı - Sosyal Bilimler-1 neti × 3
- Sıralama: Yuvarlanmamış puan yüksekten düşüğe sıralanır. Eşit puanda bilinen daha düşük maliyet önce gelir; maliyeti bilinmeyenler aynı puan grubunun sonuna gider. Tam eşitlikte kaynak sırası korunur.
- 1 modelin maliyeti bilinmediği için maliyet analizlerinden çıkarılır; 9 modelin maliyeti yaklaşık değer taşır.
- Model notları:
- DeepSeek V4 Pro (xhigh): Maliyet liste fiyatından hesaplandı; model allow_fallbacks ile koşuldu ve 2026-07-31 usage.cost ölçümünde gerçek fatura hesaplananın ≈3,9 katına ulaştı.
- DeepSeek V4 Pro (high): Maliyet liste fiyatından hesaplandı; model allow_fallbacks ile koşuldu ve 2026-07-31 usage.cost ölçümünde gerçek fatura hesaplananın ≈3,9 katına ulaştı.
- Tencent Hy3 (high): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,5 katıydı.
- Tencent Hy3 (low): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,5 katıydı.
- GLM 5.2 (xhigh): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,3 katıydı.
- GLM 5.2 (high): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,3 katıydı.
- Gemma 4 31B: Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,2 katıydı.
- Tencent Hy3 (none): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,5 katıydı.
- Muse Glimmer 30B (high): Koşu ayarlarındaki 65.536 istenen tavandır; efektif tavan 32.768'dir. Diğer varyantlar 131.072 ile koştu, ancak modelin bağlamı 131.072 olduğundan genel tavan gönderilemezdi. Pinlenen Together endpoint'i ilan etmediği bir sınırla talebi 32.768'de kesiyor. 2026-08-12 ölçümünde bu tavanda hiçbir yanıt kesilmedi.
- Qwen3.6 27B: Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,8 katıydı.