2026 AYT · Sosyal Bilimler-2
Yöntem notlarınet = doğru − yanlış/4; geçersiz yanıtlar yanlış sayılır. · 100 + Sosyal Bilimler-2 neti × 3
- Lider model
- GPT-5.6 Luna (low)220,00SB2 Puanı
- Model
- 74
- Soru
- 40
- Model–soru yanıtı
- 2.960
- Ölçülen toplam maliyet
- ≈$19.16
- Koşu tarihi
- 31 Temmuz 2026
İlk 5 model
Tüm sonuçları gör| Sıra | Model | SB2 Puanı | Net | Maliyet | Token |
|---|---|---|---|---|---|
| #1 | GPT-5.6 Luna (low) | 220,00 | 40,00 | $0.00 | 17.564 |
| #2 | GPT-5.6 Luna (medium) | 220,00 | 40,00 | $0.01 | 18.754 |
| #3 | GPT-5.6 Luna (high) | 220,00 | 40,00 | $0.01 | 22.353 |
| #4 | GPT-5.6 Luna (xhigh) | 220,00 | 40,00 | $0.01 | 25.774 |
| #5 | GPT-5.6 Luna (max) | 220,00 | 40,00 | $0.01 | 34.500 |
Tüm benchmark analizi
Tüm sonuçlar
Liderlik tablosu
Başlıkları seçerek sıralamayı değiştirebilirsiniz; bilinmeyen değerler her zaman sona gider.
| Model | |||||||
|---|---|---|---|---|---|---|---|
| 1 | GPT-5.6 Luna (low)OpenAI | 220,00 | 40,00 | 40,00 | $0.00 | 17.564 | |
| 2 | GPT-5.6 Luna (medium)OpenAI | 220,00 | 40,00 | 40,00 | $0.01 | 18.754 | |
| 3 | GPT-5.6 Luna (high)OpenAI | 220,00 | 40,00 | 40,00 | $0.01 | 22.353 | |
| 4 | GPT-5.6 Luna (xhigh)OpenAI | 220,00 | 40,00 | 40,00 | $0.01 | 25.774 | |
| 5 | GPT-5.6 Luna (max)OpenAI | 220,00 | 40,00 | 40,00 | $0.01 | 34.500 | |
| 6 | Thinky Inkling (low)Thinking Machines Lab | 220,00 | 40,00 | 40,00 | $0.02 | 15.183 | |
| 7 | GPT-5.6 Terra (low)OpenAI | 220,00 | 40,00 | 40,00 | $0.04 | 16.491 | |
| 8 | GPT-5.6 Terra (high)OpenAI | 220,00 | 40,00 | 40,00 | $0.05 | 17.770 | |
| 9 | GPT-5.6 Terra (xhigh)OpenAI | 220,00 | 40,00 | 40,00 | $0.05 | 18.491 | |
| 10 | Thinky Inkling (medium)Thinking Machines Lab | 220,00 | 40,00 | 40,00 | $0.06 | 22.822 | |
| 11 | Gemini 3.6 Flash (minimal)Google | 220,00 | 40,00 | 40,00 | $0.08 | 19.213 | |
| 12 | Gemini 3.6 Flash (low)Google | 220,00 | 40,00 | 40,00 | $0.13 | 25.759 | |
| 13 | Claude Sonnet 5 (high)Anthropic | 220,00 | 40,00 | 40,00 | $0.13 | 29.086 | |
| 14 | GPT-5.6 Sol (none)OpenAI | 220,00 | 40,00 | 40,00 | $0.14 | 14.507 | |
| 15 | GPT-5.6 Terra (max)OpenAI | 220,00 | 40,00 | 40,00 | $0.18 | 40.463 | |
| 16 | GPT-5.6 Sol (low)OpenAI | 220,00 | 40,00 | 40,00 | $0.19 | 15.950 | |
| 17 | GPT-5.6 Sol (medium)OpenAI | 220,00 | 40,00 | 40,00 | $0.20 | 16.311 | |
| 18 | Gemini 3.6 Flash (medium)Google | 220,00 | 40,00 | 40,00 | $0.22 | 38.177 | |
| 19 | GPT-5.6 Sol (xhigh)OpenAI | 220,00 | 40,00 | 40,00 | $0.22 | 17.227 | |
| 20 | GPT-5.6 Sol (high)OpenAI | 220,00 | 40,00 | 40,00 | $0.23 | 17.358 | |
| 21 | Gemini 3.1 Pro (low)Google | 220,00 | 40,00 | 40,00 | $0.24 | 29.282 | |
| 22 | Gemini 3.6 Flash (high)Google | 220,00 | 40,00 | 40,00 | $0.26 | 43.512 | |
| 23 | Gemini 3.1 Pro (medium)Google | 220,00 | 40,00 | 40,00 | $0.32 | 35.421 | |
| 24 | Thinky Inkling (max)Thinking Machines Lab | 220,00 | 40,00 | 40,00 | $0.35 | 94.874 | |
| 25 | Gemini 3.1 Pro (high)Google | 220,00 | 40,00 | 40,00 | $0.44 | 45.995 | |
| 26 | Claude Opus 5 (xhigh)Anthropic | 220,00 | 40,00 | 40,00 | $0.51 | 36.382 | |
| 27 | GPT-5.6 Sol (max)OpenAI | 220,00 | 40,00 | 40,00 | $0.59 | 29.418 | |
| 28 | OpenRouter FusionOpenRouter | 220,00 | 40,00 | 40,00 | $1.08 | 82.188 | |
| 29 | Thinky Inkling (minimal)Thinking Machines Lab | 216,25 | 38,75 | 38,75 | $0.03 | 15.541 | |
| 30 | Tencent Hy3 (low)Tencent | 216,25 | 38,75 | 38,75 | ≈$0.03 | 51.014 | |
| 31 | MiMo V2.5 ProXiaomi | 216,25 | 38,75 | 38,75 | $0.03 | 44.821 | |
| 32 | GPT-5.6 Terra (medium)OpenAI | 216,25 | 38,75 | 38,75 | $0.04 | 17.072 | |
| 33 | MiniMax M3MiniMax | 216,25 | 38,75 | 38,75 | $0.05 | 58.573 | |
| 34 | Claude Sonnet 5 (medium)Anthropic | 216,25 | 38,75 | 38,75 | $0.05 | 20.809 | |
| 35 | Claude Opus 5 (low)Anthropic | 216,25 | 38,75 | 38,75 | $0.13 | 21.079 | |
| 36 | Thinky Inkling (high)Thinking Machines Lab | 216,25 | 38,75 | 38,75 | $0.15 | 45.984 | |
| 37 | Grok 4.5 (low)xAI | 216,25 | 38,75 | 38,75 | $0.16 | 41.491 | |
| 38 | Claude Opus 5 (medium)Anthropic | 216,25 | 38,75 | 38,75 | $0.18 | 23.263 | |
| 39 | Claude Sonnet 5 (xhigh)Anthropic | 216,25 | 38,75 | 38,75 | $0.18 | 34.416 | |
| 40 | Grok 4.5 (medium)xAI | 216,25 | 38,75 | 38,75 | $0.22 | 51.145 | |
| 41 | Claude Fable 5 (low)Anthropic | 216,25 | 38,75 | 38,75 | $0.24 | 20.751 | |
| 42 | Grok 4.5 (high)xAI | 216,25 | 38,75 | 38,75 | $0.25 | 56.110 | |
| 43 | Kimi K3 (low)Moonshot AI | 216,25 | 38,75 | 38,75 | $0.29 | 30.082 | |
| 44 | Qwen3.7 MaxAlibaba Qwen | 216,25 | 38,75 | 38,75 | $0.33 | 81.986 | |
| 45 | Claude Opus 5 (high)Anthropic | 216,25 | 38,75 | 38,75 | $0.37 | 30.701 | |
| 46 | Claude Opus 5 (max)Anthropic | 216,25 | 38,75 | 38,75 | $0.66 | 42.252 | |
| 47 | Claude Sonnet 5 (max)Anthropic | 216,25 | 38,75 | 38,75 | $0.67 | 83.400 | |
| 48 | Kimi K3 (max)Moonshot AI | 216,25 | 38,75 | 38,75 | $0.92 | 59.915 | |
| 49 | Claude Fable 5 (xhigh)Anthropic | 216,25 | 38,75 | 38,75 | $1.33 | 42.643 | |
| 50 | Claude Fable 5 (max)Anthropic | 216,25 | 38,75 | 38,75 | $2.20 | 59.971 | |
| 51 | Tencent Hy3 (none)Tencent | 212,50 | 37,50 | 37,50 | ≈$0.01 | 23.586 | |
| 52 | Claude Sonnet 5 (low)Anthropic | 212,50 | 37,50 | 37,50 | $0.04 | 20.426 | |
| 53 | Muse Glimmer 30B (high)Meta | 212,50 | 37,50 | 37,50 | $0.05 | 44.781 | |
| 54 | Qwen3.7 PlusAlibaba Qwen | 212,50 | 37,50 | 37,50 | $0.08 | 71.574 | |
| 55 | Tencent Hy3 (high)Tencent | 212,50 | 37,50 | 37,50 | ≈$0.10 | 135.411 | |
| 56 | Qwen3.6 27BAlibaba Qwen | 212,50 | 37,50 | 37,50 | ≈$0.26 | 83.525 | |
| 57 | Claude Fable 5 (medium)Anthropic | 212,50 | 37,50 | 37,50 | $0.38 | 23.703 | |
| 58 | Kimi K3 (high)Moonshot AI | 212,50 | 37,50 | 37,50 | $0.70 | 48.047 | |
| 59 | Claude Fable 5 (high)Anthropic | 212,50 | 37,50 | 37,50 | $0.83 | 32.574 | |
| 60 | GPT-5.6 Luna (none)OpenAI | 208,75 | 36,25 | 36,25 | $0.00 | 15.126 | |
| 61 | Gemma 4 31BGoogle | 208,75 | 36,25 | 36,25 | ≈$0.01 | 28.607 | |
| 62 | GPT-5.6 Terra (none)OpenAI | 208,75 | 36,25 | 36,25 | $0.02 | 13.027 | |
| 63 | Thinky Inkling (none)Thinking Machines Lab | 208,75 | 36,25 | 36,25 | $0.03 | 17.113 | |
| 64 | GLM 5.2 (high)Z.ai | 208,75 | 36,25 | 36,25 | ≈$0.11 | 39.976 | |
| 65 | Nemotron 3 Ultra (high)NVIDIA | 208,75 | 36,25 | 36,25 | $0.71 | 208.050 | |
| 66 | DeepSeek V4 Pro (high)DeepSeek | 205,00 | 35,00 | 35,00 | ≈$0.14 | 49.318 | |
| 67 | GLM 5.2 (xhigh)Z.ai | 205,00 | 35,00 | 35,00 | ≈$0.20 | 64.084 | |
| 68 | DeepSeek V4 Pro (xhigh)DeepSeek | 205,00 | 35,00 | 35,00 | ≈$0.37 | 118.955 | |
| 69 | Nemotron 3 Ultra (medium)NVIDIA | 205,00 | 35,00 | 35,00 | $0.68 | 198.983 | |
| 70 | DeepSeek V4 Flash (high)DeepSeek | 201,25 | 33,75 | 33,75 | $0.01 | 41.849 | |
| 71 | DeepSeek V4 Flash (xhigh)DeepSeek | 201,25 | 33,75 | 33,75 | $0.01 | 59.764 | |
| 72 | LongCat 2.0Meituan | 201,25 | 33,75 | 33,75 | $0.07 | 209.287 | |
| 73 | Ring-2.6-1T (high)Inclusion AI | 197,50 | 32,50 | 32,50 | $0.02 | 52.492 | |
| 74 | Ring-2.6-1T (xhigh)Inclusion AI | 186,25 | 28,75 | 28,75 | $0.02 | 64.065 |
Tabloyu yana kaydırarak tüm sütunları görüntüleyin.
Cevap kâğıdı
dolgu = soruyu doğru çözen model oranı- 1SB2-1: 74 modelin 74 tanesi doğru çözdü
- 2SB2-2: 74 modelin 73 tanesi doğru çözdü
- 3SB2-3: 74 modelin 74 tanesi doğru çözdü
- 4SB2-4: 74 modelin 72 tanesi doğru çözdü
- 5SB2-5: 74 modelin 73 tanesi doğru çözdü
- 6SB2-6: 74 modelin 72 tanesi doğru çözdü
- 7SB2-7: 74 modelin 74 tanesi doğru çözdü
- 8SB2-8: 74 modelin 74 tanesi doğru çözdü
- 9SB2-9: 74 modelin 74 tanesi doğru çözdü
- 10SB2-10: 74 modelin 73 tanesi doğru çözdü
- 11SB2-11: 74 modelin 73 tanesi doğru çözdü
- 12SB2-12: 74 modelin 68 tanesi doğru çözdü
- 13SB2-13: 74 modelin 74 tanesi doğru çözdü
- 14SB2-14: 74 modelin 72 tanesi doğru çözdü
- 15SB2-15: 74 modelin 62 tanesi doğru çözdü
- 16SB2-16: 74 modelin 74 tanesi doğru çözdü
- 17SB2-17: 74 modelin 74 tanesi doğru çözdü
- 18SB2-18: 74 modelin 70 tanesi doğru çözdü
- 19SB2-19: 74 modelin 73 tanesi doğru çözdü
- 20SB2-20: 74 modelin 71 tanesi doğru çözdü
- 21SB2-21: 74 modelin 74 tanesi doğru çözdü
- 22SB2-22: 74 modelin 73 tanesi doğru çözdü
- 23SB2-23: 74 modelin 74 tanesi doğru çözdü
- 24SB2-24: 74 modelin 74 tanesi doğru çözdü
- 25SB2-25: 74 modelin 74 tanesi doğru çözdü
- 26SB2-26: 74 modelin 73 tanesi doğru çözdü
- 27SB2-27: 74 modelin 74 tanesi doğru çözdü
- 28SB2-28: 74 modelin 73 tanesi doğru çözdü
- 29SB2-29: 74 modelin 72 tanesi doğru çözdü
- 30SB2-30: 74 modelin 61 tanesi doğru çözdü
- 31SB2-31: 74 modelin 56 tanesi doğru çözdü
- 32SB2-32: 74 modelin 73 tanesi doğru çözdü
- 33SB2-33: 74 modelin 45 tanesi doğru çözdü
- 34SB2-34: 74 modelin 74 tanesi doğru çözdü
- 35SB2-35: 74 modelin 73 tanesi doğru çözdü
- 36SB2-36: 74 modelin 73 tanesi doğru çözdü
- 37SB2-37: 74 modelin 74 tanesi doğru çözdü
- 38SB2-38: 74 modelin 74 tanesi doğru çözdü
- 39SB2-39: 74 modelin 74 tanesi doğru çözdü
- 40SB2-40: 74 modelin 74 tanesi doğru çözdü
Koşudan çıkanlar
Üç bulgu
- Bulgu · Zirve
Aynı zirve, farklı maliyet
GPT-5.6 Luna (low), GPT-5.6 Luna (medium), GPT-5.6 Luna (high) ve 25 yapılandırma daha, 220,00 puanla zirveyi paylaşıyor. Zirve grubundaki ölçülen maliyet $0.00 (GPT-5.6 Luna (low)) ile $1.08 (OpenRouter Fusion) arasında.
- Bulgu · Bölümler
Tam net tablosu
Sosyal Bilimler-2 bölümünde tam nete ulaşan model: 28/74.
- Bulgu · Ölçüm sınırı
Bilinmeyen değer, sıfır değildir
Toplam 9 modelde en az bir ölçüm açıklaması var. Maliyet: 9 yaklaşık.
Okuma notları
Kapsam ve ölçüm sınırları
- Puanlama: net = doğru − yanlış/4; geçersiz yanıtlar yanlış sayılır. · 100 + Sosyal Bilimler-2 neti × 3
- Sıralama: Yuvarlanmamış puan yüksekten düşüğe sıralanır. Eşit puanda bilinen daha düşük maliyet önce gelir; maliyeti bilinmeyenler aynı puan grubunun sonuna gider. Tam eşitlikte kaynak sırası korunur.
- 0 modelin maliyeti bilinmediği için maliyet analizlerinden çıkarılır; 9 modelin maliyeti yaklaşık değer taşır.
- Model notları:
- Tencent Hy3 (low): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,5 katıydı.
- Tencent Hy3 (none): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,5 katıydı.
- Muse Glimmer 30B (high): Koşu ayarlarındaki 65.536 istenen tavandır; efektif tavan 32.768'dir. Diğer varyantlar 131.072 ile koştu, ancak modelin bağlamı 131.072 olduğundan genel tavan gönderilemezdi. Pinlenen Together endpoint'i ilan etmediği bir sınırla talebi 32.768'de kesiyor. 2026-08-12 ölçümünde bu tavanda hiçbir yanıt kesilmedi.
- Tencent Hy3 (high): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,5 katıydı.
- Qwen3.6 27B: Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,8 katıydı.
- Gemma 4 31B: Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,2 katıydı.
- GLM 5.2 (high): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,3 katıydı.
- DeepSeek V4 Pro (high): Maliyet liste fiyatından hesaplandı; model allow_fallbacks ile koşuldu ve 2026-07-31 usage.cost ölçümünde gerçek fatura hesaplananın ≈3,9 katına ulaştı.
- GLM 5.2 (xhigh): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,3 katıydı.
- DeepSeek V4 Pro (xhigh): Maliyet liste fiyatından hesaplandı; model allow_fallbacks ile koşuldu ve 2026-07-31 usage.cost ölçümünde gerçek fatura hesaplananın ≈3,9 katına ulaştı.