2026 AYT · Fen Bilimleri
Yöntem notlarınet = doğru − yanlış/4; geçersiz yanıtlar yanlış sayılır. · 100 + Fen Bilimleri neti × 3
- Lider model
- Gemini 3.6 Flash (minimal)216,25Fen Puanı
- Model
- 74
- Soru
- 40
- Model–soru yanıtı
- 2.960
- Ölçülen toplam maliyet
- ≈$23.57
- Koşu tarihi
- 31 Temmuz 2026
İlk 5 model
Tüm sonuçları gör| Sıra | Model | Fen Puanı | Net | Maliyet | Token |
|---|---|---|---|---|---|
| #1 | Gemini 3.6 Flash (minimal) | 216,25 | 38,75 | $0.13 | 26.469 |
| #2 | Claude Sonnet 5 (medium) | 216,25 | 38,75 | $0.19 | 33.370 |
| #3 | Gemini 3.1 Pro (low) | 216,25 | 38,75 | $0.34 | 37.465 |
| #4 | Qwen3.7 Max | 216,25 | 38,75 | $0.35 | 86.803 |
| #5 | Qwen3.6 27B | 216,25 | 38,75 | ≈$0.46 | 136.760 |
Tüm benchmark analizi
Tüm sonuçlar
Liderlik tablosu
Başlıkları seçerek sıralamayı değiştirebilirsiniz; bilinmeyen değerler her zaman sona gider.
| Model | |||||||
|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.6 Flash (minimal)Google | 216,25 | 38,75 | 38,75 | $0.13 | 26.469 | |
| 2 | Claude Sonnet 5 (medium)Anthropic | 216,25 | 38,75 | 38,75 | $0.19 | 33.370 | |
| 3 | Gemini 3.1 Pro (low)Google | 216,25 | 38,75 | 38,75 | $0.34 | 37.465 | |
| 4 | Qwen3.7 MaxAlibaba Qwen | 216,25 | 38,75 | 38,75 | $0.35 | 86.803 | |
| 5 | Qwen3.6 27BAlibaba Qwen | 216,25 | 38,75 | 38,75 | ≈$0.46 | 136.760 | |
| 6 | Gemini 3.1 Pro (medium)Google | 216,25 | 38,75 | 38,75 | $0.49 | 49.276 | |
| 7 | Thinky Inkling (max)Thinking Machines Lab | 216,25 | 38,75 | 38,75 | $0.52 | 137.597 | |
| 8 | GPT-5.6 Luna (none)OpenAI | 212,50 | 37,50 | 37,50 | $0.00 | 17.269 | |
| 9 | GPT-5.6 Luna (low)OpenAI | 212,50 | 37,50 | 37,50 | $0.01 | 20.659 | |
| 10 | GPT-5.6 Luna (high)OpenAI | 212,50 | 37,50 | 37,50 | $0.01 | 23.643 | |
| 11 | GPT-5.6 Luna (xhigh)OpenAI | 212,50 | 37,50 | 37,50 | $0.01 | 27.879 | |
| 12 | GPT-5.6 Luna (max)OpenAI | 212,50 | 37,50 | 37,50 | $0.03 | 55.035 | |
| 13 | Tencent Hy3 (low)Tencent | 212,50 | 37,50 | 37,50 | ≈$0.04 | 61.855 | |
| 14 | GPT-5.6 Terra (low)OpenAI | 212,50 | 37,50 | 37,50 | $0.05 | 18.318 | |
| 15 | GPT-5.6 Terra (medium)OpenAI | 212,50 | 37,50 | 37,50 | $0.06 | 18.870 | |
| 16 | GPT-5.6 Terra (high)OpenAI | 212,50 | 37,50 | 37,50 | $0.07 | 20.270 | |
| 17 | Claude Sonnet 5 (low)Anthropic | 212,50 | 37,50 | 37,50 | $0.07 | 21.680 | |
| 18 | GPT-5.6 Terra (xhigh)OpenAI | 212,50 | 37,50 | 37,50 | $0.08 | 21.904 | |
| 19 | Qwen3.7 PlusAlibaba Qwen | 212,50 | 37,50 | 37,50 | $0.09 | 80.273 | |
| 20 | Tencent Hy3 (high)Tencent | 212,50 | 37,50 | 37,50 | ≈$0.12 | 162.505 | |
| 21 | Claude Opus 5 (low)Anthropic | 212,50 | 37,50 | 37,50 | $0.17 | 21.427 | |
| 22 | GPT-5.6 Terra (max)OpenAI | 212,50 | 37,50 | 37,50 | $0.17 | 38.309 | |
| 23 | Grok 4.5 (low)xAI | 212,50 | 37,50 | 37,50 | $0.18 | 43.763 | |
| 24 | GPT-5.6 Sol (none)OpenAI | 212,50 | 37,50 | 37,50 | $0.20 | 16.076 | |
| 25 | Gemini 3.6 Flash (low)Google | 212,50 | 37,50 | 37,50 | $0.20 | 35.638 | |
| 26 | GPT-5.6 Sol (low)OpenAI | 212,50 | 37,50 | 37,50 | $0.28 | 18.765 | |
| 27 | GLM 5.2 (high)Z.ai | 212,50 | 37,50 | 37,50 | ≈$0.30 | 53.096 | |
| 28 | Claude Opus 5 (medium)Anthropic | 212,50 | 37,50 | 37,50 | $0.30 | 26.689 | |
| 29 | GPT-5.6 Sol (medium)OpenAI | 212,50 | 37,50 | 37,50 | $0.31 | 19.540 | |
| 30 | Gemini 3.6 Flash (medium)Google | 212,50 | 37,50 | 37,50 | $0.34 | 54.483 | |
| 31 | Grok 4.5 (medium)xAI | 212,50 | 37,50 | 37,50 | $0.35 | 72.339 | |
| 32 | Grok 4.5 (high)xAI | 212,50 | 37,50 | 37,50 | $0.35 | 72.507 | |
| 33 | GPT-5.6 Sol (high)OpenAI | 212,50 | 37,50 | 37,50 | $0.36 | 21.464 | |
| 34 | GPT-5.6 Sol (xhigh)OpenAI | 212,50 | 37,50 | 37,50 | $0.37 | 21.611 | |
| 35 | Gemini 3.6 Flash (high)Google | 212,50 | 37,50 | 37,50 | $0.42 | 64.122 | |
| 36 | Claude Opus 5 (high)Anthropic | 212,50 | 37,50 | 37,50 | $0.48 | 33.866 | |
| 37 | GPT-5.6 Sol (max)OpenAI | 212,50 | 37,50 | 37,50 | $0.49 | 25.629 | |
| 38 | Claude Opus 5 (xhigh)Anthropic | 212,50 | 37,50 | 37,50 | $0.54 | 36.168 | |
| 39 | OpenRouter FusionOpenRouter | 212,50 | 37,50 | 37,50 | $0.66 | 68.322 | |
| 40 | Claude Opus 5 (max)Anthropic | 212,50 | 37,50 | 37,50 | $0.68 | 41.704 | |
| 41 | Gemini 3.1 Pro (high)Google | 212,50 | 37,50 | 37,50 | $0.74 | 70.816 | |
| 42 | GPT-5.6 Luna (medium)OpenAI | 208,75 | 36,25 | 36,25 | $0.01 | 21.692 | |
| 43 | Gemma 4 31BGoogle | 208,75 | 36,25 | 36,25 | ≈$0.01 | 31.213 | |
| 44 | Tencent Hy3 (none)Tencent | 208,75 | 36,25 | 36,25 | ≈$0.01 | 23.803 | |
| 45 | DeepSeek V4 Flash (high)DeepSeek | 208,75 | 36,25 | 36,25 | $0.02 | 64.104 | |
| 46 | Ring-2.6-1T (high)Inclusion AI | 208,75 | 36,25 | 36,25 | $0.02 | 47.308 | |
| 47 | Thinky Inkling (minimal)Thinking Machines Lab | 208,75 | 36,25 | 36,25 | $0.04 | 17.848 | |
| 48 | Thinky Inkling (medium)Thinking Machines Lab | 208,75 | 36,25 | 36,25 | $0.09 | 30.362 | |
| 49 | LongCat 2.0Meituan | 208,75 | 36,25 | 36,25 | $0.17 | 148.737 | |
| 50 | Nemotron 3 Ultra (medium)NVIDIA | 208,75 | 36,25 | 36,25 | $0.26 | 83.072 | |
| 51 | DeepSeek V4 Pro (high)DeepSeek | 208,75 | 36,25 | 36,25 | ≈$0.27 | 85.664 | |
| 52 | Thinky Inkling (high)Thinking Machines Lab | 208,75 | 36,25 | 36,25 | $0.29 | 81.384 | |
| 53 | Nemotron 3 Ultra (high)NVIDIA | 208,75 | 36,25 | 36,25 | $0.32 | 98.620 | |
| 54 | Claude Sonnet 5 (high)Anthropic | 208,75 | 36,25 | 36,25 | $0.33 | 47.598 | |
| 55 | Kimi K3 (low)Moonshot AI | 208,75 | 36,25 | 36,25 | $0.44 | 36.445 | |
| 56 | Claude Sonnet 5 (xhigh)Anthropic | 208,75 | 36,25 | 36,25 | $0.53 | 67.145 | |
| 57 | Kimi K3 (high)Moonshot AI | 208,75 | 36,25 | 36,25 | $0.81 | 55.096 | |
| 58 | Kimi K3 (max)Moonshot AI | 208,75 | 36,25 | 36,25 | $1.21 | 70.615 | |
| 59 | GLM 5.2 (xhigh)Z.ai | 208,75 | 36,25 | 36,25 | ≈$1.55 | 247.730 | |
| 60 | Claude Sonnet 5 (max)Anthropic | 208,75 | 36,25 | 36,25 | $1.70 | 184.631 | |
| 61 | DeepSeek V4 Flash (xhigh)DeepSeek | 205,00 | 35,00 | 35,00 | $0.04 | 140.227 | |
| 62 | Thinky Inkling (low)Thinking Machines Lab | 205,00 | 35,00 | 35,00 | $0.04 | 17.822 | |
| 63 | Ring-2.6-1T (xhigh)Inclusion AI | 205,00 | 35,00 | 35,00 | $0.06 | 139.254 | |
| 64 | Muse Glimmer 30B (high)Meta | 205,00 | 35,00 | 35,00 | $0.07 | 56.822 | |
| 65 | DeepSeek V4 Pro (xhigh)DeepSeek | 205,00 | 35,00 | 35,00 | ≈$0.50 | 157.629 | |
| 66 | GPT-5.6 Terra (none)OpenAI | 201,25 | 33,75 | 33,75 | $0.03 | 14.583 | |
| 67 | MiMo V2.5 ProXiaomi | 201,25 | 33,75 | 33,75 | $0.05 | 59.996 | |
| 68 | Thinky Inkling (none)Thinking Machines Lab | 197,50 | 32,50 | 32,50 | $0.04 | 18.908 | |
| 69 | MiniMax M3MiniMax | 190,00 | 30,00 | 30,00 | $0.02 | 96.652 | |
| 70 | Claude Fable 5 (low)Anthropic | 171,25 | 23,75 | 23,75 | $0.22 | 19.926 | |
| 71 | Claude Fable 5 (medium)Anthropic | 171,25 | 23,75 | 23,75 | $0.44 | 24.388 | |
| 72 | Claude Fable 5 (high)Anthropic | 171,25 | 23,75 | 23,75 | $0.65 | 28.648 | |
| 73 | Claude Fable 5 (xhigh)Anthropic | 171,25 | 23,75 | 23,75 | $0.98 | 35.249 | |
| 74 | Claude Fable 5 (max)Anthropic | 171,25 | 23,75 | 23,75 | $1.37 | 43.087 |
Tabloyu yana kaydırarak tüm sütunları görüntüleyin.
Cevap kâğıdı
dolgu = soruyu doğru çözen model oranı- 1FEN-1: 74 modelin 69 tanesi doğru çözdü
- 2FEN-2: 74 modelin 73 tanesi doğru çözdü
- 3FEN-3: 74 modelin 74 tanesi doğru çözdü
- 4FEN-4: 74 modelin 74 tanesi doğru çözdü
- 5FEN-5: 74 modelin 71 tanesi doğru çözdü
- 6FEN-6: 74 modelin 73 tanesi doğru çözdü
- 7FEN-7: 74 modelin 74 tanesi doğru çözdü
- 8FEN-8: 74 modelin 74 tanesi doğru çözdü
- 9FEN-9: 74 modelin 74 tanesi doğru çözdü
- 10FEN-10: 74 modelin 73 tanesi doğru çözdü
- 11FEN-11: 74 modelin 70 tanesi doğru çözdü
- 12FEN-12: 74 modelin 74 tanesi doğru çözdü
- 13FEN-13: 74 modelin 71 tanesi doğru çözdü
- 14FEN-14: 74 modelin 73 tanesi doğru çözdü
- 15FEN-15: 74 modelin 71 tanesi doğru çözdü
- 16FEN-16: 74 modelin 74 tanesi doğru çözdü
- 17FEN-17: 74 modelin 74 tanesi doğru çözdü
- 18FEN-18: 74 modelin 73 tanesi doğru çözdü
- 19FEN-19: 74 modelin 74 tanesi doğru çözdü
- 20FEN-20: 74 modelin 74 tanesi doğru çözdü
- 21FEN-21: 74 modelin 74 tanesi doğru çözdü
- 22FEN-22: 74 modelin 74 tanesi doğru çözdü
- 23FEN-23: 74 modelin 73 tanesi doğru çözdü
- 24FEN-24: 74 modelin 74 tanesi doğru çözdü
- 25FEN-25: 74 modelin 74 tanesi doğru çözdü
- 26FEN-26: 74 modelin 73 tanesi doğru çözdü
- 27FEN-27: 74 modelin 74 tanesi doğru çözdü
- 28FEN-28: 74 modelin 69 tanesi doğru çözdü
- 29FEN-29: 74 modelin 69 tanesi doğru çözdü
- 30FEN-30: 74 modelin 69 tanesi doğru çözdü
- 31FEN-31: 74 modelin 69 tanesi doğru çözdü
- 32FEN-32: 74 modelin 69 tanesi doğru çözdü
- 33FEN-33: 74 modelin 69 tanesi doğru çözdü
- 34FEN-34: 74 modelin 69 tanesi doğru çözdü
- 35FEN-35: 74 modelin 69 tanesi doğru çözdü
- 36FEN-36: 74 modelin 8 tanesi doğru çözdü
- 37FEN-37: 74 modelin 1 tanesi doğru çözdü
- 38FEN-38: 74 modelin 68 tanesi doğru çözdü
- 39FEN-39: 74 modelin 68 tanesi doğru çözdü
- 40FEN-40: 74 modelin 49 tanesi doğru çözdü
Koşudan çıkanlar
Üç bulgu
- Bulgu · Zirve
Aynı zirve, farklı maliyet
Gemini 3.6 Flash (minimal), Claude Sonnet 5 (medium), Gemini 3.1 Pro (low) ve 4 yapılandırma daha, 216,25 puanla zirveyi paylaşıyor. Zirve grubundaki ölçülen maliyet $0.13 (Gemini 3.6 Flash (minimal)) ile $0.52 (Thinky Inkling (max)) arasında.
- Bulgu · Bölümler
Tam net tablosu
Fen Bilimleri bölümünde tam nete ulaşan model: 0/74.
- Bulgu · Ölçüm sınırı
Bilinmeyen değer, sıfır değildir
Toplam 9 modelde en az bir ölçüm açıklaması var. Maliyet: 9 yaklaşık.
Okuma notları
Kapsam ve ölçüm sınırları
- Puanlama: net = doğru − yanlış/4; geçersiz yanıtlar yanlış sayılır. · 100 + Fen Bilimleri neti × 3
- Sıralama: Yuvarlanmamış puan yüksekten düşüğe sıralanır. Eşit puanda bilinen daha düşük maliyet önce gelir; maliyeti bilinmeyenler aynı puan grubunun sonuna gider. Tam eşitlikte kaynak sırası korunur.
- 0 modelin maliyeti bilinmediği için maliyet analizlerinden çıkarılır; 9 modelin maliyeti yaklaşık değer taşır.
- Model notları:
- Qwen3.6 27B: Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,8 katıydı.
- Tencent Hy3 (low): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,5 katıydı.
- Tencent Hy3 (high): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,5 katıydı.
- GLM 5.2 (high): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,3 katıydı.
- Gemma 4 31B: Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,2 katıydı.
- Tencent Hy3 (none): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,5 katıydı.
- DeepSeek V4 Pro (high): Maliyet liste fiyatından hesaplandı; model allow_fallbacks ile koşuldu ve 2026-07-31 usage.cost ölçümünde gerçek fatura hesaplananın ≈3,9 katına ulaştı.
- GLM 5.2 (xhigh): Maliyet liste fiyatından hesaplandı; allow_fallbacks nedeniyle 2026-07-31 ölçümünde gerçek fatura hesaplananın ≈1,3 katıydı.
- Muse Glimmer 30B (high): Koşu ayarlarındaki 65.536 istenen tavandır; efektif tavan 32.768'dir. Diğer varyantlar 131.072 ile koştu, ancak modelin bağlamı 131.072 olduğundan genel tavan gönderilemezdi. Pinlenen Together endpoint'i ilan etmediği bir sınırla talebi 32.768'de kesiyor. 2026-08-12 ölçümünde bu tavanda hiçbir yanıt kesilmedi.
- DeepSeek V4 Pro (xhigh): Maliyet liste fiyatından hesaplandı; model allow_fallbacks ile koşuldu ve 2026-07-31 usage.cost ölçümünde gerçek fatura hesaplananın ≈3,9 katına ulaştı.
- Claude Fable 5 (low): 40 sorunun 13'ünde (biyoloji) sağlayıcı içerik filtresi yanıtı engelledi; model bu sorulara hiç girmedi. Bu bölümdeki net, modelin bilgisini değil filtre davranışını yansıtır.
- Claude Fable 5 (medium): 40 sorunun 13'ünde (biyoloji) sağlayıcı içerik filtresi yanıtı engelledi; model bu sorulara hiç girmedi. Bu bölümdeki net, modelin bilgisini değil filtre davranışını yansıtır.
- Claude Fable 5 (high): 40 sorunun 13'ünde (biyoloji) sağlayıcı içerik filtresi yanıtı engelledi; model bu sorulara hiç girmedi. Bu bölümdeki net, modelin bilgisini değil filtre davranışını yansıtır.
- Claude Fable 5 (xhigh): 40 sorunun 13'ünde (biyoloji) sağlayıcı içerik filtresi yanıtı engelledi; model bu sorulara hiç girmedi. Bu bölümdeki net, modelin bilgisini değil filtre davranışını yansıtır.
- Claude Fable 5 (max): 40 sorunun 13'ünde (biyoloji) sağlayıcı içerik filtresi yanıtı engelledi; model bu sorulara hiç girmedi. Bu bölümdeki net, modelin bilgisini değil filtre davranışını yansıtır.