Tüm modeller

GPT-5.6 Luna

OpenAI · 7 ölçülmüş yayın

Model kimliği
openai/gpt-5.6-luna
Geliştirici
OpenAI

Benchmark sonuçları

6 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#1
Matematik Puanı
213,25 / 217,00
Net
37,75
Maliyet
$0.04
Token
69.598
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
xhigh
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

6 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#26
TDE-SB1 Puanı
212,50 / 220,00
Net
37,50
Maliyet
$0.01
Token
20.290
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
medium
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

6 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#8
Fen Puanı
212,50 / 220,00
Net
37,50
Maliyet
$0.00
Token
17.269
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
none
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

6 varyant koşuldu; en iyi sıralı sonuç gösteriliyor · Effort sekmesi

Sıra
#1
SB2 Puanı
220,00 / 220,00
Net
40,00
Maliyet
$0.00
Token
17.564
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
131072
Akıl yürütme düzeyi
low
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a
Ulusal sınav

2026 TYT

Sıra
#5
TYT Puanı
487,62 / 500,00
Net
116,25
Maliyet
$0.27
Token
120.931
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
16384
Akıl yürütme düzeyi
high
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a
Mesleki sınav

TUS · TTBT

Sıra
#11
TTBT Neti
69,50 / 72,00
Maliyet
$0.01
Token
23.046
Koşu ayarları
Sıcaklık
0
Azami çıktı tokenı
16384
Akıl yürütme düzeyi
medium
İstenen yönlendirme
n/a
Doğrulanan inference sağlayıcısı
n/a

Uzun bağlam

16K–512K bağlam kalite eğrisi

PUAN
77,0
Gönderilen hücre
30/30
Format ihlali
0

Uzun bağlam PUAN'ı 0–100 aralığındadır ve sınav puanıyla toplanmaz.

ContextCurve sonuçlarını aç