AI modelleri ve benchmark karşılaştırması

Önde gelen yapay zekâ modellerinin bağımsız testlerdeki genel zekâ puanları. Her firmanın en güçlü ayarı gösteriliyor.

#ModelZekâ endeksiBağlam
1Claude Opus 5.5 (max)Anthropic581M
2Claude Fable 5.1 (max)Anthropic531M
2GPT-6 Astra (max)OpenAI531M
4Muse Spark 1.3 (max)Meta481M
4GPT-6 Sol (max)OpenAI48872k
6Grok 4.7 (xhigh)SpaceXAI46500k
6MiMo-V2.6-ProXiaomi461M
8Qwen3.8 Max (0902)Alibaba45984k
8GLM-5.3 (max)Z AI451M
10Kimi K3 (max)Moonshot AI441.05M
10Step 5 PreviewStepFun441M
12Gemini 3.8 Flash (high)Google411M
13DeepSeek V4.1 Flash (max)DeepSeek391M
14MiniMax-M3MiniMax291M
15Nemotron 3 UltraNVIDIA23262k
16Mistral Medium 3.5Mistral14256k
16Nova 2.0 Pro Preview (medium)Amazon14256k
18gpt-oss-120b (high)OpenAI12131k

Zekâ endeksi, Artificial Analysis’in akıl yürütme, bilgi, matematik ve kodlama testlerini birleştiren bağımsız puanıdır (yüksek = daha iyi). Bağlam: modelin tek seferde okuyabildiği metin uzunluğu (token).

Kaynak: Artificial Analysis · Güncelleme: 26 Eylül 2026

Üyelere özel: detaylı karşılaştırma

Ücretsiz üyelik

Devamı üyelere özel

Yazının tamamını ve detaylı verileri görmek için ücretsiz üye olun. Google hesabınızla tek tıkla giriş yapabilirsiniz.