\n\n

Yapay zeka modellerinde rekabet: Liderlik tablosu hızla değişiyor

Yapay zeka modelleri arasındaki performans yarışı, bir hafta içinde yayımlanan üç farklı güncellemeyle dengeleri değiştirdi. GPT-6 Astra ve Fable 5.1 modelleri son testlerde eşit puana ulaşırken maliyet farklarıyla ayrıştı.

Bu haber ilgini çekti mi?Benzer gelişmeleri kişisel akışında gör ve bildirimlerini seç.
+Gündem
Temsili görsel: Yapay zeka modellerinde rekabet: Liderlik tablosu hızla değişiyor
Temsili görsel · 51581 / Pixabay
Haberin kısa özeti2 dakikada okuyun
  • Yapay zeka modelleri arasındaki performans yarışı, bir hafta içinde yayımlanan üç farklı güncellemeyle dengeleri değiştirdi.
  • GPT-6 Astra ve Fable 5.1 modelleri son testlerde eşit puana ulaşırken maliyet farklarıyla ayrıştı.
  • Yapay zeka dünyasında geliştirici platformu Artificial Analysis tarafından yürütülen performans testleri, sektördeki hızlı değişimi gözler önüne serdi.
HIZLI CEVAP

Bu haber ne anlatıyor?

Yapay zeka modelleri arasındaki performans yarışı, bir hafta içinde yayımlanan üç farklı güncellemeyle dengeleri değiştirdi. GPT-6 Astra ve Fable 5.1 modelleri son testlerde eşit puana ulaşırken maliyet farklarıyla ayrıştı.

1 kaynakla doğrulama Kaynak gösterimine hazır Son güncelleme: 10.09.2026 07:47
Editoryal not: Bu içerik, doğrulanabilir kaynaklar ve görsel veriler titizlikle analiz edilerek, özgünlük ilkeleri çerçevesinde editoryal süreçten geçirilerek hazırlanmıştır.

Yapay zeka dünyasında geliştirici platformu Artificial Analysis tarafından yürütülen performans testleri, sektördeki hızlı değişimi gözler önüne serdi. v5 güncellemesi öncesinde hızlandırılmış bir süreçle yayımlanan v4.1.1, v4.2 ve v4.3 sürümleri, yapay zeka modelleri arasındaki liderlik yarışını bir hafta içinde üç kez değiştirdi.

Sürecin başında Fable 5.1 modeli, GPT-6 Astra'nın önünde yer alıyordu. Ancak platformun yeni değerlendirme kriterlerini sisteme dahil etmesi ve test setlerini güncellemesiyle birlikte aradaki puan farkı hızla kapandı. v4.3 sürümüne gelindiğinde, her iki model de 53 puanla zirveyi paylaşarak eşitlendi. Bu durum, modellerin performans kapasitelerinin birbirine yaklaştığını gösterse de maliyet ve uzmanlık alanları açısından belirgin farklılıklar ortaya koydu.

Maliyet ve Uzmanlık Farkları

Yapılan analizler, GPT-6 Astra'nın görev başına 3,26 dolar maliyetle, 7,63 dolar maliyeti olan Fable 5.1'e göre yüzde 57 daha ekonomik olduğunu ortaya koydu. Astra'nın bu maliyet avantajını, değerlendirme sürecinde daha az çıktı çipi kullanmasına borçlu olduğu belirtildi. Uzmanlık alanlarına bakıldığında ise Fable 5.1 modeli bilimsel hesaplamalar ve bilgi odaklı görevlerde üstünlük sağlarken, Astra modeli terminal tabanlı yazılım geliştirme ve iş akışı otomasyonu süreçlerinde daha yüksek başarı gösterdi.

Güvenilirlik İçin Yeni Kriterler

Platform, modellerin test sorularını ezberlemesini engellemek amacıyla gizli test setlerinin ağırlığını artırma stratejisini sürdürüyor. v4.1 sürümünde yüzde 20 olan gizli test oranı, v4.3 itibarıyla yüzde 45 seviyesine yükseltildi. Artificial Analysis yetkilileri, gelecek v5 güncellemesinde bu oranı daha da artırmayı hedeflediklerini açıkladı.

Güncel liderlik tablosunda Astra ve Fable 5.1'i 51 puanla Claude Opus 5 takip ederken, Claude Fable 5 modeli 50 puanla dördüncü sırada yer aldı. Açık kaynaklı modeller arasında ise GLM-5.3 Flash, 42 puanlık performansıyla dikkat çekti.

KAYNAK ŞEFFAFLIĞI

Doğrulanan bilgiler ve kaynaklar

1kaynak · 5 olgu

1 kaynak ve 5 yapılandırılmış olgu üzerinden hazırlanmış editoryal doğrulama özeti.

Öne çıkan doğrulanmış bilgiler

  1. Artificial Analysis, v4.1.1, v4.2 ve v4.3 sürümlerini v5 güncellemesi öncesinde hızlandırılmış bir süreçle yayımladı.Kaynak 1
  2. v4.3 sürümünde GPT-6 Astra ve Fable 5.1 modelleri 53 puanla eşitlendi.Kaynak 1
  3. GPT-6 Astra, görev başına 3,26 dolar maliyetle Fable 5.1'den yüzde 57 daha uygun fiyatlıdır.Kaynak 1
  4. Fable 5.1 bilimsel hesaplamalarda, Astra ise yazılım ve otomasyon işlerinde daha başarılı sonuçlar vermektedir.Kaynak 1
  5. Modellerin ezber yapmasını engellemek için kullanılan gizli test setlerinin oranı v4.3 sürümünde yüzde 45'e çıkarıldı.Kaynak 1

Başvurulan kaynaklar

  1. 1
    TRT HaberHaber kaynağı · 10.09.2026 07:24

    Yapay zekada liderlik yarışı: Tablo bir haftada 3 kez değişti

    Kaynağı aç ↗

Bu haber sizde nasıl bir etki bıraktı?

Tek dokunuşla tepkinizi paylaşın. Seçiminize yeniden basarsanız tepkiniz kaldırılır.

0 tepki

İlgili Haberler

Aynı konudaki gelişmeler
HaberSitesi'ni Google'da tercih edilen kaynak yap

HaberSitesi.Org'u tercih edilen kaynaklarınıza ekleyerek Google'daki Top Stories, AI Mode ve AI Overviews yüzeylerinde yayınlarımızı daha kolay öne çıkarabilirsiniz.