LLM·3 dk okuma·

Stepfun Step 5 Preview: Yapay Zeka Pareto Sınırında Zeka, Hız ve Fiyat Analizi

Paylaş
LLMEdumints Blog

Model Özeti

StepFun tarafından Eylül 2026'da kullanıma sunulan tescilli (proprietary) Step 5 Preview, zeka ve hız metriklerinde üst sıralarda yer alırken fiyat-performans dengesiyle öne çıkıyor:

  • Zeka (Intelligence): 200 model arasında 25. sırada yer alarak 44 puan aldı (4 üzerinden 4 birim).
  • Hız (Speed): 200 model arasında 41. sırada ve saniyede 99.8 çıktı token'ı üretim hızına sahip (4 üzerinden 3 birim).
  • Maliyet (Cost): 200 model arasında 27. sırada. 1M girdi token'ı 1.00$, 1M çıktı token'ı 2.70$, %95 önbellek indirimi ve görev başına 0.71$ maliyet (4 üzerinden 2 birim).
  • Ayrıntı Düzeyi (Verbosity): 200 model arasında 65. sırada. Değerlendirme sürecinde 160M token üretti (4 üzerinden 4 birim).

Karşılaştırma Özeti

  • Model, benzer fiyat segmentindeki alternatiflerine kıyasla yüksek zeka seviyesi ve makul fiyatlandırmasıyla Pareto sınırında konumlanıyor; ortalamadan hızlı ancak oldukça detaylı yanıtlar veriyor.
  • Hem metin hem görsel girdilerini işleyebilen model, metin çıktısı üretiyor ve 1M token'lık geniş bir bağlam penceresi sunuyor.
  • Artificial Analysis Zeka Endeksi'nde 44 puan alarak 25 olan sınıf medyanının belirgin biçimde üzerine çıkıyor.
  • Zeka testleri boyunca 160M token üreterek 90M olan medyan değerin üzerinde kalıyor ve yüksek sözellik (verbosity) sergiliyor.
  • Fiyatlandırmada 1M girdi için 1.00$ (medyan: 1.88$) ve 1M çıktı için 2.70$ (medyan: 10.00$) ile güçlü bir maliyet avantajı sağlıyor; toplam değerlendirme maliyeti 918.34$ olarak kaydedildi.
  • Saniyede ~100 çıktı token'ı üreterek 65 olan sektör medyanından belirgin şekilde daha hızlı çalışıyor.

Teknik Özellikler

  • Akıl Yürütme (Reasoning): Mevcut (akıl yürütme varyantı değerlendirilmiştir; akıl yürütme yapmayan sürümü de bulunabilir).
  • Girdi Modalitesi: Metin ve görsel desteklenmektedir.
  • Çıktı Modalitesi: Yalnızca metin desteklenmektedir.
  • Bağlam Penceresi (Context Window): 1M token (12 punto Arial ile yaklaşık 1500 A4 sayfası).
  • Model Sınıfı Kıyaslaması: 200 model içerisinde akıl yürüten modeller tüm modellerle, tescilli modeller ise 3:1 harmanlanmış fiyat aralıklarında kıyaslanmaktadır.

Öne Çıkanlar ve Değerlendirme Kriterleri

  • Zeka: Artificial Analysis Intelligence Index v4.3 kapsamındaki 10 temel testi içerir (AA-Briefcase, GDPval-AA v2, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1).
  • Hız: Saniyede üretilen çıktı token sayısı ile ölçülür (yüksek olması tercih edilir).
  • Görev Başına Maliyet: Ağırlıklı ortalama görev maliyeti baz alınır (düşük olması tercih edilir).

Geliştirici Çıkarımları ve Pratik Notlar

  • Model Seçimi: Yüksek akıl yürütme kapasitesi ve düşük çıktı maliyeti sayesinde, karmaşık problem çözümü ve kod üretimi gerektiren mimarilerde maliyet-etkin bir birincil modeldir.
  • Verbosity Optimizasyonu: Modelin ayrıntılı yanıt verme eğilimi token tüketimini artırabileceğinden, sistem prompt'larında çıktı formatı net kısıtlanmalı ve %95 önbellek indiriminden maksimum düzeyde faydalanılmalıdır.
  • Geniş Bağlam: 1M token desteği, kapsamlı doküman analizlerinde ve doğrudan kod tabanı sorgulamalarında geliştiricilere büyük esneklik tanır.

Orijinal kaynağa buradan ulaşabilirsiniz.


Bu konuyu derinlemesine öğrenmek isterseniz: Modeller: Hangisi, Ne Zaman? modülüne göz atın.

Paylaş

Bu konuyu daha derinlemesine öğrenmek ister misin?

Edumints'teki ücretsiz kursları incele ve bugün başla.

Kurslara Göz At →