LLM·3 dk okuma·
Stepfun Step 5 Preview: Yapay Zeka Pareto Sınırında Zeka, Hız ve Fiyat Analizi
LLMEdumints Blog
İçindekiler
Model Özeti
StepFun tarafından Eylül 2026'da kullanıma sunulan tescilli (proprietary) Step 5 Preview, zeka ve hız metriklerinde üst sıralarda yer alırken fiyat-performans dengesiyle öne çıkıyor:
- Zeka (Intelligence): 200 model arasında 25. sırada yer alarak 44 puan aldı (4 üzerinden 4 birim).
- Hız (Speed): 200 model arasında 41. sırada ve saniyede 99.8 çıktı token'ı üretim hızına sahip (4 üzerinden 3 birim).
- Maliyet (Cost): 200 model arasında 27. sırada. 1M girdi token'ı 1.00$, 1M çıktı token'ı 2.70$, %95 önbellek indirimi ve görev başına 0.71$ maliyet (4 üzerinden 2 birim).
- Ayrıntı Düzeyi (Verbosity): 200 model arasında 65. sırada. Değerlendirme sürecinde 160M token üretti (4 üzerinden 4 birim).
Karşılaştırma Özeti
- Model, benzer fiyat segmentindeki alternatiflerine kıyasla yüksek zeka seviyesi ve makul fiyatlandırmasıyla Pareto sınırında konumlanıyor; ortalamadan hızlı ancak oldukça detaylı yanıtlar veriyor.
- Hem metin hem görsel girdilerini işleyebilen model, metin çıktısı üretiyor ve 1M token'lık geniş bir bağlam penceresi sunuyor.
- Artificial Analysis Zeka Endeksi'nde 44 puan alarak 25 olan sınıf medyanının belirgin biçimde üzerine çıkıyor.
- Zeka testleri boyunca 160M token üreterek 90M olan medyan değerin üzerinde kalıyor ve yüksek sözellik (verbosity) sergiliyor.
- Fiyatlandırmada 1M girdi için 1.00$ (medyan: 1.88$) ve 1M çıktı için 2.70$ (medyan: 10.00$) ile güçlü bir maliyet avantajı sağlıyor; toplam değerlendirme maliyeti 918.34$ olarak kaydedildi.
- Saniyede ~100 çıktı token'ı üreterek 65 olan sektör medyanından belirgin şekilde daha hızlı çalışıyor.
Teknik Özellikler
- Akıl Yürütme (Reasoning): Mevcut (akıl yürütme varyantı değerlendirilmiştir; akıl yürütme yapmayan sürümü de bulunabilir).
- Girdi Modalitesi: Metin ve görsel desteklenmektedir.
- Çıktı Modalitesi: Yalnızca metin desteklenmektedir.
- Bağlam Penceresi (Context Window): 1M token (12 punto Arial ile yaklaşık 1500 A4 sayfası).
- Model Sınıfı Kıyaslaması: 200 model içerisinde akıl yürüten modeller tüm modellerle, tescilli modeller ise 3:1 harmanlanmış fiyat aralıklarında kıyaslanmaktadır.
Öne Çıkanlar ve Değerlendirme Kriterleri
- Zeka: Artificial Analysis Intelligence Index v4.3 kapsamındaki 10 temel testi içerir (AA-Briefcase, GDPval-AA v2, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1).
- Hız: Saniyede üretilen çıktı token sayısı ile ölçülür (yüksek olması tercih edilir).
- Görev Başına Maliyet: Ağırlıklı ortalama görev maliyeti baz alınır (düşük olması tercih edilir).
Geliştirici Çıkarımları ve Pratik Notlar
- Model Seçimi: Yüksek akıl yürütme kapasitesi ve düşük çıktı maliyeti sayesinde, karmaşık problem çözümü ve kod üretimi gerektiren mimarilerde maliyet-etkin bir birincil modeldir.
- Verbosity Optimizasyonu: Modelin ayrıntılı yanıt verme eğilimi token tüketimini artırabileceğinden, sistem prompt'larında çıktı formatı net kısıtlanmalı ve %95 önbellek indiriminden maksimum düzeyde faydalanılmalıdır.
- Geniş Bağlam: 1M token desteği, kapsamlı doküman analizlerinde ve doğrudan kod tabanı sorgulamalarında geliştiricilere büyük esneklik tanır.
Orijinal kaynağa buradan ulaşabilirsiniz.
Bu konuyu derinlemesine öğrenmek isterseniz: Modeller: Hangisi, Ne Zaman? modülüne göz atın.
Bu konuyu daha derinlemesine öğrenmek ister misin?
Edumints'teki ücretsiz kursları incele ve bugün başla.
Kurslara Göz At →