---
title: "Robot Kollarında GPT-6 Astra: Manipülasyon Başarısı, Maliyet ve Ajan Verimliliği"
url: https://blog.edumints.com/robot-kollarinda-gpt-6-astra-manipulasyon-basarisi-maliyet-v-4gwht47r
category: "LLM"
date: 2026-09-06T07:12:06.586Z
publisher: Edumints Blog
lang: tr-TR
source_name: "Hacker News"
source_url: https://openai.robocurve.org/gpt-6-astra/
---

# Robot Kollarında GPT-6 Astra: Manipülasyon Başarısı, Maliyet ve Ajan Verimliliği

Robocurve tarafından yayınlanan bu çalışma, daha önce paylaşılan Claude Fable 5 ve Fable 5.1 karşılaştırmasının doğrudan devamı niteliğindedir. Deneyde OpenAI'ın **GPT-6 Astra** modeli, aynı YAM robot kolları ve aynı "Inspect Robots" ajan politikası altında iki temel fiziksel manipülasyon görevinde test edildi:

- "Kırmızı bloğu masadan alıp kasenin içine yerleştirin."
- "Yuvarlak mavi yapboz parçasını merkezindeki tutamaçtan tutup panodaki eşleşen dairesel yuvaya yerleştirin."

Toplamda 120 denemeden oluşan test serisinde modellerin aşama puanları, harcanan token miktarları, deneme maliyetleri ve süreleri karşılaştırıldı.

## Görev Performansı ve Benchmark Sonuçları

Blok yerleştirme görevinde GPT-6 Astra ezici bir üstünlük sağladı. 20 denemenin 19'unu (%95 tamamlanma) başarıyla bitirerek, Fable 5.1'in 8/20'lik (%40) ve Fable 5'in 1/20'lik (%5) başarı oranlarını açık ara geride bıraktı. Astra, bu görevi deneme başına 2.5 dakikada ve 0.94 dolara tamamlarken, Fable 5.1 6.8 dakika ve 2.12 dolar harcadı. Bu sonuç Astra'nın 2.4 kat daha yüksek başarı oranına sahip olduğunu ve 2.3 kat daha ucuza çalıştığını gösteriyor.

Buna karşılık yapboz görevinde tablo tamamen değişti. İnce motor becerisi gerektiren bu görevde Astra da Fable 5.1 gibi 20 denemede yalnızca 2 kez (%10 tamamlanma) başarı yakaladı; Fable 5 ise hiç tamamlayamadı (%0). Astra parçayı yuvaya kadar getirmesine rağmen, Fable ile tamamen aynı son adımda takılarak durakladı. Ancak Astra 1.36 dolarlık birim maliyet ve 3.4 dakikalık deneme süresiyle, Fable 5.1'e (2.18 dolar ve 5.9 dakika) kıyasla 1.6 kat daha ucuz ve daha hızlı kaldı.

## 5 Aşamalı Değerlendirme Rubriği

Her bir deneme, başarısız olsa dahi ulaştığı en ileri adımı kaydetmek amacıyla insan değerlendiriciler tarafından puanlandı:

- **0:** Amaçlı bir yaklaşım sergilenmedi.
- **1:** Hedef nesneyle fiziksel temas kuruldu.
- **2:** Nesne masadan tamamen yukarı kaldırıldı.
- **3:** Nesne bırakma noktasının üzerinde konumlandırıldı.
- **4:** Nesne nihai konumuna başarıyla yerleştirildi.

Astra blok görevinde ortalama 3.95 aşama skoruna ulaşırken yalnızca 2.1k çıktı token'ı üretti (Fable 5.1: 12.9k token, 2.40 aşama). Yapboz görevinde ise Astra ortalama 2.00 aşamada kaldı (2.7k token).

## Yazılım Geliştirme ve Ajan Mimarisi İçin Çıkarımlar

- **Token Verimliliği ve Maliyet:** Astra'nın çıktı token'ı kullanımındaki dramatik düşüş (2.1k vs 12.9k), ajan mimarilerinde gereksiz akıl yürütme döngülerinin budanmasının gecikme ve maliyetleri doğrudan düşürdüğünü kanıtlamaktadır.
- **"Son Mil" Problemi:** Modeller kaba manipülasyonda üstün yetenek sergilese de, mikrometre hassasiyeti ve kuvvet geri bildirimi gerektiren nihai kenetlenme adımlarında saf görme-akıl yürütme döngüleri yetersiz kalmaktadır.
- **Ajan Tasarımında Hibrit Yaklaşım:** Üretim seviyesinde robotik veya araç kullanan otonom ajanlar inşa ederken, salt model yükseltmek yerine uç noktalarda yerel hata toleransı ve deterministik düzeltme mekanizmaları kurgulanmalıdır.

[Orijinal kaynağa buradan ulaşabilirsiniz.](https://openai.robocurve.org/gpt-6-astra/)

---

Bu konuyu derinlemesine öğrenmek isterseniz: [Modeller: Hangisi, Ne Zaman?](https://edumints.com/kesfet/google-ai-studio-kullanm-rehberi-joou) modülüne göz atın.

---

**Kaynak:** [Hacker News](https://openai.robocurve.org/gpt-6-astra/)
**Yayıncı:** [Edumints Blog](https://blog.edumints.com) · Alıntılarken bu URL'ye bağlantı verin: https://blog.edumints.com/robot-kollarinda-gpt-6-astra-manipulasyon-basarisi-maliyet-v-4gwht47r
