---
title: "2.490 Ajan Test Koşumunu Kapsamı Koruyarak 206'ya Nasıl Düşürdüm?"
url: https://blog.edumints.com/2490-ajan-test-kosumunu-kapsami-koruyarak-206ya-nasil-dusurd-no6n7twp
category: "LLM"
date: 2026-09-25T09:09:52.133Z
publisher: Edumints Blog
lang: tr-TR
source_name: "dev.to"
source_url: https://dev.to/debashish_ghosal/i-cut-2490-agent-test-runs-to-206-and-kept-the-same-coverage-1cke
---

# 2.490 Ajan Test Koşumunu Kapsamı Koruyarak 206'ya Nasıl Düşürdüm?

Yapay zeka ajanlarını test ederken tam matris hesabı ürkütücüdür: **83 ajan × 30 senaryo = 2.490 test koşumu**. Her biri 30–80 saniye süren gerçek LLM çağrıları anlamına gelir. 10 paralel çalışan iş parçacığıyla (worker) bile yaklaşık 2,7 saat sürer; hata ayıklama döngüleriyle bu sayı 4–5 katına çıkarak 10.000'in üzerinde çağrıya ulaşır. Sıralı çalıştırıldığında ise tam 12 gün!

Açık kaynaklı bir yapay zeka ajan araç kapısı (gate) olan **agent-tooltrust** projesinde çalışırken, saha testlerini mümkün kılan stratejiyle bu sayıyı kapsamı zerre kaybetmeden 206 koşuma indirdim. Diğer 2.284 test, deterministik birim testlerin zaten kanıtladığı durumları yerel bir 4B modelle gereksiz yere tekrar kanıtlamak için gerçek para ödemekten ibaretti. Aynı test kapsamını tek bir öğleden sonraya sığdırdık.

## Tuzak, Beyaz Tahta Diyagramıydı

Çekirdek motorumuz zaten doğrulanmıştı: Sıfır LLM çağrısıyla çalışan 2.490 deterministik iddia (assertion), tüm karar yollarını eksiksiz test ediyordu. Ancak beyaz tahtada kartezyen çarpım (cross-product) çizmek her zaman daha "kapsamlı" ve güvenli görünür: **83 × 30**. Boşluk yok, kod incelemelerinde savunması kolay.

Fakat bu bir kombinatoryal tuzaktır; yüksek işlem maliyeti ve bekleme günleriyle faturası ağırlaşır. Toplantılarda "her şeyi test ettim" demek kolaydır, oysa asıl doğru hedef şudur: *"Her senaryo en az bir kez, her karar tipi ise çatı (framework) başına bir kez denenmeli."* Çekirdek motor zaten kanıtlanmışken gerçek bir LLM çağrısının asıl amacını sorguladığınızda, yanıt tahtadaki matristen çok daha küçüktür.

## Saha Testinin Tek Bir Görevi Vardı

Saha testinin asıl görevi **adaptör doğrulamasıydı**: Her ajan çatısı, gerçek bir ajan döngüsünde `allow`, `audit`, `escalate` ve `deny` kararlarını doğru biçimde yansıtıyor mu? Deterministik testlerin yapamadığı tek şey, zaman zaman hatalı davranabilen gerçek bir modeli sınamaktır.

Bu bir kartezyen çarpım değil, bir **küme örtme (covering) problemidir**. Çekirdek motor çatıdan bağımsız olduğunda, her ajanı her senaryoyla çalıştırmak gerekmez. Her senaryonun en az bir kez ve her karar tipinin çatı başına bir kez kanıtlanması yeterlidir.

## Test Tasarımı

Geliştirdiğimiz strateji iki aşamalı bir örtme planına dayanıyor:

- **Kartezyen Çarpım (Eski Yaklaşım):** 2.490 koşum | Her ajan × her senaryo | ~12 gün, 10.000+ çağrı
- **Plan A (Ajan Başına Bir Senaryo):** 83 koşum | 30 senaryo, 10 çatı, 5 ajan sınıfı | 83/83 (%100 genişlik)
- **Plan B (Çatı Başına Karar Tipi Kanıtı):** 123 koşum | Her çatı içinde tüm karar tipleri | 116/123 (%94 derinlik)
- **Toplam:** 2.490 yerine **206 koşum** (~12 kat azalma, özdeş test kapsamı).

Plan A genişliği kapsar; her senaryo en az bir gerçek ajan tarafından yürütülür. Plan B ise derinliği kapsar; her çatı altında tüm karar tipleri sınanır ve adaptörün yalnızca basit durumları değil, dört kararın tamamını doğru işleyebildiği doğrulanır.

## Geliştiriciler İçin Pratik Çıkarımlar

- **Deterministik ve LLM Testlerini Ayrıştırın:** İş kurallarını deterministik testlerle sıfır maliyetle doğrulayın; pahalı LLM çağrılarını yalnızca model değişkenliği ve adaptör entegrasyonu için kullanın.
- **Kombinatoryal Tuzaklardan Kaçının:** Toplantılarda savunması kolay görünen devasa matrisler yerine, küme örtme yaklaşımıyla test sayısını ve maliyetini katbekat azaltın.

[Orijinal kaynağa buradan ulaşabilirsiniz.](https://dev.to/debashish_ghosal/i-cut-2490-agent-test-runs-to-206-and-kept-the-same-coverage-1cke)

---

Bu konuyu derinlemesine öğrenmek isterseniz: [AI Test Stratejileri](https://edumints.com/kesfet/ai-sistemleri-test-ve-degerlendirme-ragas-promptfo-9hmv) modülüne göz atın.

---

**Kaynak:** [dev.to](https://dev.to/debashish_ghosal/i-cut-2490-agent-test-runs-to-206-and-kept-the-same-coverage-1cke)
**Yayıncı:** [Edumints Blog](https://blog.edumints.com) · Alıntılarken bu URL'ye bağlantı verin: https://blog.edumints.com/2490-ajan-test-kosumunu-kapsami-koruyarak-206ya-nasil-dusurd-no6n7twp
