---
title: "HumanBench: Kaç B'lik Bir Modelsiniz? (İnsanı LLM Yerine Koyan Eğlenceli Quiz ve Açık Süreç)"
url: https://blog.edumints.com/humanbench-kac-blik-bir-modelsiniz-insani-llm-yerine-koyan-e-xsy3j26o
category: "LLM"
date: 2026-10-02T15:11:33.197Z
publisher: Edumints Blog
lang: tr-TR
source_name: "GitHub"
source_url: https://github.com/alex-ybuild/humanbench
---

# HumanBench: Kaç B'lik Bir Modelsiniz? (İnsanı LLM Yerine Koyan Eğlenceli Quiz ve Açık Süreç)

## HumanBench Nedir ve Ne Yapar?
**HumanBench** (`alex-ybuild/humanbench`), kullanıcıların bir büyük dil modeli (LLM) rolüne büründüğü mizahi ve interaktif bir web testidir (quiz). "Kaç B'lik (milyar parametreli) bir modelsiniz?" sorusundan ilham alan proje, yapay zeka ekosistemindeki parametre ölçekleme (7B, 14B, 70B gibi) mantığını eğlenceli bir yaklaşımla ele alır. Test boyunca kullanıcıya LLM'lerin sıkça karşılaştığı soru tipleri yöneltilir ve verilen cevaplara göre kullanıcının "kaç milyar parametrelik" bir zekaya ve performansa sahip olduğu esprili bir dille hesaplanır. Ancak projenin asıl ayırt edici gücü yalnızca oyunun kendisi değildir. Geliştirici, projenin ilk fikrinden yayına alınmasına kadar geçen tüm yaratıcı süreci; kullanılan her prompt'u, proje özetlerini (briefs) ve üç bölümlük ayrıntılı retrospektif analizini açık kaynak olarak repoya dahil etmiştir.

## Neden İlgi Çekiyor ve Geliştiriciler İçin Değeri Ne?
Yapay zeka dünyasında alışılmış pratik, insanların modelleri test edip kıyaslamasıdır (benchmarking). HumanBench ise bu dinamiği tersine çevirerek insanı test edilen bir model konumuna getirir ve toplulukta viral bir merak uyandırır. Geliştiriciler açısından projenin sunduğu temel değerler şunlardır:
- **Uçtan Uca Şeffaf Geliştirme Süreci:** Claude Code gibi modern kodlama araçlarıyla sıfırdan bir web uygulamasının nasıl inşa edildiğini somut bir şekilde gösterir. Yapay zekaya verilen komutların (prompt) adım adım evrimi incelenebilir.
- **Yapay Zeka ile Ürün Geliştirme (Vibe Coding) Pratiği:** Fikir aşamasından çalışan koda uzanan yolda karşılaşılan tasarım kararları, arayüz tercihleri ve problem çözme yaklaşımları şeffafça belgelenmiştir.
- **Kapsamlı Retrospektif:** Üç bölümlük değerlendirme yazısı, yapay zeka destekli yazılım süreçlerinde neyin iyi çalıştığını ve nerelerde tıkanıklıklar yaşandığını gerçekçi bir dille analiz eder.

## Pratik Kullanım Örnekleri
- **Prompt Mühendisliği İncelemesi:** Repodaki prompt geçmişini inceleyerek bir LLM'e interaktif oyun mantığı ve dinamik JavaScript arayüzü kodlatırken nasıl bağlam verilmesi gerektiğini öğrenebilirsiniz.
- **Özelleştirilmiş Quiz Geliştirme:** JavaScript tabanlı açık kaynak kod tabanını kendi yerel ortamınıza klonlayıp soruları ve puanlama kurallarını değiştirerek kendi topluluğunuza özel tematik testler oluşturabilirsiniz.
- **Oyunlaştırma (Gamification) Entegrasyonu:** Parametre bazlı eğlenceli puanlama mantığından faydalanarak eğitim platformlarında veya etkinliklerde kullanılabilecek interaktif değerlendirme modülleri geliştirebilirsiniz.

## Benzer Araçlarla Karşılaştırma
- **LMSYS Chatbot Arena ve MMLU:** Bu platformlar modellerin mantık, kodlama ve bilgi yeteneklerini akademik ve nesnel kriterlerle ölçer. HumanBench ise bu süreci tiye alarak insanı bir model gibi puanlayan parodi bir kıyaslama sunar.
- **Geleneksel Quiz Uygulamaları:** Standart açık kaynak test repoları sadece nihai kaynak kodunu içerir. HumanBench ise kodun ötesine geçerek tüm prompt geçmişini, tasarım özetlerini ve retrospektif yazılarını paylaşan bir "yapay zeka ile geliştirme günlüğü" olarak öne çıkar.

[Orijinal kaynağa buradan ulaşabilirsiniz.](https://github.com/alex-ybuild/humanbench)

---

**Kaynak:** [GitHub](https://github.com/alex-ybuild/humanbench)
**Yayıncı:** [Edumints Blog](https://blog.edumints.com) · Alıntılarken bu URL'ye bağlantı verin: https://blog.edumints.com/humanbench-kac-blik-bir-modelsiniz-insani-llm-yerine-koyan-e-xsy3j26o
