LLM

LLM

341 yazı
LLMEdumints Blog
LLM3 dk

Zehrini Seç: Daha Güçlü LLM Arka Kapı Saldırıları İçin Zehir Kümelerinin Öğrenilerek Seçilmesi

İnce Ayar Verilerinde Arka Kapı Tehdidi ve Rastgele Örnekleme Yanılgısı Büyük dil modellerinde (LLM) arka kapı zehirleme saldırıları (backdoor poisoning attacks…

LLMEdumints Blog
LLM3 dk

Grouped Value Attention: İhtiyaç Anında Anahtar Yeniden Yapılandırma ile Verimli KV Önbellekleme

Giriş: Transformer Kod Çözme Sürecinde KV Önbellek Darboğazı Büyük dil modellerinde (LLM) metin üretimi sırasında performans ve ölçeklenebilirlik, büyük ölçüde…

AgentScope Java: Kurumsal Düzeyde Dağıtık ve Uzun Ömürlü AI Ajanları
LLM2 dk

AgentScope Java: Kurumsal Düzeyde Dağıtık ve Uzun Ömürlü AI Ajanları

AgentScope Java Nedir ve Neden Önemlidir? AgentScope Java, kurumsal ortamlarda dağıtık, üretim kalitesinde (production-grade) ve kesintisiz uzun süre çalışabile…

Yapay Zeka Onu Ölçmek İçin Kullandığımız Testleri Aştığında Ne Olur?
LLM3 dk

Yapay Zeka Onu Ölçmek İçin Kullandığımız Testleri Aştığında Ne Olur?

GPT-6 Astra gibi yeni bir yapay zeka modeli tanıtıldığında tanıdık bir döngü yaşanır: Model duyurulur, benchmark sonuçları paylaşılır ve hemen ardından Jensen H…

LLMEdumints Blog
LLM2 dk

PhysBrain 1.5: Görme-Dil Modellerinden Fiziksel Temel Modellere

Giriş ve Fiziksel Çevre Döngüsü PhysBrain 1.5, fiziksel ortamları anlama, eylemler üretme ve gelecekteki durumları tahmin etme yeteneklerini tek bir çatıda birl…

LLMEdumints Blog
LLM2 dk

Ajanlar Ne Zaman Yavaşlar? Token Başına Elo Analizi ile LLM Ajanlarının Test Zamanı Stratejileri

Giriş ve Test Zamanı Hesaplama Dinamikleri Büyük dil modeli (LLM) tabanlı otonom ajanlar; sundukları çözümleri adım adım revize ederken, harici araçları (tools)…

LLMEdumints Blog
LLM3 dk

Realtime-Venus: Asenkron Görev Delegasyonuna Sahip Tam Çift Yönlü Etkileşim Sistemi

1. Kesintisiz Algı ve Yerel Konuşma Üreten Ön Uç Modelleri Dijital ve fiziksel ortamlarda doğal etkileşim kurabilmek, kesintisiz bir algılama ve anlık tepki ver…

LLMEdumints Blog
LLM3 dk

RSIAgent: Yeni Ortamlarda Özyinelemeli Öz-Gelişim İçin Otonom Keşif

Dijital otonom ajanların karşılaştığı en temel zorluklardan biri, önceden eğitilmiş temel modellerin arayüzlerini, araç setlerini ve olası hata modlarını bütünü…

HK: Zig ile Geliştirilmiş Yeni Nesil Birleşik Sinir Ağı Formatı
LLM2 dk

HK: Zig ile Geliştirilmiş Yeni Nesil Birleşik Sinir Ağı Formatı

HK Nedir ve Neden Popülerleşiyor? Yapay zekâ ve derin öğrenme dünyasında model ağırlıklarının depolanması, dağıtılması ve belleğe yüklenmesi uzun süredir parçal…

LLMEdumints Blog
LLM3 dk

OpenArch: Modern LLM Mimarilerinin PyTorch ile Sıfırdan Uygulamaları

OpenArch, günümüzün önde gelen açık kaynaklı büyük dil modellerinin (LLM) mimari yapılarını PyTorch kullanarak sıfırdan hayata geçiren kapsamlı bir öğrenme depo…

LLMEdumints Blog
LLM3 dk

FlashAttention'ı Anlamak Bölüm 1: Kişisel Notlar

0. Giriş: Girdi/Çıktı (IO) Duyarlı Dikkat Mekanizması Yaklaşıklama Yapmadan Transformer'ları Nasıl Hızlandırır? FlashAttention mekanizmasının özü üç temel kavra…

LLMEdumints Blog
LLM3 dk

Kod Analizi Ortaya Çıkardı: Apple Siri, Claude ve ChatGPT ile Değiştirilebiliyor

Güvenlik ve kod araştırmacısı "pdfu" tarafından iOS 27 ve macOS Golden Gate özel framework'lerinde yapılan derinlemesine incelemeler, Apple'ın yeni Siri mimaris…