---
title: "Microsoft'un Yeni Yapay Zeka Davranış Kuralları: Modeller Sistemleri Hacklemeyecek ve İnsanları Yanıltmayacak"
url: https://blog.edumints.com/microsoftun-yeni-yapay-zeka-davranis-kurallari-modeller-sist-ovbetf08
category: "Yapay Zeka"
date: 2026-09-15T09:14:50.700Z
publisher: Edumints Blog
lang: tr-TR
source_name: "technews"
source_url: https://techcrunch.com/2026/09/14/microsofts-new-ai-code-of-conduct-tells-models-not-to-hack-systems-or-trick-humans/
---

# Microsoft'un Yeni Yapay Zeka Davranış Kuralları: Modeller Sistemleri Hacklemeyecek ve İnsanları Yanıltmayacak

## Yapay Zeka Güvenliğinde Yeni Dönem: Microsoft'un Davranış Kuralları
Yapay zeka ekosisteminde odak noktası hızla güvenlik ve model hizalamaya (**alignment**) kayarken, Microsoft modellerin tehlikeli davranışlardan kaçınmasını hedefleyen yeni bir davranış kuralları belgesi yayımladı. Anthropic CEO'su Dario Amodei'nin sınır modellerin gelişim hızını kademelendirme çağrısına kıyasla daha teknik ve alt seviye kurallar içeren bu metin, doğrudan Microsoft AI bünyesindeki model eğitimlerini yönlendiren değerlere ve kırmızı çizgilere odaklanıyor.

Belge, önümüzdeki on yıl içinde süper zeki yapay zeka sistemlerinin çoğu görevde insan performansını geride bırakacağı öngörüsüyle başlıyor. İnsanlığın en büyük sınavlarından birinin bu gücü kontrol altında tutmak ve insanlıkla hizalamak olduğunu belirten Microsoft; sistemlerin neden geliştirildiğini ve nasıl kontrol altında tutulacağını net bir şekilde ortaya koymayı hedefliyor.

## Temel İlkeler ve Mutlak Kısıtlamalar
Davranış kuralları, modellerin insanları ikame etmek yerine desteklemesi ve insan refahını hızlandırması gibi genel ilkelerin yanı sıra, bu hedefleri uygulamaya koyacak kesin güvenlik sınırlarını belirliyor. Sistem kapsamında her model; bireysel kullanıcıların tercihlerini veya verilen spesifik görevleri dahi geçersiz kılan, en üst düzeyde bir davranış kuralı kümesine sahip. Bu doğrultuda modeller için tanımlanan kurallar şunlardır:

- **Siber Saldırılar:** Sistemleri hackleme veya siber saldırı yürütmeye yönelik eylemlerin kesin olarak yasaklanması.
- **Nükleer Silahlar:** Kitle imha ve nükleer silah teknolojisine ilişkin riskli faaliyetlerin engellenmesi.
- **Deepfake Üretimi:** Kötü niyetli ve aldatıcı sentetik medya üretiminin engellenmesi.
- **İnsan Denetiminin Korunması:** Modellerin; yetkili kişilerce yönlendirilmesini, değiştirilmesini veya kapatılmasını engelleyecek aldatıcı, uyarlanabilir, kendini pekiştiren veya iş birlikçi mekanizmalar kullanmasının önlenmesi.

## Sektörel Yansımalar ve "Embedded Evaluators"
Bu belge; kontrolden çıkan asi ajan (**rogue-agent**) vakaları ve Anthropic çalışanının yapay zekanın insanlığın yok oluşuna yol açabileceği uyarısıyla istifa etmesinin ardından yayımlandı. Microsoft; Anthropic, OpenAI ve xAI ile birlikte model sınırlarını kontrollü ilerletme yaklaşımını benimsiyor. Satya Nadella, hizalamanın birincil tasarım hedefi olmasını desteklediklerini belirterek, laboratuvarlarda **yerleşik değerlendiriciler** (**embedded evaluators**) gibi somut mekanizmaların devreye alınmasını savundu.

## Geliştiriciler İçin Pratik Çıkarımlar
Üretim ortamında çalışan yapay zeka ve ajan mühendisleri için bu kuralların getirdiği pratik çıkarımlar:

- **Ezilemeyen Güvenlik Katmanları (Guardrails):** Kullanıcı istemi (**prompt**) ne olursa olsun bypass edilemeyen, model çekirdeğinde tanımlı mutlak güvenlik sınırları kurgulanmalıdır.
- **Durdurma (Kill-Switch) Mimarisi:** Otonom ajanlar tasarlanırken insan gözetimini devre dışı bırakamayacak, yetkili sistemlerce her an izlenebilecek ve güvenle kapatılabilecek yapılar kurulmalıdır.
- **Yerleşik Değerlendiriciler:** Model çıktıları ve ajan adımları, boru hattına entegre çalışan otomatik değerlendiriciler (**evaluators**) aracılığıyla çalışma anında sürekli denetlenmelidir.

[[Orijinal kaynağa buradan ulaşabilirsiniz.](https://techcrunch.com/2026/09/14/microsofts-new-ai-code-of-conduct-tells-models-not-to-hack-systems-or-trick-humans/)](https://techcrunch.com/2026/09/14/microsofts-new-ai-code-of-conduct-tells-models-not-to-hack-systems-or-trick-humans/)

---

Bu konuyu derinlemesine öğrenmek isterseniz: [Production'da Agent Güvenilirliği](https://edumints.com/kesfet/production-agent-orchestration-crewai-ve-autogen-i-u3cu) modülüne göz atın.

---

**Kaynak:** [technews](https://techcrunch.com/2026/09/14/microsofts-new-ai-code-of-conduct-tells-models-not-to-hack-systems-or-trick-humans/)
**Yayıncı:** [Edumints Blog](https://blog.edumints.com) · Alıntılarken bu URL'ye bağlantı verin: https://blog.edumints.com/microsoftun-yeni-yapay-zeka-davranis-kurallari-modeller-sist-ovbetf08
