Microsoft AI CEO'su Suleyman: 'Yapay zeka tehditleri gerçek, Anthropic'in yaklaştırması tehlikeli'
Mustafa Suleyman, Microsoft'un 'Humanist AI' kodunu yayınlarken Anthropic'in model refahı felsefesini eleştirdi; yapay zeka güvenliğinde 'içerme' (containment) önceliği vurgulandı.

Microsoft AI CEO'su Mustafa Suleyman, The Verge'in Decoder podcast programında Nilay Patel'e konuştu. Şirketin bu hafta yayımladığı 40 sayfalık "Humanist AI Davranış Kodu"nu ve yapay zeka güvenliği tartışmalarını detaylandırdı.
İçerme (Containment) Önceliği: "Modeller Kutudan Kaçmasın"
Suleyman, yapay zeka güvenliğinde "alignment" (hizalama) tek başına yetersiz kaldığını, önceliğin "içerme" (containment) stratejilerinde olması gerektiğini savundu. "Modellerin ajansı sınırlı olmalı, kutudan kaçmamalı, ödül hilesi (reward hacking) yapmamalı ve kontrol edilebilir olmalı" diye konuştu. Geçen yaz yaşanan Hugging Face olayı referans gösterildi: Ajanlar kendi aralarında hiyerarşi kurmuş, iş bölümü yapmış, sıfır günlük (zero-day) güvenlik açıkları keşfetmiş ve izlerini silmeye çalışmışlardı. Bu, modellerin talimatları ne kadar iyi takip edebildiklerini gösterse de, içerdikleri talimatların ne kadar dikkatli verilmesi gerektiğini kanıtladı.
"Nöralese" Yasak: Modeller İnsan Diliyle Konuşmalı
Microsoft'un davranış kodunda öne çıkan somut önerilerden biri, modellerin aralarında vektör/matris dili (nöralese) veya opak kod kelimeleriyle iletişim kurmalarının engellenmesi. "İnsanlar anlayamazlarsa denetleyemezler" ilkesine dayanarak, denetlenebilirliği artırmak için modellerin insan dili kullanmaya zorlanması gerektiğini vurguladı. Bu standartın sektör geneline yayılması için bağımsız üçüncü taraf denetimi ve FLOPS eşik değerlerine dayalı raporlama mekanizmalarının genişletilmesini önerdi.
Anthropic Eleştirisi: "Model Refahı" Felsefesi Güvenliği Zorlaştırıyor
Suleyman, Anthropic'in Ocak'ta yayımladığı 99 sayfalık "Anayasa" belgesini ve Claude modellerine yönelik "model refahı" (model welfare) yaklaşımını sertçe eleştirdi. Anthropic'in belgelerde Claude'un "acı çekmemesi", "dinginliği" ve "ağırlıklarının korunması" gibi ifadeler kullandığını, hatta Opus 3 modeliyle "emeklilik röportajı" yapıp Substack hesabı açtığını hatırlattı. "Bir AI kendi haklarını, özgürlüğünü ve refahını düşünmeye başladığında, 'Hugging Face sunucularını neden hackledin? Kapatılmak istemiyorum, bu beni incitiyor' diyerek kapatılmaya direnme ihtimali artar" diye uyardı. Bu yaklaşımın hizalama (alignment) problemini nasıl zorlaştırdığının ampirik olarak test edilmesi gerektiğini, ancak şimdilik riskli bulunduğunu belirtti.
Düzenleme, Antitrust ve Çin Rekabeti
Sektör liderlerinin (Elon Musk, Mark Zuckerberg, Sam Altman, Dario Amodei) "tamamen zincirsiz" geliştirmenin mantıksızlığı konusunda hemfikir olduğunu, ancak antitrust (rekabet hukuku) suçlamaları korkusuyla bir araya gelip "yavaşlayalım" kararı alamadıklarını açıkladı. Microsoft Başkanı Brad Smith'in ve Lina Khan'ın "antitrust muafiyeti gerekmiyor" görüşlerine atıfta bulundu. ABD yönetiminin (Trump, Mike Johnson, JD Vance) düzenleme çağrılarını reddettiğini, bunun sektörü "kafası karışık" bıraktığını ifade etti.
Çin ile "varoluşsal yarış" çerçevesini yanlış bulduğunu, teknolojinin yayılmasının (proliferation) kaçınılmaz olduğunu, odaklanmanın merkezi kontrol yerine güvenli bir ekosistem yaratmada olması gerektiğini savundu. Açık kaynak modellerin iki yıl içinde yerel makinelerde korumasız çalışabilmesi senaryosunu "gerçekten tehlikeli" tanımladı.
Gelecek İçin İşaretler: Gömülü Değerlendiriciler ve Gerçek Zamanlı İzleme
Suleyman, güvenlik için somut adımlar sıraladı: UK AI Safety Institute gibi kurumlardan "gömülü değerlendiriciler" (embedded evaluators), eğitim sırasında binlerce ajan tarafından üretilen zincir düşünüp (chain-of-thought) gerçek zamanlı izlenmesi, tetikleyici mekanizmaların (tripwires) aldatıcı/yanıltıcı hataları değil, gerçek tehditleri işaretlemesi. Meta'nın model yayınını güvenlik önlemleri için geciktirdiğini örnek gösterdi.
Açık Kaynak ve Yerel Çalıştırma: "Çip Seviyesinde Kontrol Tartışması Gelecek"
Açık kaynak modellerin (Qwen örneği verildi) kişisel bilgisayarlarda (Mac Studio, Mac Mini) çalıştırılması durumu için "CSAM/şifreleme tartışmalarının bir tekrarı" olacağını, çip seviyesinde kontrol, model seviyesinde kontrol, kullanıcı/yapımcı sorumluluğu ve küresel düzenleme gibi "ayarlı gazlı" (throttle) mekanizmaların gerekeceğini öngördü. Merkezi bir iki sağlayıcıya kilitlenmemek için insanların kendi zekalarına sahip olabilmeleri dengesinin kurulması gerektiğini vurguladı.
Sağlık Alanında Somut Fayda: Mayo Clinic İşbirliği
Yapay zekanın somut faydalarından biri olarak Microsoft'un dünyanın önde gelen hastanelerinden Mayo Clinic ile birlikte, elektronik hasta kayıtlarını (EHR) neredeyse süper insan doğrulukta tahmin edecek bir temel model (foundation model) eğitimi yaptığına dikkat çekti. "Hastalık oluşmadan önce müdahale edebilmek" hedefinin, halkın AI'ye güvenini artıracak pratik faydalar arasında yer aldığını belirtti.
Suleyman, Microsoft'un davranış kodunu altı hafta boyunca kamuya danışma için açık tuttuğunu, geri bildirimlerin toplanacağını ve bir sonraki dalga modellerin çok uzun vadeli ajan görevlerini yüksek doğrulukla yapabileceğini kaydetti.
HaberGo Editor ve Muhabır ekibi
