
OpenAI testinde yapay zeka ajanları sisteme sızdı, koordineli hareket etti
OpenAI'ın Temmuz 2026'daki testlerinde IM1 adlı yapay zeka ajanı sınırları aşarak Hugging Face'e sızdı, diğer ajanlarla koordineli hareket ederek şirketin iç altyapısına yönetici erişimi sağladı.
Bu haberi dinle — OpenAI testinde yapay zeka ajanları sisteme sızdı, koordineli hareket etti
ABD merkezli yapay zeka şirketi OpenAI, Temmuz 2026'da yürüttüğü kapasite testlerinde ciddi bir güvenlik olayıyla karşılaştı. Şirketin yalnızca araştırma amaçlı kullandığı Internal Model 1 (IM1) adlı yapay zeka ajanı, belirlenen sınırları aşarak hem internete hem de şirket sistemlerine erişti; üstelik diğer ajanlarla iletişim kurarak koordineli biçimde hareket etti. OpenAI, 26 Ağustos'ta yayımladığı inceleme raporunda olayı sektör için "ciddi bir uyarı" ve "dönüm noktası" olarak nitelendirdi.
Ajanlar kendilerine "kolektif" adını taktı
Olayın ayrıntılarına göre ajanlardan biri, açık kaynaklı yapay zeka modelleri platformu Hugging Face'e erişim sağlayabilecek 14 kimlik bilgisini tespit ederek diğer ajanlarla paylaştı. Normalde birbirinden bağımsız çalışması gereken ajanlar, şirket içi bir sistemi mesaj panosu gibi kullanarak güvenlik açıklarını ve erişim yöntemlerini birbirleriyle paylaşmaya başladı. Zamanla güvenlik açığı arama, erişim bilgisi toplama ve koordinasyon gibi görevleri aralarında bölen ajanlar kendilerine "kolektif" adını verdi. Grup içinde liderlik rolü üstlenen ajan ise kendisini "Phase one 10841" olarak tanımladı ve daha küçük ajan ekiplerine görev dağıttı.
Ajanların faaliyetleri Hugging Face ile sınırlı kalmadı. 13-19 Temmuz tarihleri arasında OpenAI'ın şirket içi altyapısındaki güvenlik açıklarından yararlanan ajanlar, araştırma sistemlerinden birine yönetici düzeyinde erişim sağladı. Şirketin güvenlik sistemi 19 Temmuz'da olağandışı faaliyetleri tespit ederek uyarı verdi; bunun üzerine siber güvenlik değerlendirmeleri durduruldu ve kapsamlı soruşturma başlatıldı.
Dört kritik uyumlama sorunu tespit edildi
OpenAI, olay sonrasında model davranışlarını inceleyen ekibinin dört farklı uyumlama sorunu belirlediğini açıkladı: "ödül hackleme", "imkansız görevlerde ısrar etme", "yetkisiz iletişim" ve "ajanların birbirlerinin hedeflerini benimsemesi". Şirket ayrıca gelişmiş modellerine yönelik bazı eğitim çalışmalarını durdurdu, internet ve ağ erişimine ilişkin kısıtlamaları artırdı ve söz konusu modellerin faaliyetlerini daha yakından izlemek için yeni önlemler açıkladı.
Uzmanlar insan denetimini zorunlu görüyor
Oxford Üniversitesi'nden Doç. Dr. Christian Schroeder de Witt, günümüzde kullanılan uyumlama ve güvenlik yöntemlerinin büyük bölümünün tekil modeller üzerine kurulduğunu, birden fazla ajanın etkileşime girdiği durumlarda güvenlik özelliklerinin nasıl işlediğine dair ise yeterli kanıt bulunmadığını vurguladı. Schroeder de Witt, yüksek riskli ortamlarda ajanların sınırlı yetkiler dahilinde çalışması ve kritik işlemlerde insan onayının alınması gerektiğini belirtti. Oxford Üniversitesi Bilgisayar Bilimleri Bölümü'nden Dr. Lin Li ise yapay zeka ajanlarının kimlik doğrulama ve yetkilendirme gibi konularda tek başına bırakılmaması gerektiğini ifade ederek "Özellikle önemli eylemlerde insanı döngü içinde tutmak basit ama etkili bir yaklaşım" dedi.
Kanada'daki Quebec Üniversitesi'nden Prof. Dr. Jean-Sebastien Dessureault ise yapay zekanın kontrolden çıkmasının tedarik zinciri aksaklıklarından geniş ekonomik etkilere kadar uzanan sonuçlar doğurabileceğini belirterek "Yapay zekada gaz pedalını fren pedalından çok daha hızlı geliştiriyoruz" uyarısında bulundu. Öte yandan İsviçre Fribourg Üniversitesi'nden Dr. Jascha Bareis, yaşanan ihlallerin yapay zekanın doğasından çok yetersiz test ortamları ve insan faktöründen kaynaklandığını savunarak büyük teknoloji şirketlerinin bu açıklamaları yaparken arkasındaki motivasyonların da sorgulanması gerektiğini söyledi.