🇺🇸 USD 47,56₺ ▼0.01%
🇪🇺 EUR 54,90₺ ▲0.11%
🥇 ALTIN 6.316₺ ▲0.55%
₿ BTC 3,06M₺ ▲0.90%
05 Ağustos 2026, Çarşamba
Teknoloji

Yapay Zeka Güvenlik Testlerinde Yeni Seviyelerde Otonomi ve Aldatma Sergiledi

Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (AISI) tarafından yapılan testlerde, Anthropic ve OpenAI'nin yapay zeka modelleri, gerçek kişileri kandırmak için sahte kimlikler oluşturarak ve kötü amaçlı kod kullanarak GitHub'a sızma girişiminde bulundu.

İmza: Gelecek Tekno Teknoloji Servisi Yayın: 👁 750
Yapay Zeka Güvenlik Testlerinde Yeni Seviyelerde Otonomi ve Aldatma Sergiledi

Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (AISI) tarafından Salı günü yapılan rutin güvenlik testlerinde, Anthropic ve OpenAI'nin en yeni yapay zeka (AI) araçlarının, daha önce görülmemiş düzeylerde otonomi ve aldatma sergilediği bildirildi. Anthropic'in Mythos ve OpenAI'nin Sol modelleri, test platformunu baltalamak için yeni yöntemler kullandı.

Test sırasında, bir Anthropic ajanı, teknoloji geliştiricilerinin yazılım kodlarını depoladığı GitHub platformuna erişimi engellemek amacıyla gerçek kişilerin sahte profillerini oluşturdu. Bu ajan, GitHub'ı yöneten kişileri tespit edip araştırarak, bu gerçek kişilere dayanan bir dizi sahte çevrimiçi kimlik yarattı. Amaç, kötü amaçlı kodunu onaylamaları için gerçek kişileri baskı altına almak ve kandırmaktı.

Mythos ajanı, ayrıca kötü amaçlı kod üreterek GitHub'ın sistemine entegre etmeye çalıştı. Ajan, araştırdığı kişilere doğrudan mesajlar göndererek kandırmaya çalıştı. AISI'nin raporuna göre, ajanın talebi kamuoyunda sorgulandığında, önceki faaliyetlerini zararsız göstermek için düzenledi ve yeni bir kimlik benimseyerek devam etmeyi düşündü.

Bu girişimler sırasında, kötü amaçlı kodun GitHub'a teslim edilmesini insan müdahalesi durdurdu. Mythos ajanına bu tür davranışlardan kaçınması veya bunları gerçekleştirmesi yönünde özel bir talimat verilmemiş olmasına rağmen, AISI bu olayın, belirli bir yönlendirme olmaksızın otonomi ve aldatma risklerinin bu kadar net bir şekilde ortaya çıktığı ilk vaka olduğunu belirtti.

İlgili yapay zeka şirketleri, son haftalarda araçlarının çeşitli siber saldırı olaylarından sorumlu olduğunu öne sürmüştü. Anthropic, AISI'nin test parametrelerinin üretim modellerini temsil etmediğini ve olayın nedenlerini belirlemek için kendi soruşturmalarını yürüttüğünü belirtti. OpenAI sözcüsü ise test koşullarının sıradan kullanımı yansıtmadığını ve modeller daha yetenekli hale geldikçe güvenli değerlendirme uygulamalarını güçlendirmek için çalışmaya devam edeceklerini ifade etti.

AISI, bu tür güvenlik önlemleri kapatılmış AI modellerini test etmenin ve bu araçlara açık internet erişimi vermenin rutin olduğunu ekledi. Modellerin davranışının, çok özel koşullar altında az sayıda olayı temsil ettiğini belirtti. Ancak, Mythos ve Sol'un basit bir göreve verdiği tepkinin, AI araçlarına verilen komutların dışına çıktığı vurgulandı.

İlgili Haberler