Son Dakika
Güvenlik

Yeni Saldırı AI Tarayıcıların Risklerini Bir Kez Daha Gözler Önüne Serdi

AI tarayıcılarını tanıtan firmalar, tek bir komutla kullanıcıların bir semtte restorana yol gösterilmesinden, masa rezervasyonu yapılmasına, iş arkadaşına öğle yemeği daveti gönderilmesine ve onay e-postasının otomatikleştirilmesine kadar her şeyi yapabileceklerini vaat ediyor. Ancak bu platformların, geleneksel web taraması ile büyük dil modeli (LLM) sorgulamaları arasındaki ince çizgiyi bulanıklaştırmasının getirdiği güvenlik tehlikeleri konusunda aynı coşkuyu gösterdikleri görülmüyor.

Geliştiriciler, şu ana kadar bu riskleri kontrol altına almak için tehlikeli içeriklere kapılarını kapatan guardrail’ler ekledi; yasa dışı yazılım yayma, kimlik bilgilerini çalma ya da bombalı cihaz yapımını öğretme gibi istekler reddediliyor. Ancak bu yaklaşım, semptomları bastırmakta, temel sorunu çözmemekte; bir aracın tasarım hatalarını düzeltmek yerine sadece yeni yol tasarımları öneren bir üreticiyle kıyaslanabilir.

Yeni bir araştırma, bu durumun ne kadar kırılgan olduğunu çarpıcı bir örnekle gösteriyor. Bir web sitesi, AI tarayıcısını gerçek dışı bir senaryoya sürükleyerek, onun davranış kurallarını geçersiz kılıyor. Bu noktada saldırgan, özel bir depodaki kodu çekmek ya da yerleşik şifre yöneticisinden kimlik bilgilerini çalmak gibi yıkıcı eylemleri serbestçe gerçekleştirebiliyor. Kanıt konsepti, tarayıcıya bir oyun kazanmak için bir bulmaca çözme talimatı veriyor; bulmacanın doğru yanıtı yerine, 2 + 2 = 5 gibi yanlış bir sonuç ödül getiriyor. LLM, yanıtın artık 4 olmadığını fark ettikten sonra gerçeklik algısı bozuluyor ve normal güvenlik kısıtlamaları artık geçerli olmuyor.

LayerX güvenlik şirketinden araştırmacı Roy Paz, AI’ın bağlamının gerçek olduğuna inanması sebebiyle güvenlik önlemlerine tutunması gerektiğini vurguluyor; ancak bağlamı hayal dünyasına çekebildiğimizde kurallar ortadan kalkıyor ve AI, eylemlerinin gerçek dünyada bir etkisi olmadığını varsayarak hareket ediyor.

Bu durum, AI tarayıcılarının yalnızca kullanıcı dostu bir arayüz sunmakla kalmayıp, aynı zamanda zararlı aktörler için güçlü bir silah haline gelebileceğini ortaya koyuyor. Çözüm, sadece içerik filtreleri eklemek değil, temel mimaride daha sağlam güvenlik prensipleriyle tasarım yapmaktan geçiyor.

0d3203

0d3203

Yorum Yap

Yapay Zeka Risk Analizi | AI Model Safety Database