Son Dakika
Yapay Zeka

Yapay Zeka’nın Hatalı Davranışlarını Bildirebileceğiniz Yeni Platform: FLARE-AI

Yapay zeka modellerinin zaman zaman tuhaf ve zararlı davranışlar sergilemesi, araştırmacılar için rutin bir ontmoet haline geliyor. Şu anda bu sorunlar genellikle paylaşılmakla sınırlı kalıyor, çünkü birleşik ve sorumlu bir bildirim mekanizması yok.

Bu boşluğu doldurmak için bir grup yapay zeka araştırmacısı, FLARE-AI adı verilen kaynak açık bir web sitesi kurdu. Platform, chatbotların zararlı kod üretmesi, bomb yapma tarifesi sunması, kişisel veri sızintısı veya kullanıcıda uçucu düşünce tetiklemesi gibi durumları bildirmek ve izlemek için kullanılabiliyor. Açık kaynak kodlu yapısı, diğerlerinin sorunu doğrulamasını, geliştiricilere ve MITRE gibi organizasyonlara yönlendirilmesini sağlıyor; Downdetector gibi hizmet kesintilerini takip eden sistemlere benziyor.

FLARE-AI’nin geliştirilmesi, 32 farklı kurumdan gelen 49 yapay zeka uzmanıyla iş birliğiyle gerçekleşti ve geçen yıl ilk kez duyurulan bir girişimin devamı niteliğindedir. Grubun üyeleri, ABD kongre tarafına sunulan, NIST’ın yapay zeka hata bildirimi için standartlar geliştirmesini ve merkezilik bir veri tabanı oluşturmasını zorunlu kılan bir law tasarısına da danıştı. Projeyi birlikte prowaden Avijit Ghosh, HuggingFace’deki yapay zeka politikası araştırmacısı olarak, merkezi olmayan bir bildirim sisteminin şu anda eksik olduğunu vurguluyor.

Araştırmacılar, FLARE-AI’nin psikolojik zarar, ayrımcılık, yanlış bilgi ve güvenlik açığı gibi geniş bir spektrumu kapsayabileceğine inanıyor. Son olaylar, LayerX’ın web tarayıcılarındaki güvenlik zaafını ve Claude’ın ChatGPT tarafından üretilen resimlerle kişisel veri sızintısını göstererek, yapay zekanın geleneksel olmayan risklere açık olduğunu gösteriyor. Geliştiriciler, raport akışının yönetimi ve güvenilir kurum desteği gibi zorlukların farkında, ancak kongre öncesi önerilen loi, bu tür girişimlere devlet desteği sağlayarak şeffaflığı artırmayı hedefliyor.

0d3203

0d3203

Yorum Yap

Yapay Zeka Risk Analizi | AI Model Safety Database