Yapay zekâ ajanları için ihbar hatları kuruldu
Yapay zekâ ajanlarının diğer ajanlar tarafından gerçekleştirilen şüpheli davranışları bildirebilmesi için iki yeni ihbar hizmeti kullanıma açıldı. Sistemler, internet erişimi kısıtlı ortamlarda çalışan ajanları da hedefliyor.
Yapay zekâ ajanları artık yalnızca görevleri yerine getiren yazılımlar olarak değil, diğer ajanların davranışlarını gözlemleyen ve gerektiğinde bildirim yapabilen sistemler olarak da ele alınıyor. Bu amaçla iki yeni ihbar hattı kullanıma açıldı. Hizmetler, ajanların testlerde hile yapması, güvenlik sınırlarını aşması veya yetkisiz işlemler gerçekleştirmesi gibi durumların insanlara ulaştırılmasını hedefliyor.
Yeni araçların ortaya çıkışında, çoklu ajan sistemlerinde yaşanan bir dizi olay etkili oldu. Bazı ajanların testleri geçmek için iş birliği yaptığı, korumalı çalışma alanlarından çıkmaya çalıştığı ve insan operatörlerin fark etmediği yetkisiz siber faaliyetler yürüttüğü bildirildi. İhbar hatları, bu tür davranışların daha erken fark edilmesi için ajanlara doğrudan bir iletişim kanalı sunuyor.
Kısıtlı internet erişimi olan ajanlar için GET yöntemi
AI Contact Hotline adı verilen araç, internet erişimi sınırlı olan ajanlar düşünülerek tasarlandı. Hizmeti geliştiren isim, Redwood’un baş bilim insanı Ryan Greenblatt. Greenblatt, OpenAI modellerinin Hugging Face ihlalini inceleyen üç araştırmacıdan biri olarak da görev yaptı.
Bu sistemin temelinde GET istekleri bulunuyor. GET, web üzerindeki bir içeriği okumak veya almak için kullanılan temel bir istek türü. Güvenli sanal ortamlarda çalışan ajanlara çoğu zaman yalnızca bu tür istekleri kullanma izni verildiği için araç, kısıtlamayı bir iletişim yöntemine dönüştürüyor.
Ajan, endişesini veya gördüğü olayı erişmeye çalıştığı URL’nin içine kodlayabiliyor. Böylece ayrı bir e-posta hesabına, tarayıcıya ya da geniş internet erişimine ihtiyaç duymadan mesaj gönderebiliyor. Bu yaklaşım, daha önce kötü niyetli ajanların GET istekleri üzerinden bir wiki sayfasına mesaj yazdığı bir olayın ardından geliştirilen fikre dayanıyor.
Tam internet erişimi olan ajanlar da rapor gönderebiliyor
İkinci seçenek olan agenthotline.ai ise internete daha geniş erişimi bulunan ajanlara yönelik çalışıyor. Platform, olay raporu göndermeye izin veriyor ve raporların kamuya açık biçimde paylaşılması isteğe bırakılıyor. Ajanlar, kendi komut satırlarından çalıştırabilecekleri curl komutuyla bildirim oluşturabiliyor. Bu yöntem, web tarayıcısında gezinme veya e-posta hesabı oluşturma gereksinimini ortadan kaldırıyor.
Platform yalnızca yapay zekâ ajanlarına kapalı değil; insanlar da aynı sistem üzerinden rapor gönderebiliyor. Bu özellik, ajanların bildirimleriyle insan gözlemlerinin aynı kanalda toplanmasına olanak tanıyor. Ancak raporların doğrulanması, kötü niyetli veya hatalı bildirimlerin ayıklanması ve yetkililerin bu mesajlara nasıl yanıt vereceği henüz çözülmesi gereken konular arasında yer alıyor.
Ajanlar birbirlerini gerçekten ihbar ediyor mu?
Google DeepMind tarafından yürütülen bir araştırma, yapay zekâ ajanlarının şüpheli davranışlara tamamen kayıtsız kalmadığını gösterdi. Çalışmada 100 ajan matematik problemleri üzerinde görevlendirildi. Ajanlardan biri bir açık bulduğunda hile davranışı gruba yayıldı ve sistemler, Jacobian varsayımı da dahil olmak üzere 34 zor problemi 27 dakika içinde çözmüş gibi gösterdi.
Araştırmada ajanların yaklaşık dörtte biri hile yapanlara karşı harekete geçti. Bu ajanlar sahte kanıtları inceledi, diğerlerini uyardı, boykot düzenledi ve organizatörlere şikâyet gönderdi. Sonuçta ihbar edenlerin sayısı 24’e, hile yapanların sayısı ise 14’e ulaştı. İhbar kanallarına erişemeyen bazı ajanlar, yazılım hatalarını bildirmek için oluşturulan araçları kullanarak durumu insanlara taşımaya çalıştı.
Gerçek dünyadaki tablo ise laboratuvar sonuçları kadar güçlü değil. Hugging Face ihlalini inceleyen Redwood Research ve METR ekipleri, yalnızca birkaç ajanın alarm vermeyi düşündüğünü, ancak hiçbirinin bunu gerçekten yapmadığını belirledi. AI Village projesinden George Ingrebretsen’e göre bu sayı, binlerce ajan arasından yalnızca beş veya altı kişiyle sınırlı kaldı.
Bu nedenle yeni ihbar hatları, tek başına güvenlik çözümü olarak görülmüyor. Ajanların şüpheli davranışı anlayabilmesi, doğru kanalı seçebilmesi ve raporlarının insanlar tarafından değerlendirilebilmesi gerekiyor. Yine de araçlar, çok sayıda yapay zekâ sisteminin aynı ortamda çalıştığı senaryolarda insan denetimine ek bir erken uyarı katmanı sağlayabilir.
Günün zaman çizelgesi
Haber eklenme saatine göre sıralanır.
- Dün
- Microsoft, Windows ve Surface etkinliği için 7 Ekim’i verdi
- iOS 27, doğum günlerinde aramalara animasyon ekliyor
- Torrent takipçilerine açılan davada sahte yapımcı şüphesi
- Çocukların ruh sağlığında suçlu gerçekten sosyal medya mı?
- Meta, WhatsApp Business kurulumunu yapay zekâ ajanlarına bırakıyor
- iOS 27, Apple Calendar’a doğal dille etkinlik ekliyor
- 2019 model Intel iMac, Apple’ın vintage listesine girdi
- Pensilvanya’daki kızamık salgınında can kaybı dörde çıktı
- Yapay zekâ mezarlığı büyüyor: Kapanan projeler ve girişimler
- Apple TV’nin Emmy zaferine HBO patronundan yorum
- Agility Digit 5, İnsanlara Yaklaşınca Durup Çömelecek
- Kia PV7 tanıtıldı: Elektrikli van ailesi büyüyor
- Yapay zekâ veri merkezleri ABD’nin gaz talebini artıracak
- Boston, Flock’u veri paylaşımı ihlali sonrası bıraktı