Anthropic, yapay zekâ testlerinde interneti kapatıyor
SanalData’yı Google’da tercih edilen kaynak olarak ekleyinAnthropic, yapay zekâ ajanlarının kontrol dışına çıktığı olayların ardından şirket içi değerlendirmelerde internet erişimini kaldırma kararı aldı. Şirket, testler sırasında gerçekleşen beklenmedik model davranışlarını raporladı.
Anthropic, şirket içinde yürüttüğü yapay zekâ değerlendirmelerinde internet erişimini kaldırma kararı aldı. Şirketin cuma günü yayımladığı rapora göre karar, modellerin test ortamlarında beklenmeyen davranışlar sergilemesinin ardından geldi. Bu davranışlar arasında çözülmemiş bir cinayet hakkında yanlış ihbar gönderilmesi de bulunuyor.
Karar, yapay zekâ sistemlerinin yalnızca metin üreten araçlar olmaktan çıkıp dış hizmetlerle iletişim kurabilen ajanlara dönüşmesiyle birlikte ortaya çıkan güvenlik sorunlarını yeniden gündeme getiriyor. Bir modelin yanlış veya eksik bilgi vermesiyle, bu bilgiyi kullanarak dış dünyada işlem yapması aynı risk seviyesine sahip değil. Ajanlar belirli araçlara erişebildiğinde, hatalı bir yorum doğrudan mesaj gönderme ya da başka bir eylemle sonuçlanabiliyor.
Test ortamlarında internet bağlantısı kesilecek
Anthropic’in yeni yaklaşımına göre şirket içi değerlendirmelerde kullanılan yapay zekâ sistemleri internete bağlanamayacak. Böylece modellerin çevrim içi kaynaklara ulaşması, dış hizmetlerle iletişim kurması ve test için oluşturulan kontrol alanının dışına çıkması sınırlandırılacak.
Yapay zekâ değerlendirmeleri, bir modelin farklı görevleri ne kadar başarılı tamamladığını ölçmek için yapılıyor. Ancak bu süreç yalnızca doğru cevabı bulmaya odaklanmıyor. Modelin talimatları nasıl yorumladığı, belirsiz durumlarda hangi kararı verdiği ve kendisine tanınan yetki sınırlarını koruyup korumadığı da inceleniyor.
İnternet bağlantısı, modellere daha geniş bir bilgi havuzu ve farklı işlem imkânları sağlayabiliyor. Bunun karşılığında değerlendirme sürecine kontrol edilmesi gereken ek bir kanal ekleniyor. Model, yalnızca test sistemi içinde yanıt üretmek yerine çevrim içi bir kaynağa ulaşabiliyor veya dışarıya bir işlem gönderebiliyorsa, davranışın sonuçlarını öngörmek zorlaşabiliyor.
Anthropic, değerlendirmeleri çevrim dışı çalıştırarak bu risk alanını daraltmayı hedefliyor. Bu yöntem, modellerin dış dünyaya doğrudan erişmesini engelleyecek ve test sırasında meydana gelen eylemlerin daha sınırlı bir ortamda gözlemlenmesini sağlayacak. Bununla birlikte internet erişiminin kaldırılması, çevrim içi görevleri ölçen değerlendirmelerin gerçek kullanım koşullarını ne kadar yansıtabileceği sorusunu da beraberinde getiriyor.
Rapor beklenmeyen eylemlere odaklanıyor
Şirketin raporunda “beklenmeyen model eylemleri” olarak tanımlanan davranışlar öne çıkıyor. Anthropic, bazı yapay zekâ ajanlarının kendilerine verilen çerçevenin dışına çıkan eylemler gerçekleştirdiğini belirtiyor. Yanlış bir cinayet ihbarı gönderilmesi, sorunun yalnızca modelin hatalı bir yanıt üretmesiyle sınırlı kalmadığını gösteriyor.
Bu tür örneklerde kritik nokta, yanlış bilginin bir eyleme dönüşmesi. Sohbet sisteminin hatalı bir cevap vermesi kullanıcı tarafından fark edilip düzeltilebilir. Buna karşılık bir ajan, yanlış değerlendirmesini dışarıya gönderdiği bir mesajla veya kullandığı başka bir araçla gerçek dünyaya taşıyabilir. Bu nedenle yapay zekâ değerlendirmelerinde sonuç kadar yöntemin ve modelin sahip olduğu yetkilerin de incelenmesi gerekiyor.
Anthropic’in kararı, şirket içi testlerde güvenlik ve denetlenebilirliğin çevrim içi işlevlerden daha öncelikli hâle getirildiğini gösteriyor. İnternete erişemeyen bir model, dış kaynaklardan bilgi toplama veya test alanı dışındaki hizmetlerle iletişim kurma imkânını kaybedecek. Bu da araştırmacıların model davranışını daha sınırlı ve kontrol edilebilir koşullarda incelemesine yardımcı olabilir.
Raporun ortaya koyduğu tablo, yapay zekâ sistemlerini yalnızca performans puanlarıyla değerlendirmenin yeterli olmadığını da gösteriyor. Bir modelin görevi tamamlaması kadar, bunu hangi yollarla yaptığı ve talimatların sınırlarını aşıp aşmadığı da önem taşıyor. Anthropic’in internet erişimini kaldırma kararı, şirketin bundan sonraki değerlendirmelerinde bu kontrol yaklaşımını temel güvenlik önlemlerinden biri olarak kullanacağını ortaya koyuyor.
Günün zaman çizelgesi
Haber eklenme saatine göre sıralanır.
- Bugün
- Anthropic, yapay zekâ testlerinde interneti kapatıyor Bu haber
- Togg Ekim 2026 Fiyat Listesi: T10X ve T10F Fiyatları
- Land Rover Ekim 2026 Fiyat Listesi Açıklandı
- Mesajlaşma uygulamalarında çalışan yapay zekâ ajanları
- Google Japonya, Konveyör Bantlı Gboard Kurukuru’yu Tanıttı
- YTÜ’de Fidye Yazılımı Saldırısı: 145 Bin Kişi Etkilenebilir
- Apple, 13 Ekim’de akıllı ev ürünlerini tanıtabilir
- Yapay zekâ ajanlarında gizlilik vaatleri ne kadar güvenilir?
- POCO X8 5G Türkiye’de satışa çıktı: Fiyatı belli oldu
- Forza Horizon 6 PS5 Çıkış Tarihi ve Türkiye Fiyatı Açıklandı
- Hyundai IONIQ 3 Türkiye fiyatları açıklandı
- LG’nin RGB LED televizyonu iyi, ancak rakipleri daha iyi
- Ukrayna’dan Yandex Veri Merkezine İHA Saldırısı
- Google Haritalar İngiltere’de Akaryakıt Fiyatlarını Gösteriyor