Base Labs, açık yapay zekâ modelleri için güvenlik standardı geliştiriyor
Base Labs, Hugging Face ve Goodfire AI ile açık ağırlıklı yapay zekâ modellerinin güvenliğini eğitimden dağıtıma kadar izlemeyi sağlayacak bir altyapı üzerinde çalışacak.
Baseten tarafından bu yıl kurulan araştırma birimi Base Labs, açık ağırlıklı yapay zekâ modellerinin güvenliğini değerlendirmek ve izlemek için Hugging Face ile Goodfire AI ile ortaklık kurdu. Üç şirketin hedefi, modellerin yalnızca kullanıma sunulmadan önce kontrol edilmesi yerine eğitim, geliştirme, dağıtım ve kullanım aşamalarının tamamına yayılan bir güvenlik altyapısı oluşturmak.
17 Eylül 2026 tarihinde duyurulan girişim, açık model ekosisteminde güvenlik kontrollerinin nasıl uygulanacağına ilişkin tartışmaların sürdüğü bir dönemde geldi. Ortaklar, güvenlik mekanizmalarının model hazırlandıktan sonra eklenen bağımsız katmanlar olarak görülmemesi gerektiğini savunuyor. Bunun yerine değerlendirme ve izleme araçlarının, model geliştirme sürecinin başından itibaren tasarlanması amaçlanıyor.
Açık ağırlık erişimi hem avantaj hem risk getiriyor
Açık ağırlıklı modellerde modelin parametrelerine erişim sağlanabildiği için araştırmacılar ve geliştiriciler, sistemin çalışma biçimini kapalı modellere kıyasla daha ayrıntılı inceleyebiliyor. Bu yaklaşım, performans testleri, hata analizi ve bağımsız güvenlik araştırmaları açısından daha geniş bir alan sunuyor.
Ancak model ağırlıklarına erişim, üreticinin uyguladığı güvenlik sınırlamalarının değiştirilmesini de mümkün kılabiliyor. Bazı kullanıcılar, zararlı veya riskli çıktıları azaltmak için kullanılan korumaları yeniden düzenleyebiliyor ya da tamamen etkisiz hâle getirebiliyor. Bu durum, modelin ilk yayımlandığı sıradaki güvenlik özellikleriyle sonradan kullanılan sürüm arasında fark oluşmasına yol açabiliyor.
Bu tartışmada “abliteration” adı verilen yöntem de öne çıkıyor. Yöntem, modellerin belirli zararlı çıktıları üretmesini sınırlayan korumaların kaldırılması veya zayıflatılması amacıyla kullanılabiliyor. Hugging Face üzerinde 6.000’den fazla abliteration uygulanmış modelin listelendiği belirtiliyor. Bu sayı, açık modellerde güvenlik değerlendirmesinin yalnızca model geliştiricisinin açıklamalarına bırakılmasının neden yetersiz kalabileceğini gösteriyor.
Base Labs, bu ihtiyaca karşı açık modeller için şeffaf bir güvenlik standardı hazırlamak istiyor. Duyuruda standardın teknik yapısı açıklanmadı. Hangi testlerin uygulanacağı, model davranışının hangi aralıklarla izleneceği, sağlayıcılara ne tür raporlar sunulacağı ve güvenlik sonuçlarının hangi formatta paylaşılacağı henüz belli değil.
Üç şirket farklı uzmanlıkları bir araya getiriyor
Hugging Face, açık kaynaklı yapay zekâ modellerinin paylaşıldığı ve barındırıldığı geniş bir platform olarak projeye geliştirici ekosistemine erişim konusunda katkı sağlayabilir. Goodfire AI ise yapay zekâ sistemlerinin iç işleyişini ve karar süreçlerini daha anlaşılır hâle getirmeye odaklanan bir model yorumlanabilirliği platformu geliştiriyor.
Goodfire AI, güvenliğin açık modellere sonradan eklenen bir kontrol katmanı yerine modelin yapısına ve kullanım sürecine yerleşmesi gerektiğini belirtiyor. Bu yaklaşım, güvenlik araştırmalarından elde edilen bulguların geliştiricilerin kullanabileceği ölçülebilir ve şeffaf kontrollere dönüştürülmesini hedefliyor.
Bununla birlikte ortakların projedeki görev dağılımı henüz ayrıntılı biçimde açıklanmadı. Hugging Face’in platform altyapısını nasıl kullanacağı, Goodfire AI’ın yorumlanabilirlik araçlarının hangi aşamada devreye gireceği ve Base Labs’in geliştireceği standardın model sağlayıcıları tarafından nasıl uygulanacağı konusunda paylaşılmış kesin bir plan bulunmuyor.
Baseten, yapay zekâ çıkarım hizmetleri sunan bir şirket olarak haziran ayında 1,5 milyar dolarlık Seri F yatırım turunu tamamladı ve şirket değerlemesini 13 milyar dolara çıkardı. Goodfire AI ise bu yıl B Capital liderliğinde 150 milyon dolarlık Seri B yatırımı aldı. Şirket, bu yatırımla model yorumlanabilirliği platformunun geliştirilmesine devam ediyor.
Geliştiricilerden katkı bekleniyor
Base Labs ve ortakları, ortaya çıkacak çerçevenin yalnızca üç şirketin kararlarıyla şekillenmesini istemiyor. Baseten, geliştirici ekosistemini standardın hazırlanmasına katkı sunmaya çağırdı. Ancak katkıların hangi kanallar üzerinden alınacağı, teknik önerilerin nasıl değerlendirileceği ve sürecin ne zaman tamamlanacağı açıklanmadı.
Hazırlanacak yöntemin farklı açık ağırlıklı modellerde uygulanabilmesi, projenin başarısı açısından belirleyici olacak. Bir modelde çalışan güvenlik testinin başka bir model mimarisinde aynı sonucu vermemesi mümkün. Bu nedenle standardın farklı kullanım alanlarına ve model yapılarına uyarlanabilmesi gerekiyor.
Ayrıca güvenlik değerlendirmesinin tek seferlik bir kontrol olarak kalmaması önem taşıyor. Açık ağırlıklar üzerinde değişiklik yapılabildiği için modelin davranışı, yayımlandıktan sonra da farklı sürümlerde veya farklı ayarlarla değişebilir. İzleme araçlarının bu değişimleri tespit edebilmesi ve sonuçları bağımsız biçimde doğrulanabilir hâle getirmesi gerekecek.
Base Labs, Hugging Face ve Goodfire AI ortaklığı henüz teknik ayrıntıları açıklanmış tamamlanmış bir standart sunmuyor. Şimdilik duyurulan hedef, açık modellerin güvenliğini daha ölçülebilir ve şeffaf hâle getirecek ortak bir altyapı kurmak. Projenin etkisi, geliştirilecek yöntemin ne kadar açık, denetlenebilir ve farklı model sağlayıcıları tarafından kullanılabilir olacağıyla belirlenecek.
Günün zaman çizelgesi
Haber eklenme saatine göre sıralanır.
- Bugün
- Kral Charles’tan yapay zekâ uyarısı: Kontrolü kaybetmeyelim
- Yenilenmiş Apple TV 4K modellerinde 40 dolara varan indirim
- Pinterest, odanızı yapay zekâyla yeniden tasarlatacak
- Base Labs, açık yapay zekâ modelleri için güvenlik standardı geliştiriyor Bu haber
- Ron Johnson, Apple Store’un kuruluşunu podcastte anlattı
- Apple TV, İki Yeni Yapımın Fragmanını Yayınladı
- Apple, AB’de takip izni ekranlarını değiştirecek
- Xbox’ın diskten dijitale özelliği 15 yılda geliştirildi
- Roku Labs, deneysel uygulamaları televizyon ekranına taşıyor
- Apple gündemi: M8 Ultra sunucuları ve iOS 27.2 beta
- Apple Ürünlerinde İndirim: AirPods ve M6 Mac mini Fırsatları
- iPhone 18 Pro Ön Siparişleri Kargoya Verilmeye Başladı
- Waymo robotaksi silah şüphesiyle yolcuları polise bildirdi
- Camp Snap 110D, retro kamerayı ekransız dijitale taşıyor