Base Labs, açık yapay zekâ modelleri için güvenlik standardı geliştiriyor

Base Labs, Hugging Face ve Goodfire AI ile açık ağırlıklı yapay zekâ modellerinin güvenliğini eğitimden dağıtıma kadar izlemeyi sağlayacak bir altyapı üzerinde çalışacak.

Base Labs, açık yapay zekâ modelleri için güvenlik standardı geliştiriyor
Kapak görseli yapay zeka ile üretilmiştir. Temsili görseldir; gerçek fotoğraf veya ürün çekimi değildir. Editoryal ilkeler

Baseten tarafından bu yıl kurulan araştırma birimi Base Labs, açık ağırlıklı yapay zekâ modellerinin güvenliğini değerlendirmek ve izlemek için Hugging Face ile Goodfire AI ile ortaklık kurdu. Üç şirketin hedefi, modellerin yalnızca kullanıma sunulmadan önce kontrol edilmesi yerine eğitim, geliştirme, dağıtım ve kullanım aşamalarının tamamına yayılan bir güvenlik altyapısı oluşturmak.

17 Eylül 2026 tarihinde duyurulan girişim, açık model ekosisteminde güvenlik kontrollerinin nasıl uygulanacağına ilişkin tartışmaların sürdüğü bir dönemde geldi. Ortaklar, güvenlik mekanizmalarının model hazırlandıktan sonra eklenen bağımsız katmanlar olarak görülmemesi gerektiğini savunuyor. Bunun yerine değerlendirme ve izleme araçlarının, model geliştirme sürecinin başından itibaren tasarlanması amaçlanıyor.

Açık ağırlık erişimi hem avantaj hem risk getiriyor

Açık ağırlıklı modellerde modelin parametrelerine erişim sağlanabildiği için araştırmacılar ve geliştiriciler, sistemin çalışma biçimini kapalı modellere kıyasla daha ayrıntılı inceleyebiliyor. Bu yaklaşım, performans testleri, hata analizi ve bağımsız güvenlik araştırmaları açısından daha geniş bir alan sunuyor.

Ancak model ağırlıklarına erişim, üreticinin uyguladığı güvenlik sınırlamalarının değiştirilmesini de mümkün kılabiliyor. Bazı kullanıcılar, zararlı veya riskli çıktıları azaltmak için kullanılan korumaları yeniden düzenleyebiliyor ya da tamamen etkisiz hâle getirebiliyor. Bu durum, modelin ilk yayımlandığı sıradaki güvenlik özellikleriyle sonradan kullanılan sürüm arasında fark oluşmasına yol açabiliyor.

Bu tartışmada “abliteration” adı verilen yöntem de öne çıkıyor. Yöntem, modellerin belirli zararlı çıktıları üretmesini sınırlayan korumaların kaldırılması veya zayıflatılması amacıyla kullanılabiliyor. Hugging Face üzerinde 6.000’den fazla abliteration uygulanmış modelin listelendiği belirtiliyor. Bu sayı, açık modellerde güvenlik değerlendirmesinin yalnızca model geliştiricisinin açıklamalarına bırakılmasının neden yetersiz kalabileceğini gösteriyor.

Base Labs, bu ihtiyaca karşı açık modeller için şeffaf bir güvenlik standardı hazırlamak istiyor. Duyuruda standardın teknik yapısı açıklanmadı. Hangi testlerin uygulanacağı, model davranışının hangi aralıklarla izleneceği, sağlayıcılara ne tür raporlar sunulacağı ve güvenlik sonuçlarının hangi formatta paylaşılacağı henüz belli değil.

Üç şirket farklı uzmanlıkları bir araya getiriyor

Hugging Face, açık kaynaklı yapay zekâ modellerinin paylaşıldığı ve barındırıldığı geniş bir platform olarak projeye geliştirici ekosistemine erişim konusunda katkı sağlayabilir. Goodfire AI ise yapay zekâ sistemlerinin iç işleyişini ve karar süreçlerini daha anlaşılır hâle getirmeye odaklanan bir model yorumlanabilirliği platformu geliştiriyor.

Goodfire AI, güvenliğin açık modellere sonradan eklenen bir kontrol katmanı yerine modelin yapısına ve kullanım sürecine yerleşmesi gerektiğini belirtiyor. Bu yaklaşım, güvenlik araştırmalarından elde edilen bulguların geliştiricilerin kullanabileceği ölçülebilir ve şeffaf kontrollere dönüştürülmesini hedefliyor.

Bununla birlikte ortakların projedeki görev dağılımı henüz ayrıntılı biçimde açıklanmadı. Hugging Face’in platform altyapısını nasıl kullanacağı, Goodfire AI’ın yorumlanabilirlik araçlarının hangi aşamada devreye gireceği ve Base Labs’in geliştireceği standardın model sağlayıcıları tarafından nasıl uygulanacağı konusunda paylaşılmış kesin bir plan bulunmuyor.

Baseten, yapay zekâ çıkarım hizmetleri sunan bir şirket olarak haziran ayında 1,5 milyar dolarlık Seri F yatırım turunu tamamladı ve şirket değerlemesini 13 milyar dolara çıkardı. Goodfire AI ise bu yıl B Capital liderliğinde 150 milyon dolarlık Seri B yatırımı aldı. Şirket, bu yatırımla model yorumlanabilirliği platformunun geliştirilmesine devam ediyor.

Geliştiricilerden katkı bekleniyor

Base Labs ve ortakları, ortaya çıkacak çerçevenin yalnızca üç şirketin kararlarıyla şekillenmesini istemiyor. Baseten, geliştirici ekosistemini standardın hazırlanmasına katkı sunmaya çağırdı. Ancak katkıların hangi kanallar üzerinden alınacağı, teknik önerilerin nasıl değerlendirileceği ve sürecin ne zaman tamamlanacağı açıklanmadı.

Hazırlanacak yöntemin farklı açık ağırlıklı modellerde uygulanabilmesi, projenin başarısı açısından belirleyici olacak. Bir modelde çalışan güvenlik testinin başka bir model mimarisinde aynı sonucu vermemesi mümkün. Bu nedenle standardın farklı kullanım alanlarına ve model yapılarına uyarlanabilmesi gerekiyor.

Ayrıca güvenlik değerlendirmesinin tek seferlik bir kontrol olarak kalmaması önem taşıyor. Açık ağırlıklar üzerinde değişiklik yapılabildiği için modelin davranışı, yayımlandıktan sonra da farklı sürümlerde veya farklı ayarlarla değişebilir. İzleme araçlarının bu değişimleri tespit edebilmesi ve sonuçları bağımsız biçimde doğrulanabilir hâle getirmesi gerekecek.

Base Labs, Hugging Face ve Goodfire AI ortaklığı henüz teknik ayrıntıları açıklanmış tamamlanmış bir standart sunmuyor. Şimdilik duyurulan hedef, açık modellerin güvenliğini daha ölçülebilir ve şeffaf hâle getirecek ortak bir altyapı kurmak. Projenin etkisi, geliştirilecek yöntemin ne kadar açık, denetlenebilir ve farklı model sağlayıcıları tarafından kullanılabilir olacağıyla belirlenecek.

Günün zaman çizelgesi

Haber eklenme saatine göre sıralanır.

  1. Bugün
  2. Kral Charles’tan yapay zekâ uyarısı: Kontrolü kaybetmeyelim
  3. Yenilenmiş Apple TV 4K modellerinde 40 dolara varan indirim
  4. Pinterest, odanızı yapay zekâyla yeniden tasarlatacak
  5. Base Labs, açık yapay zekâ modelleri için güvenlik standardı geliştiriyor Bu haber
  6. Ron Johnson, Apple Store’un kuruluşunu podcastte anlattı
  7. Apple TV, İki Yeni Yapımın Fragmanını Yayınladı
  8. Apple, AB’de takip izni ekranlarını değiştirecek
  9. Xbox’ın diskten dijitale özelliği 15 yılda geliştirildi
  10. Roku Labs, deneysel uygulamaları televizyon ekranına taşıyor
  11. Apple gündemi: M8 Ultra sunucuları ve iOS 27.2 beta
  12. Apple Ürünlerinde İndirim: AirPods ve M6 Mac mini Fırsatları
  13. iPhone 18 Pro Ön Siparişleri Kargoya Verilmeye Başladı
  14. Waymo robotaksi silah şüphesiyle yolcuları polise bildirdi
  15. Camp Snap 110D, retro kamerayı ekransız dijitale taşıyor
Burak
Yazar

Burak

Kurucu / Teknoloji Editörü

Burak, yazılım geliştirme, web teknolojileri, mobil uygulamalar, veritabanı sistemleri ve yapay zekâ üzerine çalışan bir teknoloji editörüdür. SanalData’nın kurucusu olarak yazılım, yapay zekâ, mobil teknolojiler ve teknoloji sektöründeki gelişmeleri izler ve değerlendirir.

Burak’ın tüm yazıları

Yorum yaz