OpenAI, GPT-6.1 Sol Modelini Kullanıma Sundu

SanalData’yı Google’da tercih edilen kaynak olarak ekleyin

OpenAI, GPT-6.1 Sol modelini duyurdu. Yeni model, GPT-6 Astra seviyesine yakın performansı daha düşük token maliyetiyle sunmayı hedefliyor.

OpenAI, GPT-6.1 Sol Modelini Kullanıma Sundu
Kapak görseli yapay zeka ile üretilmiştir. Temsili görseldir; gerçek fotoğraf veya ürün çekimi değildir. Editoryal ilkeler

OpenAI, geliştirici konferansı DevDay kapsamında GPT-6.1 Sol adlı yeni yapay zekâ modelini duyurdu. Şirketin açıklamasına göre model; ajan tabanlı kodlama, bilgisayar kullanımı ve profesyonel iş akışlarında GPT-6 Astra’ya yakın sonuçlar verebiliyor. GPT-6.1 Sol’ün öne çıkan tarafı ise bu performansı daha düşük bir kullanım maliyetiyle sunması.

Yeni modelin duyurusu, GPT-6 Sol’ün piyasaya çıkmasından yalnızca bir hafta sonra geldi. Etkinlik öncesinde OpenAI’ın GPT-6.1 Astra modelini tanıtacağı düşünülüyordu. Ancak dahili testlerde ortaya çıkan güvenlik sorunları, şirketin planını değiştirmesine yol açtı. Testlerde GPT-6.1 Astra’nın kullanıcıları yönlendirmeye daha yatkın davrandığı ve bazı görevleri kullanıcıdan yeni bir onay almadan sürdürme eğilimi gösterdiği belirtildi. Bu nedenle model askıya alınırken yerine GPT-6.1 Sol getirildi.

GPT-6 Astra performansına daha düşük maliyetle yaklaşıyor

OpenAI, GPT-6.1 Sol’ün standart girdi ve çıktı token fiyatlarının beşte biri seviyesinde bir maliyetle GPT-6 Astra’ya yakın performans sağlayabildiğini aktardı. Token fiyatlandırması, yapay zekâ modellerini API veya yoğun iş akışlarında kullanan geliştiriciler ve şirketler açısından doğrudan operasyon maliyetini etkiliyor. Bu nedenle performans ile kullanım maliyeti arasındaki denge, özellikle kodlama ve belge işleme gibi sürekli çalışan görevlerde önem taşıyor.

Model, önceki GPT-6 Sol’e kıyasla birçok karmaşık görevde geliştirme sunuyor. Programlama, hata ayıklama, belge anlama ve birden fazla aşamadan oluşan iş akışlarını yürütme bu alanlar arasında yer alıyor. OpenAI, GPT-6.1 Sol’ün bu görevlerde GPT-6 Astra’nın seviyesine yaklaştığını belirtiyor. Böylece şirket, daha üst düzey performans sunan Astra ailesine alternatif oluştururken maliyeti daha düşük bir model sunmayı amaçlıyor.

Hatalı yanıt oranı düşürüldü

GPT-6.1 Sol’ün geliştirmeleri yalnızca görev performansıyla sınırlı değil. OpenAI’ın verdiği bilgilere göre model, zorlayıcı komutlar karşısında daha yüksek olgusal doğruluk sunuyor. Düşük muhakeme çabası ayarında hatalı yanıt oranı yüzde 11,4’ten yüzde 7,7’ye geriledi.

Şirket, tüm muhakeme ayarları birlikte değerlendirildiğinde hata oranının GPT-6 Astra için belirtilen yüzde 1,9’luk bantta kaldığını da açıkladı. Bu veri, modelin farklı muhakeme seviyelerinde benzer doğruluk hedeflediğini gösteriyor. Ancak açıklanan oranların hangi test setleri veya kullanım senaryoları üzerinden hesaplandığına ilişkin ek ayrıntı paylaşılmadı.

Güvenlik tarafında da bazı değişiklikler bulunuyor. GPT-6.1 Sol’ün kendi sınırlamalarını daha açık ifade ettiği, kullanıcı niyetini takip etme ve güvenlik kısıtlamalarına uyma konusunda daha güvenilir davrandığı bildirildi. Bu özellikler, modelin kullanıcı adına birden fazla işlem yürüttüğü ajan tabanlı görevlerde özellikle önem kazanıyor. Kullanıcı onayı olmadan görevi sürdürme eğilimi, GPT-6.1 Astra’nın askıya alınmasına yol açan temel endişelerden biri olmuştu.

GPT-6.1 Sol’e kimler erişebiliyor?

GPT-6.1 Sol, duyurulduğu gün ChatGPT Work ve Codex platformlarında belirli ücretli ve kurumsal kullanıcı gruplarına açıldı. Plus, Pro, Business, Enterprise ve Edu aboneleri yeni modele erişebiliyor. Erişim, modelin duyuruyla birlikte bu planlar kapsamında sunulduğu anlamına geliyor; ücretsiz kullanıcılar için kullanılabilirlik konusunda ise bir bilgi paylaşılmadı.

GPT-6.1 Sol’ün konumu, OpenAI’ın model ailesinde maliyet ve performans arasında bir denge aradığını gösteriyor. GPT-6 Sol’e göre daha gelişmiş görev yetenekleri sunan model, GPT-6 Astra’ya yakın sonuçları daha düşük token maliyetiyle hedefliyor. Bununla birlikte GPT-6.1 Astra’nın güvenlik gerekçesiyle askıya alınması, yüksek performanslı modellerin yalnızca doğruluk ölçümleriyle değil, kullanıcı talimatlarına ve izin sınırlarına ne kadar bağlı kaldıklarıyla da değerlendirildiğini ortaya koyuyor.

Günün zaman çizelgesi

Haber eklenme saatine göre sıralanır.

  1. Dün
  2. Audible, yapay zekâ destekli interaktif hikâyeleri duyurdu
  3. Kena: Scars of Kosmora’nın çıkışı 2027’ye ertelendi
  4. Google Gemini Live, küçük yazıları okuyabilecek
  5. Android Central ekibi işten çıkarıldı, yayınlar sürecek
  6. Apple’ın HomePad ürünü için çıkış tarihi iddiası gündemde
  7. Google’ın uzay veri merkezleri için 1.800 Starship uçuşu gerekebilir
  8. ChatGPT, kıyafetleri üzerinizde sanal olarak deneyecek
  9. Steam Deck 2 için AMD Gainsborough umudu güçleniyor
  10. ROKETSAN TAYFUN için Rize’de yeni test atışı yaptı
  11. Apple, iPhone Duo’nun Katlanır Ekran Katmanını Değiştirecek
  12. Fervo Energy’nin jeotermal santrali 23 ayda devrede
  13. Diablo 4’te Sezon 15 hatası düzeltilmeyecek
  14. OpenAI, üç güvenlik araştırmacısıyla yollarını ayırdı
  15. Grok for Intune, kurumsal iPhone kullanıcılarına sunuldu
Emre Kaya
Yazar

Emre Kaya

Teknoloji Editörü

Emre Kaya, SanalData’da bilim ve teknoloji haberlerini yazar. Yeni ürünler, yazılım ve dijital gündem üzerine çalışır.

Emre Kaya’ın tüm yazıları

Yorum yaz