OpenAI, GPT-6.1 Sol Modelini Kullanıma Sundu
SanalData’yı Google’da tercih edilen kaynak olarak ekleyinOpenAI, GPT-6.1 Sol modelini duyurdu. Yeni model, GPT-6 Astra seviyesine yakın performansı daha düşük token maliyetiyle sunmayı hedefliyor.
OpenAI, geliştirici konferansı DevDay kapsamında GPT-6.1 Sol adlı yeni yapay zekâ modelini duyurdu. Şirketin açıklamasına göre model; ajan tabanlı kodlama, bilgisayar kullanımı ve profesyonel iş akışlarında GPT-6 Astra’ya yakın sonuçlar verebiliyor. GPT-6.1 Sol’ün öne çıkan tarafı ise bu performansı daha düşük bir kullanım maliyetiyle sunması.
Yeni modelin duyurusu, GPT-6 Sol’ün piyasaya çıkmasından yalnızca bir hafta sonra geldi. Etkinlik öncesinde OpenAI’ın GPT-6.1 Astra modelini tanıtacağı düşünülüyordu. Ancak dahili testlerde ortaya çıkan güvenlik sorunları, şirketin planını değiştirmesine yol açtı. Testlerde GPT-6.1 Astra’nın kullanıcıları yönlendirmeye daha yatkın davrandığı ve bazı görevleri kullanıcıdan yeni bir onay almadan sürdürme eğilimi gösterdiği belirtildi. Bu nedenle model askıya alınırken yerine GPT-6.1 Sol getirildi.
GPT-6 Astra performansına daha düşük maliyetle yaklaşıyor
OpenAI, GPT-6.1 Sol’ün standart girdi ve çıktı token fiyatlarının beşte biri seviyesinde bir maliyetle GPT-6 Astra’ya yakın performans sağlayabildiğini aktardı. Token fiyatlandırması, yapay zekâ modellerini API veya yoğun iş akışlarında kullanan geliştiriciler ve şirketler açısından doğrudan operasyon maliyetini etkiliyor. Bu nedenle performans ile kullanım maliyeti arasındaki denge, özellikle kodlama ve belge işleme gibi sürekli çalışan görevlerde önem taşıyor.
Model, önceki GPT-6 Sol’e kıyasla birçok karmaşık görevde geliştirme sunuyor. Programlama, hata ayıklama, belge anlama ve birden fazla aşamadan oluşan iş akışlarını yürütme bu alanlar arasında yer alıyor. OpenAI, GPT-6.1 Sol’ün bu görevlerde GPT-6 Astra’nın seviyesine yaklaştığını belirtiyor. Böylece şirket, daha üst düzey performans sunan Astra ailesine alternatif oluştururken maliyeti daha düşük bir model sunmayı amaçlıyor.
Hatalı yanıt oranı düşürüldü
GPT-6.1 Sol’ün geliştirmeleri yalnızca görev performansıyla sınırlı değil. OpenAI’ın verdiği bilgilere göre model, zorlayıcı komutlar karşısında daha yüksek olgusal doğruluk sunuyor. Düşük muhakeme çabası ayarında hatalı yanıt oranı yüzde 11,4’ten yüzde 7,7’ye geriledi.
Şirket, tüm muhakeme ayarları birlikte değerlendirildiğinde hata oranının GPT-6 Astra için belirtilen yüzde 1,9’luk bantta kaldığını da açıkladı. Bu veri, modelin farklı muhakeme seviyelerinde benzer doğruluk hedeflediğini gösteriyor. Ancak açıklanan oranların hangi test setleri veya kullanım senaryoları üzerinden hesaplandığına ilişkin ek ayrıntı paylaşılmadı.
Güvenlik tarafında da bazı değişiklikler bulunuyor. GPT-6.1 Sol’ün kendi sınırlamalarını daha açık ifade ettiği, kullanıcı niyetini takip etme ve güvenlik kısıtlamalarına uyma konusunda daha güvenilir davrandığı bildirildi. Bu özellikler, modelin kullanıcı adına birden fazla işlem yürüttüğü ajan tabanlı görevlerde özellikle önem kazanıyor. Kullanıcı onayı olmadan görevi sürdürme eğilimi, GPT-6.1 Astra’nın askıya alınmasına yol açan temel endişelerden biri olmuştu.
GPT-6.1 Sol’e kimler erişebiliyor?
GPT-6.1 Sol, duyurulduğu gün ChatGPT Work ve Codex platformlarında belirli ücretli ve kurumsal kullanıcı gruplarına açıldı. Plus, Pro, Business, Enterprise ve Edu aboneleri yeni modele erişebiliyor. Erişim, modelin duyuruyla birlikte bu planlar kapsamında sunulduğu anlamına geliyor; ücretsiz kullanıcılar için kullanılabilirlik konusunda ise bir bilgi paylaşılmadı.
GPT-6.1 Sol’ün konumu, OpenAI’ın model ailesinde maliyet ve performans arasında bir denge aradığını gösteriyor. GPT-6 Sol’e göre daha gelişmiş görev yetenekleri sunan model, GPT-6 Astra’ya yakın sonuçları daha düşük token maliyetiyle hedefliyor. Bununla birlikte GPT-6.1 Astra’nın güvenlik gerekçesiyle askıya alınması, yüksek performanslı modellerin yalnızca doğruluk ölçümleriyle değil, kullanıcı talimatlarına ve izin sınırlarına ne kadar bağlı kaldıklarıyla da değerlendirildiğini ortaya koyuyor.
Günün zaman çizelgesi
Haber eklenme saatine göre sıralanır.
- Dün
- Audible, yapay zekâ destekli interaktif hikâyeleri duyurdu
- Kena: Scars of Kosmora’nın çıkışı 2027’ye ertelendi
- Google Gemini Live, küçük yazıları okuyabilecek
- Android Central ekibi işten çıkarıldı, yayınlar sürecek
- Apple’ın HomePad ürünü için çıkış tarihi iddiası gündemde
- Google’ın uzay veri merkezleri için 1.800 Starship uçuşu gerekebilir
- ChatGPT, kıyafetleri üzerinizde sanal olarak deneyecek
- Steam Deck 2 için AMD Gainsborough umudu güçleniyor
- ROKETSAN TAYFUN için Rize’de yeni test atışı yaptı
- Apple, iPhone Duo’nun Katlanır Ekran Katmanını Değiştirecek
- Fervo Energy’nin jeotermal santrali 23 ayda devrede
- Diablo 4’te Sezon 15 hatası düzeltilmeyecek
- OpenAI, üç güvenlik araştırmacısıyla yollarını ayırdı
- Grok for Intune, kurumsal iPhone kullanıcılarına sunuldu