OpenAI, Jev benzeri Decisions API ile ajanları izleyecek
SanalData’yı Google’da tercih edilen kaynak olarak ekleyinOpenAI, geliştiricilerin yapay zekâ modellerini belirli seçenekler arasında hızlı karar vermek için kullanabileceği Decisions API’yi sınırlı ön izlemeye açtı. API, otonom ajanların davranışlarını daha düşük maliyetle denetlemek için de kullanılabilir.
OpenAI, geliştiricilerin yapay zekâ modellerine belirli seçenekler arasından seçim yaptırmasını sağlayan Decisions API’yi duyurdu. Şirketin geliştirici etkinliğinde tanıtılan API, büyük dil modellerinin her görevde uzun yanıtlar üretmesi yerine sınıflandırma ve davranış seçimi gibi daha dar kararları hızlı biçimde vermeyi hedefliyor.
Decisions API’nin işlevleri, TypeSafe AI tarafından daha önce tanıtılan Jev adlı modele benziyor. Jev, yazılım otomasyonu için tasarlanmış, geliştiricilerin önceden belirlediği seçenekleri olasılıklarla değerlendiren bir model olarak konumlanıyor. OpenAI’nin çözümünün Jev ile ne ölçüde aynı teknik yaklaşımı kullandığı ise henüz net değil. Bunun nedeni, API’nin şu anda sınırlı ön izleme aşamasında bulunması ve gerçek kullanım performansının yeterince test edilmemiş olması.
Decisions API nasıl çalışıyor?
OpenAI CEO’su Sam Altman, API’nin şirketin Luna modeline önceden tanımlanmış seçenekler arasından tercih yaptırabileceğini belirtti. Bu seçenekler, bir görselin hangi kategoriye ait olduğunun belirlenmesinden bir yapay zekâ ajanının hangi davranışı sergilemesi gerektiğine kadar uzanabiliyor.
Modelin yalnızca belirli bir seçime odaklanması, yanıt üretim süresini ve işlem maliyetini azaltmayı amaçlıyor. Buna karşın görsel anlama, farklı dillerle çalışma ve güvenlik korumaları gibi yeteneklerin korunması hedefleniyor. Klasik bir büyük dil modelinin her isteği uzun biçimde değerlendirmesi gereken senaryolarda, daha küçük ve odaklanmış bir karar katmanı pratik bir alternatif sunabilir.
Bu yaklaşımın temel avantajı, büyük dil modellerinin her işlem için kullanılmasının her zaman verimli olmaması. Yazılım otomasyonunda bazı görevler karmaşık muhakeme gerektirmiyor; bir eylemi sınıflandırmak, izin vermek ya da incelemeye göndermek gibi kararlar daha hızlı çalışan özel modellerle gerçekleştirilebiliyor.
Yapay zekâ ajanlarının güvenliği için kullanılabilir
Decisions API’nin en dikkat çekici kullanım alanlarından biri, internette işlem yapan yapay zekâ ajanlarını izlemek olabilir. Ajanların yanlış komutlar vermesi veya görev tanımının dışına çıkması, geliştiriciler açısından önemli bir güvenlik riski oluşturuyor. OpenAI, bu tür davranışları izlemek için ayrı bir model kullanan güvenlik yaklaşımından söz etmişti. Ancak bu yöntemin yüksek işlem gücü gerektirebildiği belirtiliyor.
siber güvenlik uzmanı Shapor Naghibzadeh, Jev kullanarak bir ajanın her eylemini verilen görevle karşılaştıran bir demo geliştirdi. Bu sistem, kötü olduğu konusunda yüksek güven bulunan eylemleri engelliyor, daha belirsiz işlemleri incelemeye gönderiyor ve uygun görülen adımlara izin veriyor.
Paylaşılan örnekte, bu tür bir izleme altyapısının bir ajanın her eyleminde çalıştırılabileceği savunuluyor. Jev ile yapılan izleme işleminin maliyeti 2,94 dolar olarak hesaplanırken, aynı iş için sınırdaki büyük bir dil modeli kullanıldığında maliyetin 372 dolara çıkabildiği aktarılıyor. Bu karşılaştırma, karar modellerinin yalnızca hız değil, sürekli güvenlik denetimi açısından da değer taşıyabileceğini gösteriyor.
Performans kadar doğruluk da belirleyici olacak
Hızlı ve düşük maliyetli sonuç üretmek, bu modellerin tek başına başarılı olacağı anlamına gelmiyor. Asıl soru, modelin verdiği olasılıkların gerçek dünyadaki sonuçlarla ne kadar uyumlu olduğu. Yanlış bir eylemi onaylamak ya da güvenli bir işlemi engellemek, özellikle otonom ajanlarda ciddi sorunlara yol açabilir.
TypeSafe AI, Jev’in karar doğruluğunda sentetik verilerle oluşturduğu istatistiksel çıktılara güveniyor. Şirketin yöneticisi Diogo Almeida, düşük maliyet ve yüksek hızın tek başına yeterli olmadığını; asıl zor kısmın dolar başına düşen zekâyı artırmak olduğunu savunuyor.
OpenAI’nin Decisions API’si henüz sınırlı ön izleme aşamasında olduğu için geliştiricilerin gerçek projelerde elde edeceği sonuçlar bilinmiyor. Ayrıca piyasada Jev benzeri modeller geliştiren başka girişimler de bulunuyor. Bu nedenle rekabetin yalnızca modelin ne kadar hızlı çalıştığı üzerinden değil, kararlarının ne kadar isabetli ve güvenilir olduğu üzerinden şekillenmesi bekleniyor.
Günün zaman çizelgesi
Haber eklenme saatine göre sıralanır.
- Dün
- Factory CEO’su, danışmanını Cognition’a bilgi sızdırmakla suçladı
- Apple Music dört ülkede daha kullanıma sunuldu
- Romantik Anime Önerileri: Aşk, Komedi ve Dramı Birleştiren 6 Yapım
- DoorDash, drone teslimatına önce yerden başladı
- iPhone 18 Pro için en iyi aksesuarlar ve şarj seçenekleri
- Meta’nın yapay zekâ asistanı Muse, 5 milyon indirmeyi geçti
- Threads Hesap Silme ve Devre Dışı Bırakma Rehberi
- ABD ordusunun milyonlarca personel verisi çalındı
- iPhone True Tone Nedir, Ne İşe Yarar ve Nasıl Açılır?
- Apple gündeminde HomePad, iPhone Duo ve John Ternus var
- Türk Telekom Cayma Bedeli Nasıl Öğrenilir? Sorgulama Rehberi
- OpenAI, Jev benzeri Decisions API ile ajanları izleyecek Bu haber
- BMW’nin elektrikli 3 Serisi, benzinliden 4.400 dolar ucuz
- iOS 27.2, Mesajlar uygulamasına pratik bir özellik getiriyor