Yapay zeka dünyasında son günlerde dikkat çeken Jev, ChatGPT, Claude veya Gemini gibi kullanıcılarla sohbet eden bir model değil. TypeSafe AI tarafından geliştirilen Jev; bir müşteri talebinin hangi departmana gönderileceği, bir işlemin güvenli olup olmadığı ya da bir yapay zeka ajanının sonraki adımının ne olması gerektiği gibi konularda doğrudan seçim, puan ve olasılık üretiyor.
Modelin arkasındaki TypeSafe AI’ın kurucularından Diogo Almeida, daha önce OpenAI’da çalıştı ve ChatGPT’nin geliştirilme sürecinde kullanılan insan geri bildirimli pekiştirmeli öğrenme (RLHF) çalışmalarında yer aldı. Almeida daha sonra Erik Gafni ve Sasha Sheng ile TypeSafe’i kurdu.
Şirket, iki yıllık gizli çalışma döneminin ardından Jev’i 15 Eylül’de tanıtırken 40 milyon dolarlık yatırım aldığını da açıkladı.
CÜMLE KURMAK YERİNE KARAR VERİYOR
Jev’in temel farkı, serbest metin üretmek yerine yazılımların kullanabileceği yapılandırılmış kararlar üretmesi.
Örneğin bir müşteri, “Kartımdan iki kez para çekildi” şeklinde bir mesaj gönderdiğinde klasik bir dil modeli bunun faturalandırma birimine aktarılması gerektiğini metinle açıklayabilir. Jev ise yazılıma doğrudan “faturalandırma”, “teknik destek” veya “satış” seçenekleri için olasılık değerleri sunabiliyor.
Böylece yazılımın, yapay zekanın ürettiği metni yeniden okuyup anlamlandırmasına ve kullanılabilir verilere dönüştürmesine gerek kalmıyor. TypeSafe bu yaklaşımı “System One Model” olarak adlandırıyor ve modelin özellikle yazılım otomasyonu için geliştirildiğini belirtiyor.
HIZ VE MALİYET İDDİASI
Şirketin verilerine göre Jev’in yanıt süresi yaklaşık 70 ila 500 milisaniye arasında değişiyor. Modelin fiyatı ise bir milyon girdi tokenı için 0,042 dolar olarak açıklanıyor; çıktı için ayrıca ücret alınmıyor.
TypeSafe, bazı görevlerde Jev’in geleneksel büyük dil modellerine kıyasla onlarca, hatta yüzlerce kat hız ve maliyet avantajı sağladığını öne sürüyor.
Ancak bu performans rakamlarının önemli bölümü şirketin kendi testlerine dayanıyor. Dolayısıyla söz konusu avantajların henüz kapsamlı bağımsız değerlendirmelerle doğrulanmadığına dikkat çekiliyor.
GELİŞTİRİCİLERDEN YOĞUN İLGİ
Jev’in piyasaya sürülmesinin ardından geliştiricilerin ilgisi de dikkat çekti.
TechCrunch’ın aktardığına göre talep bir noktada şirketin API üzerinden hizmet verme kapasitesini geçici olarak aşarken, geliştiriciler modeli sınıflandırma, güvenlik kontrolleri ve yapay zeka ajanlarının yönlendirilmesi gibi alanlarda denemeye başladı.
VentureBeat’in aktardığı şirket verilerine göre Jev’in kullanıma açılmasının ardından 36 saat içinde yaklaşık 140 bin kişi bekleme listesinden sisteme alındı.
Cloudflare, LangChain ve Langfuse gibi yazılım şirketleri de kısa süre içinde Jev için entegrasyonlar geliştirdi.
“HALÜSİNASYON YOK” İDDİASINA DİKKAT
TypeSafe, Jev’in serbest metin üretmemesi ve seçeneklerin önceden tanımlanması nedeniyle klasik dil modellerindeki “halüsinasyon” sorununu ortadan kaldırdığını savunuyor.
Ancak bu, modelin yanlış karar veremeyeceği anlamına gelmiyor. Jev var olmayan bir cevap üretmese bile mevcut seçeneklerden yanlış olanına yüksek olasılık verebilir.
İlk güvenlik testleri de başka bir riske işaret ediyor. TypeSafe’in kendi belgeleri ve Pydantic’in entegrasyon uyarılarına göre, modele verilen metnin içine yerleştirilen yönlendirici veya kötü niyetli ifadeler Jev’in kararlarını etkileyebiliyor.
Bu nedenle modelin özellikle güvenlik açısından kritik işlemlerde tek başına karar mekanizması olarak kullanılmaması öneriliyor.
YAPAY ZEKA GÖRÜNMEZ HALE Mİ GELECEK?
Jev’in yapay zekanın geleceğini değiştirip değiştirmeyeceğini söylemek için henüz erken. Ancak modelin gördüğü ilgi, yapay zekanın kullanım biçiminde farklı bir yönelimin öne çıkabileceğini gösteriyor.
Geleceğin yapay zeka modellerinin tamamı insanlarla konuşmak zorunda olmayabilir. Bazıları kullanıcıların karşısına hiç çıkmadan, yazılımların arka planında milyonlarca küçük karar vermek için çalışabilir.
Kaynak: Birgün
