Sakana AI’nın Fugu Ultra v1.1 Sürümü, Son Güncellemede Fable 5'i Geride Bırakıyor

Sakana AI, kritik teknik kıyaslama testlerinde (benchmark) devasa performans artışları sağladığını iddia ederek akıllı model yönlendiricisi (router) Fugu Ultra v1.1 için önemli bir güncelleme yayınladı. Bu güncelleme, üst düzey akıl yürütme ve kodlama yeteneklerine ulaşmak amacıyla sorguların en iyi modellere nasıl dağıtılacağını iyileştirmeye yönelik stratejik bir girişimi temsil ediyor.

Kıyaslama Testlerini Altüst Ediyor: Fugu Ultra v1.1 Avantajı

Fugu Ultra v1.1'in temel inovasyonu, verilen herhangi bir istem (prompt) için halka açık LLM havuzundan en uygun modeli seçen yönlendirme zekasında yatıyor. Sakana AI, bu sürümün ilk v1.0 sürümüne kıyasla 7,9 puana kadar performans artışı sağladığını bildiriyor.

En dikkat çekici olanı, yönlendiricinin özellikle ProgramBench ve TerminalBench 2.1 kıyaslama testlerinde uzmanlaşmış teknik değerlendirmelerde önemli sıçramalar göstermesidir. Sakana, çarpıcı bir iddiada bulunarak Fugu Ultra v1.1'in, Fable 5 yönlendiricinin seçim havuzunda yer almamasına rağmen, çoğu kıyaslama testinde Anthropic'in Fable 5 modelini geride bıraktığını öne sürüyor. Bu sonuçlar şu an için bağımsız bir üçüncü taraf doğrulamasına sahip olmasa da, yönlendirme mantığının mevcut model mimarilerinden en yüksek performansı çıkarma konusunda oldukça verimli hale geldiğini gösteriyor.

Teknik Mimari ve Geliştirici Entegrasyonu

Sakana'nın en güncel model havuzunu koruma yaklaşımı oldukça titizdir; şirket, yeni bir üst düzey modelin Fugu ekosistemine resmi olarak entegre edilmeden önce yaklaşık iki haftalık özel bir eğitim ve değerlendirme sürecinden geçmesi gerektiğini belirtiyor. Bu, yönlendiricinin karar verme sürecinin piyasadaki en yeni ağırlıklar (weights) ve yetenekler için optimize edilmiş kalmasını sağlıyor.

Geliştiriciler için bu güncelleme, kullanıcıların Fugu'yu doğrudan terminallerinden çağırmalarına olanak tanıyan yeni bir Claude Code-uyumlu uç nokta (endpoint) sunuyor. Bu entegrasyon, üst düzey akıl yürütme ve terminal tabanlı otomasyona ihtiyaç duyan mühendisler için iş akışlarını kolaylaştırıyor. Bu teknik ilerlemelere rağmen fiyatlandırma önceki sürümle aynı kalıyor: milyon giriş token'ı başına 5 $ ve milyon çıkış token'ı başına 30 $. Fugu'ya şu anda OpenRouter ve Vercel dahil olmak üzere başlıca platformlar üzerinden erişilebiliyor.

Pazar Zorlukları ve Düzenlemelerle Başa Çıkma

Bu sürüm, ilk Fugu lansmanının ardından gelen inceleme döneminin ardından yayınlandı. İlk eleştirmenler; yüksek token tüketimi, gecikme süresi (latency) ve tutarsız sonuçlar gibi sorunlara dikkat çekmişti. Sakana, v1.1 ile geliştirici güvenini yeniden kazanmak için verimliliğe ve özel görev performansına daha fazla odaklanıyor gibi görünüyor.

Ancak, coğrafi kısıtlamalar küresel benimseme için bir engel olmaya devam ediyor. Sakana AI, GDPR ve diğer AB'ye özgü düzenleyici çerçevelerle ilgili karmaşıklıkları gerekçe göstererek şu anda Avrupa Birliği (AB) veya Avrupa Ekonomik Alanı (AEA) içindeki kullanıcılara hizmet vermiyor. "Model yönlendirici" kategorisi büyüdükçe, Sakana'nın bu performans iddialarını şeffaf ve doğrulanabilir verilerle kanıtlama yeteneği, rekabetçi yapay zeka ortamındaki sürdürülebilirliğinin nihai testi olacaktır.

Önemli Çıkarımlar

  • Üstün Kıyaslama Performansı: Fugu Ultra v1.1, v1.0'a göre 7,9 puanlık bir iyileşme gösteriyor ve Fable 5 yönlendiricinin havuzunda yer almamasına rağmen birkaç metrikte Anthropic'in Fable 5 modelini belirgin şekilde geride bırakıyor.
  • Geliştirici Odaklı Güncellemeler: Yeni sürüm, kodlama iş akışları için daha kolay entegrasyon sağlayan Claude Code-uyumlu bir terminal uç noktası ekliyor.
  • Titiz Kürasyon: Sakana, yüksek doğruluk ve performansı korumak için yönlendiriciye eklenen her yeni model için iki haftalık bir değerlendirme döngüsü uyguluyor.