Popüler#YapayZeka#SiberGüvenlik#ChatGPT#OpenAI#Gemini#Apple#iPhone#Android#Samsung#FidyeYazılımı#Veriİhlali#NVIDIA
Yapay Zeka

Anthropic, Claude Opus 5 ile Fable 5 Performansını Yarı Fiyata Sunuyor

3 saat önce1 dk okuma3 okunma

Anthropic, yeni amiral gemisi modeli Claude Opus 5 ile yapay zeka pazarındaki rekabeti kızıştırıyor. Şirket, yeni modelin kodlama ve bilgi işleme görevlerinde üst düzey sonuçlar verdiğini, aynı zamanda Fable 5 ile benzer bir performans seviyesini çok daha düşük maliyetle sunduğunu belirtiyor. Opus 5, Claude Max platformunda varsayılan model olarak yer alırken, Claude Pro kullanıcıları için de en yetenekli seçenek haline geldi.

Anthropic, Opus 5'in kendi çalışmalarını denetleyip yinelemeli olarak iyileştirebildiğini vurguluyor. Örneğin, bir makine parçasının 3D modelini oluşturma görevinde, doğrudan görseli görememesine rağmen kendi bilgisayarlı görü hattını yazarak parçayı başarıyla yeniden inşa ettiği belirtiliyor. Ayrıca, popüler bir paket yöneticisindeki karmaşık bir hatayı, topluluk tarafından hazırlanan yamaların gözden kaçırdığı bir durumu düzelterek çözmesi, modelin teknik yetkinliğini kanıtlayan örnekler arasında gösteriliyor.

Frontier-Bench v0.1 testlerinde ajan tabanlı terminal kodlamasında %43,3 başarı oranına ulaşan Opus 5; Fable 5, GPT-5.6 Sol ve önceki sürüm Opus 4.8'i geride bırakıyor. ARC-AGI-3 testinde ise %30,2'lik skorla rakiplerine kıyasla ciddi bir fark atıyor. Ancak model her alanda lider değil; DeepSWE v1.1 kodlama testlerinde GPT-5.6 Sol'un gerisinde kalırken, sağlık ve hukuk alanındaki bazı spesifik görevlerde Fable 5 ve Mythos 5 daha iyi performans sergiliyor.

Anthropic, Opus 5'in siber güvenlik filtrelerinin Fable 5'e göre %85 daha az tetiklendiğini ifade ediyor. Model, kaynak kodu zayıflık araştırmalarına izin verirken, ikili tabanlı taramaları ve exploit üretimini engellemeye devam ediyor. Fiyatlandırma tarafında ise Opus 4.8 ile aynı olan 1 milyon girdi token başına 5 dolar, çıktı token başına 25 dolar ücretlendirme korunuyor. Kullanıcılar, düşük ve yüksek performans ayarları arasında seçim yaparak maliyet ve hız dengesini yönetebiliyor; ancak en yüksek performans ayarı olan 'max' seviyesinin, bazı testlerde bir alt seviyeden daha düşük sonuçlar verebildiği gözlemleniyor.

TeknoHQ'yu Google'da tercih edilen kaynak olarak ekleyin
Kaynak: The Decoder