

Anthropic, yapay zeka dünyasında dengeleri değiştirecek yeni modeli Claude Opus 5.5'i resmen duyurdu. Şirketin 22 Eylül Salı günü yaptığı açıklamaya göre Opus 5.5, selefi Opus 5 ile aynı seviyede performans sunarken, tipik iş yüklerinde yaklaşık yüzde 40 daha düşük maliyetle çalışıyor. Bu hamle, Anthropic'in hem rekabetçi fiyatlandırma hem de güvenlik odaklı geliştirme stratejisini bir arada yürüttüğünü gösteriyor.
Anthropic'e göre Claude Opus 5.5, şirketin kendi kıyaslama paketinde ajan tabanlı kodlama, bilgisayar kullanımı ve bilgi işleri kategorilerinde lider konumda. 44 farklı mesleği kapsayan gerçek dünya iş senaryolarını test eden GDPval-AA v2.1'de Opus 5.5, 1.846 puan aldı. Aynı testte Claude Fable 5.1 1.735, Opus 5 ise 1.708 puan topladı. Bu sonuçlar, modelin özellikle karmaşık görevlerdeki yeteneklerini ortaya koyuyor.
Terminal-Bench 4.0 testinde ise Opus 5.5 yüzde 66,4 başarı oranı yakalarken, bu ay başında piyasaya sürülen OpenAI'ın GPT-6 Astra modeli yüzde 57,9'da kaldı. Ancak Astra, Terminal-Bench-Science 0.1 testinde yüzde 64,6 ile Opus 5.5'in yüzde 58,7'lik skorunun önüne geçmeyi başardı. Bu da rekabetin hala kıyasıya devam ettiğini gösteriyor.
Anthropic, Opus 5.5'in Opus 5'e göre yüzde 40 daha düşük işletme maliyeti sunduğunu açıkladı. Bu, özellikle kurumsal müşteriler ve yoğun yapay zeka kullanımı olan geliştiriciler için ciddi bir tasarruf anlamına geliyor. Şirket, önümüzdeki haftalarda Claude Sonnet 5.5 ve Claude Haiku 5.5 modellerini de kullanıma sunacağını duyurdu. Böylece Anthropic, farklı ihtiyaç ve bütçelere hitap eden geniş bir model ailesi oluşturmayı hedefliyor.
| Model | GDPval-AA v2.1 | Terminal-Bench 4.0 | Terminal-Bench-Science 0.1 |
|---|---|---|---|
| Claude Opus 5.5 | 1.846 | %66,4 | %58,7 |
| Claude Fable 5.1 | 1.735 | - | - |
| Claude Opus 5 | 1.708 | - | - |
| GPT-6 Astra | - | %57,9 | %64,6 |
Claude Opus 5.5, Anthropic CEO'su Dario Amodei'nin yapay zeka geliştirmeyi yavaşlatma çağrısından sonra yayınlanan ilk model olma özelliği taşıyor. Bu nedenle güvenlik önlemleri ayrı bir önem kazandı. Şirket, modelin piyasaya sürülmeden önce METR ve Frontier Design gibi bağımsız değerlendiriciler tarafından test edildiğini belirtti. Ayrıca Opus 5.5, Anthropic'in otomatik davranış denetiminde bugüne kadarki en iyi skoru elde etti.
Anthropic, bu seviyedeki yeteneklerde kıyaslama farklarının artık daha az güvenilir bir gösterge olduğu konusunda da uyardı. Şirkete göre Opus 5.5 ile Fable 5.1 arasındaki gerçek dünya farkı, puanların işaret ettiğinden daha dar. Ayrıca modelin, önceki sürümde sıkça dile getirilen bir şikayet olan yazma netliği konusunda da iyileştirildiği vurgulandı.
Claude Opus 5.5 şu an için küresel ölçekte kullanıma sunulmuş durumda. Türkiye'deki kullanıcılar ve kurumlar için özel bir fiyatlandırma veya bölgesel lansman takvimi henüz açıklanmadı. Ancak Anthropic'in bulut tabanlı erişim modeli sayesinde Türkiye'den de API ve arayüz üzerinden erişim mümkün olacak. Fiyatlandırmanın dolar bazlı olması nedeniyle yerel maliyetler kur dalgalanmalarından etkilenebilir.
Anthropic'in bu hamlesi, yapay zeka pazarında maliyet ve performans dengesini yeniden tanımlayabilir. Özellikle kodlama ve bilgi işleri odaklı ekipler için Opus 5.5, hem bütçe dostu hem de yüksek başarımlı bir seçenek olarak öne çıkıyor. Önümüzdeki haftalarda Sonnet 5.5 ve Haiku 5.5'in gelişiyle birlikte Anthropic'in ürün yelpazesi daha da genişleyecek ve rekabetin nasıl şekilleneceği merakla bekleniyor.
OpenAI ve Anthropic aynı gün yeni yüksek verimli modellerini tanıttı.
Henüz yorum yapılmamış. İlk yorumu sen yap!
E-posta adresiniz yayımlanmayacaktır. Gerekli alanlar (*) ile işaretlenmiştir.



