Anthropic, Claude Haiku 5.5 modelini yüksek hacimli yapay zekâ görevlerine yönelik yeni küçük model olarak kullanıma sundu düşük giriş fiyatına rağmen daha yüksek token tüketimiyle dikkat çeken performans ortaya koydu. Model, 100 bin tokene kadar olan istemlerde milyon giriş tokenı başına 0,10 dolar, çıkış tokenı başına 0,50 dolar ücretlendirirken daha uzun istemlerde fiyatlar sırasıyla 0,50 dolar 2,50 dolara yükseliyor. Anthropic, Haiku 5.5’in önceki nesil Haiku 4.5’e kıyasla ortalama yüzde 75 daha düşük çalıştırma maliyeti sunduğunu belirtirken bağımsız testler görev başına tüketilen token sayısının belirgin şekilde arttığını gösteriyor.
Claude Haiku 5.5 Daha Düşük Fiyatla Daha Yüksek Performans SunuyorAnthropic, yeni modeli özetleme, sınıflandırma yüksek hacimli API görevleri gibi sürekli çalıştırılan iş yükleri için konumlandırıyor. Şirket, Claude Haiku 5.5 modelini şimdiye kadarki en hızlı, en ucuz en yetenekli küçük modeli olarak tanımlarken önceki nesle göre özellikle bilgisayar kullanımı yapay zekâ ajanlarının kodlama görevlerinde büyük ilerlemeler sağladığını belirtiyor.
Modelin fiyatlandırması iki ayrı katmandan oluşuyor. 100 bin tokene kadar olan istemler için milyon giriş tokenı başına 0,10 dolar, milyon çıkış tokenı başına 0,50 dolar ücret uygulanırken 100 bin token sınırının üzerindeki istemlerde fiyatlar 0,50 dolar giriş 2,50 dolar çıkış seviyesine çıkıyor.
Anthropic’in sunduğu alt fiyat kademesi, OpenAI’nin GPT-6 Luna modeli için belirtilen standart giriş çıkış token fiyatlarıyla aynı seviyede bulunuyor. Şirket ise Haiku 5.5’in önceki Haiku 4.5’e kıyasla ortalama yüzde 75 daha düşük çalıştırma maliyetine sahip olduğunu savunuyor.
Anthropic’in tığı sonuçlar, yeni modelin farklı yapay zekâ görevlerinde önceki nesle göre belirgin performans artışı sağladığını gösteriyor. Haiku 5.5, verilen altı karşılaştırmanın tamamında GPT-6 Luna’nın üzerinde sonuç alırken özellikle bilgisayar kullanımı ajan tabanlı kodlama testlerinde daha yüksek skorlar elde ediyor.
BenchmarkClaude Haiku 5.5Claude Haiku 4.5GPT-6 LunaGDPval-AA v2.116207351437AA-Briefcase v1.115786141336OSWorld 2.1%72,4%15,7%48,9Terminal-Bench 4.0%39,2%0%16,4FrontierCode 1.1%46,4—%42,4Chartography%46,4%6,4%29,1Haiku 5.5’in özellikle OSWorld 2.1 sonucundaki yüzde 72,4’lük performansı, bilgisayar üzerinde doğrudan işlem gerçekleştiren yapay zekâ ajanları açısından öne çıkıyor. Terminal-Bench 4.0 testinde yüzde 39,2’lik skor alan model, önceki Haiku 4.5’ün sıfır puanlık sonucuna kıyasla belirgin ilerleme sergiliyor.
Artificial Analysis tarafından yapılan bağımsız testler, modelin yüksek benchmark skorlarının daha fazla hesaplama token tüketimiyle geldiğini ortaya koyuyor. Claude Haiku 5.5’in maksimum çalışma ayarındaki Intelligence Index skoru 43 olurken GPT-6 Luna aynı ölçümde 38 puan alıyor.
Artificial Analysis ÖlçümüClaude Haiku 5.5GPT-6 LunaIntelligence Index4338Görev başına ortalama çıkış tokenı162 bin50 binGörev başına ortalama akıl yürütme tokenı129 bin39 binGörev başına ortalama maliyet0,21 dolar0,07 dolarÇıkış hızı243 token/sn128 token/snGörev başına ortalama süre427 saniye390 saniyeHaiku 5.5, karşılaştırmada GPT-6 Luna’ya kıyasla yaklaşık 3,5 kat daha fazla çıkış tokenı üretiyor. Modelin akıl yürütme sırasında kullandığı token sayısı yaklaşık 3,5 kat daha yüksek seviyeye ulaşırken görev başına ortalama maliyet 0,21 dolara çıkıyor.
Modelin saniyede 243 tokenlık çıkış hızı GPT-6 Luna’nın 128 tokenlık hızını aşmasına rağmen daha yüksek token tüketimi toplam işlem süresini artırıyor. Sonuçlar, token başına fiyatın tek başına yapay zekâ API maliyetini değerlendirmek için yeterli olmadığını gösterirken görev başına tüketim miktarı doğrudan maliyet hesabına dahil oluyor.
Anthropic, yeni modelin Haiku 4.5’e kıyasla güvenlik tarafında geliştirmeler içerdiğini belirtiyor. Şirket, modelin uyumsuz davranış örneklerini azaltırken potansiyel olarak zararlı taleplere uyma eğilimini düşürdüğünü ifade ediyor.
Yüksek hacimli yapay zekâ uygulamalarında güvenlik performansı, modelin yalnızca doğru yanıt üretmesinden daha geniş değerlendirme alanı oluşturuyor. Anthropic’in yaklaşımı, Claude Haiku 5.5’i geliştirici uygulamalarında sürekli çalışan özetleme, sınıflandırma ajan görevleri için daha kontrollü seçenek haline getirmeyi hedefliyor.
Anthropic, Haiku 5.5 duyurusuyla birlikte Claude Max Team aboneleri için aylık API kredilerini açıkladı. Max 5x aboneleri aylık 100 dolar, Max 20x aboneleri 200 dolar kredi alırken Team aboneleri ortak kullanım için 500 dolara kadar kredi elde edecek.
Aboneler söz konusu kredileri Anthropic’in farklı modelleri üzerinden uygulama yapay zekâ ajanı geliştirmek için kullanabilecek. Yeni kredi sistemi, özellikle API üzerinden yüksek hacimli deneyler gerçekleştiren geliştiricilerin model maliyetlerini abonelik kapsamında yönetmesine yardımcı olacak.
Claude Haiku 5.5, Anthropic Platformunun yanı sıra Amazon Web Services, Google Cloud Microsoft Azure üzerinden kullanılabiliyor. Modelin farklı bulut platformlarına aynı dönemde açılması, Anthropic’in küçük modelini kurumsal yapay zekâ uygulamalarında daha geniş geliştirici kitlesine ulaştırma stratejisini destekliyor.
Claude Haiku 5.5’in ortaya koyduğu tablo, yapay zekâ model fiyatlandırmasında yalnızca milyon token başına ücretin dikkate alınmaması gerektiğini gösteriyor. Geliştiricilerin gerçek uygulamalarda modelin görev başına kaç token kullandığını, ne kadar sürede sonuç verdiğini toplam işlem maliyetini birlikte değerlendirmesi gerekecek; Anthropic’in yeni modeli yüksek performans karşılığında daha yoğun hesaplama tüketen küçük modellerin yeni örneğini oluşturuyor.