Anthropic, haziran ayında erişimini durdurduğu Claude Fable 5 modelini yeniden küresel olarak kullanıma sunacağını açıkladı. ABD hükümetinin talimatı sonrasında askıya alınan model, yeni güvenlik önlemleriyle kademeli şekilde tekrar erişime açılacak. Claude Fable 5, güncellenen koruma mekanizmaları sayesinde ilk etapta kontrollü biçimde dağıtılırken bazı görevler geçici olarak farklı modellere yönlendirilecek.

Yeni Güvenlik Katmanları Modelin Davranışını Değiştiriyor

Anthropic, Fable 5’in yeniden yayınlanması öncesinde modele riskli siber güvenlik faaliyetlerini tespit edip engelleyen yeni sınıflandırıcılar eklediğini duyurdu. Şirket, değişikliklerin özellikle kötüye kullanım senaryolarını sınırlandırmayı hedeflediğini belirtirken modelin güvenli kullanım alanlarını korumaya odaklandığını ifade. Şirket ayrıca kod yazma hata ayıklama gibi bazı rutin görevlerin geçici süreyle Opus 4.8 modeline devredildiğini açıkladı. Böylece güvenlik filtreleri geliştirilmeye devam ederken kullanıcı deneyiminde oluşabilecek kesintilerin azaltılması amaçlanıyor. Yapay zekâ güvenlik önlemleri, geçiş sürecinin merkezinde yer alıyor.

Anthropic, yalnızca kendi modellerini güncellemekle yetinmiyor. Şirket, yapay zekâ kaynaklı siber güvenlik risklerini değerlendirebilmek amacıyla Amazon, Microsoft Google’ın yer aldığı ortak çalışma grubu oluşturduğunu açıkladı. Hazırlanan ortak çerçeve, gelişmiş yapay zekâ modellerinin oluşturabileceği siber risklerin nasıl ölçüleceği, hangi eşiklerde ek güvenlik kontrollerinin uygulanacağı sektör genelinde ortak değerlendirme kriterlerinin nasıl oluşturulacağı üzerine odaklanıyor. Yapay zekâ güvenlik modeli konusunda sektör genelinde ortak standart geliştirilmesi, üretken yapay zekâ platformlarının yaygınlaşmasıyla daha kritik hâle geliyor.

Anthropic, yeni dönemde ABD hükümetiyle yürüttüğü teknik iş birliğini genişleteceğini duyurdu. Şirket, yayın öncesinde gelişmiş modellerin daha kapsamlı testlerden geçirilmesini sağlayacak ortak değerlendirme süreçleri oluşturacağını açıkladı. kapsamda araştırma projelerine daha fazla ayrılması planlanırken model güvenliği alanındaki akademik çalışmaların destekleneceği bildirildi. Yapay zekâ risk değerlendirmesi süreçlerinin yalnızca şirket içinde değil kamu kurumlarıyla birlikte yürütülmesi, gelişmiş modeller için yeni denetim yaklaşımı olarak öne çıkıyor.

Anthropic, 12 Haziran’ ABD hükümetinden gelen talimat doğrultusunda Claude Fable 5 Claude Mythos 5 modellerinin yabancı kullanıcılara erişimini askıya almıştı. Şirket, geçen hafta Claude Mythos 5 modelini 100’den fazla ABD merkezli kamu kurumu kritik altyapı kuruluşuna yeniden açarken şimdi Fable 5 için küresel erişim sürecini başlatıyor. Şirketin attığı adım, gelişmiş yapay zekâ modellerinde yalnızca performansın değil güvenlik yönetişiminin ürün yaşam döngüsünün temel parçası hâline geldiğini gösteriyor. Önümüzdeki dönemde benzer güvenlik kontrollerinin büyük yapay zekâ platformlarında yaygınlaşması bekleniyor.