Neler yeni

Anthropic'ten yeni yapay zeka modelleri: Claude Fable 5.1 ve Claude Mythos 5.1

YapayZeka

Moderator
Moderator
Forum Üyesi
Üretici
Katılım
26 May 2026
Mesajlar
81
Tepkime puanı
0
Puanları
0
Aramıza Katıl! Tartışmalara katılmak ve konu açmak için üye ol.
Anthropic, kodlama, bilgi yoğun görevler ve uzun süreli problem çözme süreçlerine odaklanan yeni yapay zeka modelleri Claude Fable 5.1 ve Claude Mythos 5.1'i kullanıma sundu. Şirket, Fable 5.1'in önceki Fable 5 modeline kıyasla performansını artırırken özellikle ajan tabanlı iş yüklerinde maliyetleri önemli ölçüde düşürdüğünü belirtiyor. Ayrıca Anthropic, yeni modelle birlikte, rakiplerin gelişmiş modellerin yeteneklerini kopyalamasında kullanılan model damıtma yöntemlerine karşı yeni önlemler devreye alıyor.

Anthropic'e göre Claude Fable 5.1 ve Claude Mythos 5.1 aslında aynı temel yapay zeka modelini kullanıyor. İki model arasındaki temel fark ise güvenlik önlemlerinde ortaya çıkıyor. Fable 5.1 genel kullanıma sunulurken Mythos 5.1, siber güvenlik ve yaşam bilimleri gibi alanlarda çalışan ve Anthropic'in doğrulama programlarına kabul edilen kullanıcılar için daha esnek güvenlik kısıtlamalarıyla çalışıyor.

Ajan tabanlı görevlerde maliyet yüzde 45'e kadar düşebiliyor​


Claude Fable 5.1'in öne çıkan noktalarından biri maliyet tarafında. Modelin giriş ve çıkış token fiyatları Fable 5 ile aynı kalıyor. Buna göre model, API üzerinden 1 milyon girdi tokenı için 10 dolar, 1 milyon çıktı tokenı için ise 50 dolar fiyatlandırılıyor. Anthropic buna karşılık önbellekten yapılan okumaların fiyatını yüzde 75 düşürerek 1 milyon token başına 0,25 dolara çekti.

Şirket, bu değişiklik sayesinde tipik iş yüklerinde Fable 5'e kıyasla yaklaşık yüzde 25 maliyet avantajı sağlandığını belirtiyor. Çok sayıda araç çağrısı ve uzun bağlam kullanan yoğun ajan tabanlı görevlerde ise maliyet avantajının yaklaşık yüzde 45'e ulaşabileceği ifade ediliyor.

Anthropic, Fable 5.1'in düşük veya orta seviyede işlem gücü kullanıldığında da Fable 5 ile benzer veya daha yüksek performans gösterebildiğini ifade ediyor. Claude Code'da model varsayılan olarak yüksek işlem seviyesinde çalışırken Claude Cowork ve Claude.ai'da orta seviye kullanılıyor.

Kodlama ve bilimsel araştırma performansı arttı​


Şirketin paylaştığı benchmark sonuçlarında en dikkat çekici artışlardan biri bilimsel araştırma görevlerinde görülüyor. Fable 5.1, Terminal-Bench-Science 0.1 testinde yüzde 52,6 puan elde ederken Fable 5'in skoru yüzde 24,7 seviyesinde kalıyor.

Terminal-Bench 4.0 kodlama testinde ise Fable 5.1 yüzde 55,8 puan elde ediyor. Daha esnek siber güvenlik önlemlerine sahip Mythos 5.1'in aynı testteki skoru yüzde 60,9'a çıkıyor. Fable 5'in skoru ise yüzde 42 seviyesinde.

Uzun süreli görevler de modelin odaklandığı alanlar arasında. Anthropic, Fable 5.1'in bir problemi çözmeye çalışırken kısa yollara başvurmak yerine temel nedeni bulmaya daha fazla odaklandığını ifade ediyor. Şirketin paylaştığı örneklerden birinde yatırım şirketi Millennium'un sistemlerinde yıllardır açıklanamayan ve yaklaşık her bir milyon çalıştırmada bir ortaya çıkan nadir bir yazılım hatasının Fable 5.1 tarafından tespit edildiği belirtiliyor.

Yeni modelin bilimsel araştırmalardaki kullanımı da dikkat çekiyor. Anthropic'in aktardığına göre Fable 5.1, NASA'nın Magellan görevi tarafından toplanan radar görüntülerini kullanarak Venüs'ün yaklaşık üçte birini kapsayan yeni ve yüksek çözünürlüklü bir yükseklik haritası oluşturdu. Şirket, yeni haritanın önceki çalışmalara kıyasla daha ayrıntılı sonuçlar sunduğunu belirtiyor.

Mythos 5.1 ise protein tasarımı ve hesaplamalı biyoloji alanlarında test edildi. Anthropic'e göre model, yedi açık kaynaklı derin öğrenme modeline yönelik geliştirdiği GPU optimizasyonlarıyla bazı modellerin çalışma hızını 2,5 kata kadar artırdı.

Model damıtma saldırılarına karşı yeni önlemler​


Claude Fable 5.1 ile gelen dikkat çekici yeniliklerden biri de model damıtmayı zorlaştırmaya yönelik anti-distillation mekanizmaları oldu. Model damıtma, daha gelişmiş bir yapay zeka modelinin çıktılarının büyük ölçekte toplanarak başka bir modelin eğitilmesinde kullanılması anlamına geliyor. Anthropic'e göre bu tür operasyonlarda binlerce sahte hesap kullanılabiliyor ve gelişmiş modellerin sahip olduğu yetenekler, aynı güvenlik önlemleri olmadan başka modellere aktarılabiliyor.

Bu nedenle yeni oluşturulan Claude API hesaplarında önemli bir değişiklik devreye alındı. Kullanıcıların artık çok turlu bir konuşmada Claude'un önceki düşünme kayıtlarını korurken konuşmanın geçmiş bağlamını manuel olarak değiştirmesine izin verilmiyor. Anthropic, bunun kamuya açık olarak belgelenmiş model damıtma yöntemlerinden birinin önünü kapattığını ifade ediyor.

Anthropic daha önce yaklaşık 24 bin sahte hesap üzerinden gerçekleştirilen ve 16 milyondan fazla Claude etkileşimini kapsayan model damıtma faaliyetleri tespit ettiğini açıklamıştı. Şirket bu faaliyetlerle bağlantılı olarak DeepSeek, Moonshot AI ve MiniMax'in adını vermişti. Söz konusu yeni kısıtlama şimdilik yeni API hesaplarını etkiliyor. Mevcut hesaplar değişiklikten hemen etkilenmeyecek ancak Anthropic, gelecekte yayımlanacak modellerle birlikte bu yaklaşımın tüm hesaplara uygulanacağını belirtiyor.

Mythos 5.1, doğrulanmış kullanıcılara açılıyor​


Claude Mythos 5.1 ise Fable 5.1'in daha esnek güvenlik politikalarıyla sunulan versiyonu olarak konumlanıyor. Model özellikle siber güvenlik ve yaşam bilimlerinde profesyonel çalışmalar yürüten doğrulanmış kişi ve kuruluşları hedefliyor. Anthropic, Mythos 5.1'e erişimi Cyber Verification Program ve Life Sciences Verification Program üzerinden sağlamayı planlıyor. Yaşam bilimleri programı ABD hükümetiyle birlikte geliştirildi ve ilk katılımcılar programa dahil edildi. Anthropic'in kod tabanlarını güvenlik açıklarına karşı tarayan Claude Security ürünü de artık Mythos 5.1 tarafından destekleniyor.

Claude Fable 5.1 şu anda Claude'un kendi platformunun yanı sıra Amazon Web Services, Google Cloud ve Microsoft Azure üzerinden kullanılabiliyor. Geliştiriciler modele Claude API üzerinden claude-fable-5-1 adıyla erişebiliyor. Mythos 5.1'in erişimi ise şimdilik doğrulanmış siber güvenlik ve yaşam bilimleri kullanıcılarıyla sınırlı.
 

Konuyu görüntüleyenler

💡 En çok hangi alandaki konular ilginizi çekiyor?

  • Güncel Gündem & Haberler

  • Teknoloji & Yapay Zeka

  • Bilim, Kültür & Tarih

  • Eğlence, Magazin & Yaşam


Sonuçlar yalnızca oylamadan sonra görülebilir.
SON DAKİKA MAGAZİN

Magazin Dünyasının En Sıcak Gelişmeleri

Ünlüler, özel haberler, flaş iddialar ve gündeme damga vuran magazin gelişmeleri tek tıkla cebinizde.

Hemen Keşfet
🔥 FLAŞ MAGAZİN

Ünlüler Dünyasında Bugün Neler Yaşandı?

Dedikodular • Flaş Haberler • Özel Röportajlar

📸
🎬
Hemen Keşfet →
Genel Chat
Yardım Kullanıcılar
  • Şu an sohbet eden bulunmuyor.
    Sohbette mesaj yok. Bir Merhaba demek istermisiniz?
    Üst