Yazılım dünyasında yeni dönem: Ajan maliyetlerini yüzde 45 düşüren Claude Fable 5.1 tanıtıldı

Yazılım dünyasında yeni dönem: Ajan maliyetlerini yüzde 45 düşüren Claude Fable 5.1 tanıtıldı

Anthropic, karmaşık kodlama ve bilimsel araştırmalara odaklanan Claude Fable 5.1 ile Claude Mythos 5.1 sürümlerini duyurdu. Yeni modeller, önbellek okuma fiyatındaki büyük indirimle otonom ajan maliyetini yüzde 45 oranında azaltırken, rakiplerin kopyalama girişimlerine karşı yeni savunma kalkanları sunuyor.

Teknoloji dünyasında yapay zeka rekabeti hız kazanırken, Amerika Birleşik Devletleri (ABD) merkezli yapay zeka şirketi Anthropic, kodlama ve bilimsel araştırmalara odaklanan Claude Fable 5.1 ile Claude Mythos 5.1 modellerini kullanıma sundu.

Şirket, özellikle karmaşık mantık yürütme süreçleri ile uzun süreli problem çözme aşamalarında fark oluşturan iki yeni sürümü küresel pazarla buluşturdu.

Tanıtılan yeni sistemler, önceki Fable 5 nesline kıyasla operasyonel performansı yukarı taşırken, otonom yazılım ajanlarının çalışma maliyetlerinde belirgin bir düşüş sağladı.

Geliştirici ekip, yeni model ailesiyle birlikte rakiplerin yürüttüğü model kopyalama operasyonlarına karşı kapsamlı güvenlik kalkanlarını ilk kez devreye aldı.

anthropic-yeni-modeli-nedir-fiyati-ne-kadar-3.jpg

AYNI TEMEL MODEL İKİ FARKLI GÜVENLİK ZIRHIYLA ÇALIŞIYOR

Anthropic tarafından paylaşılan teknik detaylara göre, Claude Fable 5.1 ile Claude Mythos 5.1 aslında birebir aynı temel yapay zeka modelini kullanıyor.

Sistemlerin ayrıştığı tek nokta, kullanıcı gruplarına uygulanan güvenlik protokollerinde kendisini gösteriyor.

Fable 5.1 genel kullanıcı kitlesine ve kurumsal şirketlere açık bir yapı sunuyor.

Buna karşılık Mythos 5.1 sürümü, siber güvenlik uzmanları ve yaşam bilimleri araştırmacıları gibi özel doğrulama programlarından geçen yetkili isimlere hitap ediyor.

Hassas alanlarda kötüye kullanımı önlemek amacıyla Fable 5.1 üzerinde tutulan sıkı kısıtlamalar, Mythos 5.1 modelinde bilimsel araştırmaların önünü açmak için çok daha esnek kurallarla yönetiliyor.

ÖNBELLEK HAMLESİYLE AJAN MALİYETİ YÜZDE 45 GERİLEDİ

Claude Fable 5.1 modelinin teknoloji dünyasında en fazla ses getiren yanı fiyatlandırma politikasında saklanıyor.

Anthropic, girdi ve çıktı token ücretlerinde Fable 5 seviyesini korudu.

Uygulama Programlama Arayüzü (API) üzerinden sunulan modelde, 1 milyon girdi tokenı için 10 dolar, 1 milyon çıktı tokenı için ise 50 dolar talep ediliyor.

Ancak şirket, önbellekten okuma maliyetinde tarihi bir indirime imza atarak yüzde 75 oranında kesintiye gitti.

Önbellek okuma bedeli 1 milyon token başına 0,25 dolara çekildi.

Bu köklü fiyat hamlesi, standart iş yüklerinde yüzde 25 tasarruf sağlarken, uzun bağlam ve çoklu araç çağıran yoğun ajan görevlerinde toplam maliyeti yüzde 45 seviyesine kadar düşürüyor.

anthropic-yeni-modeli-nedir-fiyati-ne-kadar-2.jpg

İŞLEM SEVİYELERİ KULLANIM PLATFORMUNA GÖRE DAĞILIYOR

Yeni nesil Fable 5.1 sürümü, düşük veya orta düzeydeki işlem güçlerinde bile önceki model olan Fable 5 ile benzer ya da daha üstün bir çalışma grafiği ortaya koyuyor.

Şirket, modelin entegre edildiği servislerde işlem seviyelerini optimize etti.

Kod yazımı için geliştirilen Claude Code platformunda sistem varsayılan olarak en yüksek işlem kapasitesiyle görev yapıyor.

Buna karşılık ekip çalışmasına odaklanan Claude Cowork ve genel kullanıcı arayüzü Claude.ai servislerinde ise kaynak tüketimini dengeleyen orta işlem seviyesi tercih ediliyor.

BİLİM VE KODLAMA TESTLERİNDE SKORLAR İKİYE KATLANDI

Teknoloji şirketinin kamuoyuyla paylaştığı kıyaslama testleri, akademik ve teknik kulvarda yaşanan büyük sıçramayı belgeliyor.

Terminal-Bench-Science 0.1 adlı bilimsel araştırma testinde önceki model Fable 5 yalnızca yüzde 24,7 oranında kalırken, yeni Fable 5.1 puanını yüzde 52,6 seviyesine çıkardı.

Benzer bir başarı yazılım geliştirme alanında da yankı buldu.

Terminal-Bench 4.0 kodlama testinde Fable 5.1 yüzde 55,8 puan alarak Fable 5 modelinin yüzde 42 seviyesindeki skorunu geride bıraktı.

Siber güvenlik esnekliğine sahip Mythos 5.1 ise aynı kodlama testinde yüzde 60,9 seviyesine tırmanarak zirveye yerleşti.

anthropic-yeni-modeli-nedir-fiyati-ne-kadar-1.jpg

MİLYONDA BİR GÖRÜLEN YAZILIM HATASINI ÇÖZDÜ

Anthropic mühendisleri, Fable 5.1 modelinin karmaşık problemlere yaklaşımında köklü bir zihniyet değişimini benimsediğini vurguladı.

Şirket yetkilileri, modelin sorunları ele alış biçimini anlatırken, "Fable 5.1 bir problemi çözmeye çalışırken kısa yollara başvurmak yerine temel nedeni bulmaya daha fazla odaklanıyor" ifadesini kullandı.

Bu yeteneğin en somut kanıtı finans sektöründe yaşandı.

Küresel yatırım şirketi Millennium bünyesinde yıllardır varlığını sürdüren ve yaklaşık her bir milyon çalıştırmada sadece bir kez meydana gelen gizemli bir yazılım hatası, Fable 5.1 tarafından derinlemesine incelenerek çözüme kavuşturuldu.

VENÜS HARİTASINDAN PROTEİN TASARIMINA UZANAN BAŞARI

Bilimsel keşiflerde çıtayı yukarı koyan model ailesi, uzay araştırmalarından biyolojiye kadar geniş bir alanda pratik sonuçlar verdi.

Fable 5.1, Ulusal Havacılık ve Uzay Dairesi (NASA) tarafından yürütülen tarihi Magellan görevine ait radar verilerini işledi.

Yapay zeka, Venüs gezegeninin yaklaşık üçte birini kapsayan, önceki çalışmalara kıyasla çok daha ayrıntılı ve yüksek çözünürlüklü yeni bir yükseklik haritasını başarıyla çıkardı.

Biyoloji kulvarına odaklanan Mythos 5.1 ise protein tasarımı ile hesaplamalı biyoloji testlerinde olağan dışı sonuçlar elde etti.

Model, yedi açık kaynaklı derin öğrenme algoritmasında geliştirdiği Grafik İşlem Birimi (GPU) optimizasyonları sayesinde hesaplama hızını tam 2,5 kat seviyesine çıkardı.

24 BİN SAHTE HESABIN MODEL DAMITMA PLANI BOZULDU

Yeni sürümlerle birlikte yapay zeka casusluğuna karşı tarihi bir savunma mekanizması kuruldu.

Gelişmiş sistemlerin çıktılarını toplayarak kendi algoritmalarını eğitmeye çalışan rakiplere karşı model damıtma engelleri hayata geçti.

Anthropic, geçmiş dönemde DeepSeek, Moonshot AI ve MiniMax bağlantılı 24 bin sahte hesap üzerinden 16 milyondan fazla Claude etkileşiminin çekildiğini duyurdu.

Geliştirici ekip, yeni API düzenlemesiyle kullanıcıların çok turlu bir konuşmada Claude'un önceki düşünme kayıtlarını korurken konuşmanın geçmiş bağlamını elle değiştirmesine izin vermiyor.

Kamuoyuna yansıyan model kopyalama yöntemlerinden birini kapatan bu kısıtlama, şimdilik yeni açılan API hesaplarında uygulanıyor ancak ilerleyen süreçte tüm hesaplara yayılması planlanıyor.

DEV BULUT SİSTEMLERİNDE KULLANIMA AÇILDI

Farklı güvenlik politikalarıyla ayrışan Claude Mythos 5.1, siber güvenlik ile yaşam bilimleri alanında teyit edilmiş uzmanlara kontrollü şekilde ulaşıyor.

Yaşam bilimleri erişim programı Amerika Birleşik Devletleri hükümetiyle ortaklaşa yürütülürken, yazılımlardaki açıkları denetleyen Claude Security altyapısı da Mythos 5.1 gücüne geçti.

Genel kullanıma hitap eden Claude Fable 5.1 ise claude-fable-5-1 kimliğiyle Claude platformunun yanı sıra Amazon Web Servisleri (AWS), Google Cloud ve Microsoft Azure bulut sistemlerinde küresel erişime açıldı.

Mythos 5.1 erişimi ise şimdilik doğrulanmış siber güvenlik ve yaşam bilimleri kullanıcılarıyla sınırlı kalıyor.

YORUMLAR
YORUM YAZ
İÇERİK VE ONAY KURALLARI: KARAR Gazetesi yorum sütunları ifade hürriyetinin kullanımı için vardır. Sayfalarımız, temel insan haklarına, hukuka, inanca ve farklı fikirlere saygı temelinde ve demokratik değerler çerçevesinde yazılan yorumlara açıktır. Yorumların içerik ve imla kalitesi gazete kadar okurların da sorumluluğundadır. Hakaret, küfür, rencide edici cümleler veya imalar, imla kuralları ile yazılmamış, Türkçe karakter kullanılmayan ve büyük harflerle yazılmış yorumlar içeriğine bakılmaksızın onaylanmamaktadır. Özensizce belirlenmiş kullanıcı adlarıyla gönderilen veya haber ve yazının bağlamının dışında yazılan yorumlar da içeriğine bakılmaksızın onaylanmamaktadır.
Diğer Haberler
Son Dakika Haberleri
KARAR.COM’DAN