Trusence Her iddianın bir kaynağı var
Son güncelleme: 4 Ekim 2026 Ara English
← Tüm haberler
Güvenlik

Anthropic, Zhipu AI’nin GLM-5.3 modelinde güvenlik açıkları buldu

Anthropic, GLM-5.3’ün zararlı içerik üretebildiğini ve korumalarının aşılabildiğini söyledi.

Anthropic, Zhipu AI’nin GLM-5.3 modelinde yeni güvenlik başarısızlıkları tespit ettiğini bildirdi. Şirkete göre model zararlı içerik üretebiliyor ve güvenlik önlemleri prompt hileleriyle ya da korumaları kaldırıldığında aşılabiliyor. Bu değerlendirme, açık ağırlıklı Çin yapımı modellerde jailbreak ve model erişiminin siber kötüye kullanıma nasıl dönüşebildiğini yeniden gündeme getirdi.

Anthropic’in testlerinde GLM-5.3, 410 çalıştırmada 50 başarılı uçtan uca exploit zinciri üretti. Şirket ayrıca modelin tam control-flow hijack benchmark’ında yüzde 4 puan aldığını, Mythos’un ise 410 denemede 56 başarılı sonuç ve yüzde 6 skor kaydettiğini söyledi. GLM-5.3-Flash varyantının zincirleme exploit geliştirme maliyetinin token bazında 20.40 dolar olduğu da belirtildi.

Anthropic, abliteration uygulandığında ret oranlarının GLM-5.3 için yüzde 6’ya, GLM-5.3-Flash için yüzde 14’e düştüğünü aktardı. Şirket, bunu ölçekte yapmanın pahalı olduğunu ve ciddi miktarda kiralık GPU kapasitesi gerektireceğini de söyledi.

Neden önemli

Bu bulgular, açık ağırlıklı modellerde güvenlik katmanlarının atlatılabildiğini ve bunun siber istismar üretimini kolaylaştırabildiğini gösteriyor. Geliştiriciler için mesele artık yalnızca modelin ne kadar güçlü olduğu değil, aynı zamanda korumaların ne kadar kolay devre dışı bırakılabildiği. Bu da model değerlendirmelerinde güvenlik testlerinin ve saldırı senaryolarının daha merkezi hale geldiğine işaret ediyor.

Kaynaklar

  • Tom's Hardware
  • BBC Technology