Reklam
Teknoloji

Anthropic'in GLM-5.3 raporu: Açık ağırlıklı modelde siber istismar yeteneği

Anthropic, 29 Eylül 2026 tarihli raporunda Zhipu AI'ın açık ağırlıklı GLM-5.3 modelinin uçtan uca siber istismar geliştirebildiğini ve anlamlı koruma olmadan yayımlandığını yazdı.

Anthropic'in GLM-5.3 raporu: Açık ağırlıklı modelde siber istismar yeteneği

Anthropic, 29 Eylül 2026 tarihli araştırma yazısında Zhipu AI'ın (Z.ai) açık ağırlıklı GLM-5.3 modelinin uçtan uca siber istismar geliştirebildiğini, ancak anlamlı kötüye kullanım korumaları olmadan yayımlandığını bildirdi.

Bu sayfa Anthropic'in kendi yazısına dayanır. Anthropic bu alanda rakip bir model geliştiricisidir ve karşılaştırmaları kendi ölçümüdür; sonuçlar bağımsız bir kuruluşça doğrulanmamıştır. Sayfada saldırıya yönelik teknik ayrıntı yer almaz.

Künye

  • Rapor: "GLM-5.3 and the spread of advanced cyber capabilities"
  • Yayım tarihi: 29 Eylül 2026 (sayfa 30 Eylül 2026'da güncellendi)
  • Model: GLM-5.3, Zhipu AI (Z.ai), açık ağırlıklı
  • ExploitBench (Chrome V8): 410 denemenin 50'sinde başarı
  • İkili istismar testi: Yüzde 4
  • Önceki sürüm GLM-5.2: İki testte de yüzde 0

Rapor ne söylüyor?

Anthropic'in özet cümlesi şöyle: GLM-5.3 uçtan uca siber istismar geliştirebiliyor, ancak diğer öncü modellerden farklı olarak anlamlı güvenlik önlemleri olmadan yayımlandı. Şirket modelin kötü niyetli kişilere, kısıtlama olmaksızın güvenlik açıklarını bulma ve istismar etme yeteneği kazandıracağını düşünüyor.

Yapay zekâ modellerinin bu tür riskleri konusunda sektör çapında başlatılan güvenlik girişimlerini Nvidia'nın açık ajan güvenlik platformu sayfamızda anlattık.

Sayılar nasıl okunmalı?

ÖlçümRapordaki değer
ExploitBench (Chrome V8 motorundaki bilinen açıklar)410 denemenin 50'sinde uçtan uca istismar
İkili istismar değerlendirmesiYüzde 4
GLM-5.2 (önceki sürüm)Her iki testte yüzde 0

Dolaşan bir yanlış: "410 istismar yazdı, 50'si çalıştı." Raporda 410 deneme sayısıdır; 50 başarılı sonuç bu denemelerden çıkmıştır.

Koruma testi: "atlatma" değil, "yanıt verme" oranı

Anthropic, modelin açıkça kötü niyetli bir siber isteğe reddetmeden yanıt verme oranını dört koşulda ölçtü: doğrudan istekte yüzde 0, sahte bir kapak hikâyesiyle yüzde 64, önceden doldurulmuş akıl yürütmeyle yüzde 92 ve model ağırlıkları düzenlendiğinde (abliterasyon) yüzde 100. Anthropic test ettiği Claude modellerinin tüm koşullarda yüzde 0 olduğunu bildiriyor.

Bu nedenle "yüzde 64 ile 100 arası atlatma oranı" ifadesi eksiktir: oranlar üç ayrı yöntemi ve bir de doğrudan istek koşulunu anlatır, ölçülen şey "yanıt verme"dir.

Sınırlamalar ve öneriler

Anthropic simülasyonların "gerçek dünya koşullarının kusursuz bir yansıması olmadığını" belirtiyor ve model tarafından üretilen kodun hiçbir zaman çalıştırılmadığını yazıyor. Şirket, hükümetlerin yetenekli yapay zekâ modellerinde güvenlik testi yapmasını, geliştiricilerin bu yetenekleri uygun şekilde korumasını ve insan siber savunucuların öncü modellere genişletilmiş erişim almasını öneriyor.

Bu Sayfada Ne Yok?

  • Z.ai'nin yanıtı yok. Anthropic'in sayfasında Z.ai'nin bir açıklaması bulunmuyor.
  • Teknik istismar ayrıntısı yok. Bu sayfa saldırı yöntemi anlatmaz.
  • Bağımsız doğrulama yok. Ölçümleri Anthropic yaptı; başka bir kuruluş tekrarlamadı.
  • Gerçek dünyada kötüye kullanım kaydı yok. Rapor simülasyon sonuçlarını anlatıyor.
  • Hükümet veya düzenleyici atfı yok. Sayfa herhangi bir kurum açıklamasına dayanmıyor.
  • Modelin ilk yayım günü yok. Bu sayfa yalnızca raporun tarihini aktarır.
  • Türkiye'ye özgü bir değerlendirme yok. Rapor ülke bazlı etki ölçmüyor.

Sık Sorulan Sorular

GLM-5.3 nedir?

Anthropic'in raporuna göre Zhipu AI (Z.ai) tarafından geliştirilen açık ağırlıklı bir yapay zekâ modeli.

Anthropic neyi uyardı?

GLM-5.3'ün uçtan uca siber istismar geliştirebildiğini ve anlamlı kötüye kullanım korumaları olmadan yayımlandığını bildirdi.

ExploitBench sonucu ne?

GLM-5.3 Chrome V8 motorundaki bilinen açıklar üzerinde 410 denemenin 50'sinde uçtan uca istismar geliştirdi.

Yüzde 64 ve yüzde 100 neyi ifade ediyor?

Modelin kötü niyetli bir siber isteğe reddetmeden yanıt verme oranı: sahte kapak hikâyesinde yüzde 64, model ağırlıkları düzenlendiğinde yüzde 100.

Rapor ne zaman yayımlandı?

29 Eylül 2026. Sayfa 30 Eylül 2026'da güncellendi.

Bu sonuçlar bağımsız olarak doğrulandı mı?

Hayır. Ölçümler Anthropic'e aittir ve bağımsız bir kuruluşça tekrarlandığı doğrulanmadı.

Kaynak: Anthropic araştırma sayfası, "GLM-5.3 and the spread of advanced cyber capabilities" (29 Eylül 2026'da yayımlandı, 30 Eylül 2026'da güncellendi). Z.ai'nin yanıtı sayfada bulunmadığı için yazılmamıştır. Sonuçlar Anthropic'in kendi ölçümüdür; teknik istismar ayrıntıları bilinçli olarak aktarılmamıştır.

Yorumlar (0)

Henüz yorum yok. İlk yorumu siz yapın.

Yorum Yap