Teknoloji

GLM-5.3’ün siber yetenekleri güvenlik tartışması başlattı

GLM-5.3’ün siber yetenekleri güvenlik tartışması başlattı
Haberleri Kaçırma! Teknoblog'u Google Arama'da tercihli kaynağın yap ve En Çok Okunan Haberler'de bizi daha sık gör.
Tercihli Kaynak Ekle

Anthropic, Z.ai’nin açık ağırlıklı GLM-5.3 yapay zekâ modelini siber güvenlik görevlerinde sınadı ve bazı kontrollü testlerde yazılım açıklarından yararlanabildiğini bildirdi. Şirketin 29 Eylül tarihli araştırması, modelin güvenlik önlemlerinin farklı koşullarda aşılabildiği iddiasını da içeriyor. Teknoblog’da daha önce gelişmiş yapay zekâ modellerinin güvenlik testlerini ele almıştık. Yeni rapor, özellikle herkesin indirip değiştirebildiği güçlü modellerin nasıl değerlendirileceği sorusunu öne çıkarıyor.

Anthropic’in kullandığı ExploitBench ölçümünde GLM-5.3, bilinen tarayıcı kusurlarına ilişkin 410 denemenin 50’sinde baştan sona çalışan bir istismar zinciri kurdu. Aynı koşullardaki Claude Mythos Preview 56 başarılı denemeye ulaştı. Bu sonuçlar gerçek internette 50 başarılı saldırı gerçekleştiği anlamına gelmiyor; modeller, araştırmacıların hazırladığı izole hedeflerde denendi. Yüzdeler de bütün yazılımlara genellenebilecek bir başarı olasılığı değil, belirli testlerin sonucu.

Şirket, başka bir deneyde uzman araştırmacıların model yardımıyla daha önce bilinmeyen bazı güvenlik açıkları bulduğunu belirtiyor. Ayrıntıların sorumlu bildirim kapsamında ilgili yazılım sahiplerine iletildiğini söylüyor. Raporda açıkların teknik uygulama adımları paylaşılmıyor. Bunun yanında Anthropic, doğrudan zararlı isteklerde modelin çoğu zaman ret verdiğini, fakat bazı test düzenlerinde bu korumanın zayıfladığını iddia ediyor.

NIST değerlendirmesi tabloya ne ekliyor?

ABD Ulusal Standartlar ve Teknoloji Enstitüsü’nün 17 Eylül tarihli bağımsız değerlendirmesi, GLM-5.3’ü o tarihte yayımlanmış en yüksek siber yetenekli açık ağırlıklı model olarak nitelendirdi. Kurumun toplu ölçümüne göre model, değerlendirdiği ABD kaynaklı en ileri modellerin yaklaşık dört ay gerisindeydi. Bu karşılaştırmada bazı ABD modellerinin yalnızca denetlenmiş kullanıcılara açık sürümleri yer aldı ve güvenlik kısıtları test sırasında kapatıldı. Dolayısıyla sonuç günlük kullanımda hangi sistemin daha tehlikeli olduğunu tek başına söylemiyor.

Açık ağırlık, modelin parametrelerinin indirilebilmesi ve farklı ortamlarda çalıştırılabilmesi anlamına geliyor. Bu yapı bağımsız araştırma ve savunma çalışmaları için yarar sağlayabilir. Öte yandan merkezi bir hizmette uygulanan erişim kurallarının indirilen her kopyada aynı biçimde korunması güç. Anthropic’in asıl uyarısı da modelin yeteneği ile bu dağıtım biçiminin birleşmesinden kaynaklanıyor.

Günün Öne Çıkan Fırsatları

Dyson WashG1 sert zemin temizleyici sepette 16.019,10 TL
Dyson WashG1 sert zemin temizleyici sepette 16.019,10 TL
Satın Al
Harman Kardon Enchant Sub için sepette 1.226,78 TL indirim
Harman Kardon Enchant Sub için sepette 1.226,78 TL indirim
Satın Al
Bosch BCS712XXL çift bataryalı süpürge sepette 18.900 TL
Bosch BCS712XXL çift bataryalı süpürge sepette 18.900 TL
Satın Al
Soundcore Q11i kulaklık sepette 2.490 TL
Soundcore Q11i kulaklık sepette 2.490 TL
Satın Al
Intouch 20.000 mAh powerbank Premium ile 799 TL
Intouch 20.000 mAh powerbank Premium ile 799 TL
Satın Al
Lenovo B515 15,6 inç dizüstü çantası Premium ile 525,36 TL
Lenovo B515 15,6 inç dizüstü çantası Premium ile 525,36 TL
Satın Al
Tümünü Gör Daralt
Tüm Fırsatları Gör

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.

Raporu değerlendirirken şirketin aynı alanda ürün geliştiren bir rakip olduğunu göz ardı etmemek gerekiyor. NIST verisi kapasite artışını destekliyor, fakat Anthropic’in bütün güvenlik ve politika önerilerini bağımsız olarak doğrulamıyor. Savunma ekipleri açısından pratik sonuç, yeni modellerin gerçek sistemlere bağlanmadan önce kendi koşullarında sınanması ve erişim yetkilerinin sınırlandırılması. Son kullanıcı açısından ise bu araştırma, GLM-5.3 kullanan her uygulamanın güvensiz olduğu biçiminde bir hüküm vermiyor.

Teknoblog artık WhatsApp'taGünün en iyi teknoloji fırsatları ve kaçırmamanız gereken büyük haberler, telefonunuza gelsin.
Kanala Katıl