Semgrep, GLM 5.2'nin Claude'u Güvenlik Özelliklerinde Geri Bırakıyor
Semgrep, AI modellerinin kod güvenliği görevlerinde performansını değerlendirmek için Cyber Benchmarks adlı bir ölçütü yayınladı.
Semgrep, AI modellerinin kod güvenliği görevlerinde performansını değerlendirmek için Cyber Benchmarks adlı bir ölçütü yayınladı.
Bu ölçüt, büyük dil modellerinin kaynak kodunda güvenlik açıklarını tanımlama yeteneklerini test eder.
Zhipu AI'den gelen GLM 5.2 modeli, Anthropic'in Claude modelinden daha yüksek puan aldı. Bu sonuçlar, açık ve ABD dışındaki modellerin özel güvenlik görevlerinde hızlı ilerlemeyi gösteriyor.
Semgrep'in ölçütleri, uygulama güvenliği topluluğu tarafından geniş olarak referans alınıyor. Bulgular, teknoloji alanındaki uzmanlaşmış güvenlik görevlerinde AI modelleri arasında büyüyen rekabeti vurguluyor.
Güvenlik takımları, kod incelemesi için hangi modelleri kullanacaklarını yeniden değerlendirmek zorunda kalabilir. Detaylı puanlar ve yöntem, Semgrep'in blog postsında mevcuttur.