DeepSeek'in Performansı Dört Katına Çarparak, Opus'u Bir Yedinci ile Eşitleyen Doğrulama Döngüsü
Araştırmacılar, DeepSeek kodlama ajanının doğrulama döngüsünün etkisini incelemiş. Döngü, DeepSeek'in ölçülen zekâsını dört katına çıkardı. Döngüden sonra, DeepSeek'in performansı Opus modelinin performansı ile eşlendi.
Araştırmacılar, DeepSeek kodlama ajanının doğrulama döngüsünün etkisini incelemiş. Döngü, DeepSeek'in ölçülen zekâsını dört katına çıkardı. Döngüden sonra, DeepSeek'in performansı Opus modelinin performansı ile eşlendi. Artan DeepSeek, bu eşitlemeyi, yalnızca bir yedinci ile daha az bilgisayar kaynağı kullanarak gerçekleştirdi. Bu maliyet azaltması, döngünün verifikasyon adımlarını verimli bir şekilde yeniden kullanabilmesinden kaynaklanıyor. Bu sonuç, doğrulama döngülerinin AI verimliliğini artırmaya potansiyelini vurguluyor. Ayrıca, daha düşük maliyetli modellerin daha büyük ve daha pahalı sistemlerle rekabet edebileceğini de gösteriyor. Gelecek çalışmalarda, bu teknolojiyi diğer AI ajanlarına ölçeklendirilebilecek mi diye incelenebilir.