GLM-5.2 Memuncaki Tolok Ukur Fine-Tuning; Penulis Tolok Ukur Membantah Klaim Distilasi Claude
Menurut Beating, model open-source GLM-5.2 baru-baru ini menduduki puncak benchmark fine-tuning PostTrainBench, yang menuai kritik dari scaling01 atas keraguan tentang nilai praktisnya dan lonjakan peringkat yang tidak biasa. Namun, penulis benchmark Maksym Andriushchenko mengklarifikasi setelah meninjau log GLM-5.2 bahwa model tersebut tidak menunjukkan tanda-tanda imitasi atau distilasi Claude; pengumpulan data, kombinasi strategi, dan jalur pengambilan keputusannya secara fundamental berbeda
GateNews·07-06 06:13



