Zhipus GLM-5.2 erreicht 22,8 % Genauigkeit auf ARC-AGI-2 und konkurriert mit GPT-5.5 Light Reasoning Version

Laut ARC Prize hat das GLM-5.2-Modell von Zhipu kürzlich die offizielle Verifizierung auf dem ARC-AGI-Benchmark bestanden. Auf ARC-AGI-2 erreichte GLM-5.2 eine Genauigkeit von 22,8 % bei durchschnittlichen Kosten von 0,25 US-Dollar pro Aufgabe, während es auf dem einfacheren ARC-AGI-1-Benchmark eine Genauigkeit von 77,0 % bei 0,19 US-Dollar pro Durchlauf erzielte.

Die Gesamtleistung von GLM-5.2 ist vergleichbar mit der von OpenAIs GPT-5.4 und GPT-5.5 im Modus mit geringem Reasoning-Aufwand. ARC-AGI wurde entwickelt, um AGI-Level-Reasoning-Fähigkeiten durch abstrakte Mustererkennungsaufgaben zu bewerten, die während des Trainings nie gesehen wurden.

Disclaimer: The information on this page may come from third-party sources and is for reference only. It does not represent the views or opinions of Gate and does not constitute any financial, investment, or legal advice. Virtual asset trading involves high risk. Please do not rely solely on the information on this page when making decisions. For details, see the Disclaimer.
Kommentieren
0/400
Keine Kommentare