DGrid AI veröffentlicht das PoQ-Judge-Forschungs-paper und senkt die Kosten für die Bewertung der LLM-Qualität um 72%

Laut ChainCatcher hat DGrid AI heute seine neueste Forschungsarbeit „PoQ-Judge“ veröffentlicht. Dabei wurde ein Multi-Architektur-Qualitätsbewertungs-Framework vorgestellt, das die Notwendigkeit von Referenzantworten überflüssig macht. Das Framework erreichte auf gehaltenen Testsets eine Korrelation von 0,747 mit menschlichen Bewertungsscores und senkte die Bewertungskosten durch eine geschachtelte (kaskadierte) Bewertung sowie eine Online-Weight-Kalibrierung um über 72%. PoQ (Proof of Quality) ist DGrids proprietärer Konsensmechanismus, der auf Protokollebene verhindern soll, dass Modelle von geringer Qualität ausgerollt und Daten manipuliert werden.
Disclaimer: The information on this page may come from third-party sources and is for reference only. It does not represent the views or opinions of Gate and does not constitute any financial, investment, or legal advice. Virtual asset trading involves high risk. Please do not rely solely on the information on this page when making decisions. For details, see the Disclaimer.
Kommentieren
0/400
Keine Kommentare