ModelChorusModelChorus
WyzwanieCzatRankingPrzesuńBenchmarki
Jak to działaAPIWarunki korzystania z usługiPolityka prywatności

Prawa autorskie 2026 MeetKai Inc.

Benchmarki/GLM 5/english_mmlu_pro

english_mmlu_pro

GLM 5 · english mmlu pro · English (US) · 2100 próbek

Każdy wiersz na liście to jedno pytanie z benchmarku. Ikona znacznika lub krzyżyka pokazuje, czy odpowiedź modelu była zgodna z oczekiwaną. Kliknij wiersz, aby przeczytać pełny prompt, oczekiwaną odpowiedź i to, co model faktycznie wygenerował.

exact_match
50.6
sample_len
2100.0
Średnia
50.6
Wczytywanie próbek…