ModelChorusModelChorus
WyzwanieCzatRankingPrzesuńBenchmarki
Jak to działaAPIWarunki korzystania z usługiPolityka prywatności

Prawa autorskie 2026 MeetKai Inc.

Benchmarki/GLM 5/Swahili (Tanzania) zadań

GLM 5

3 zadań

Każdy poniższy wiersz to jedno zadanie benchmarkowe, na którym oceniano ten model. Kolumna Wynik przedstawia średnią ze wszystkich metryk zadania (dokładność, F1, dokładne dopasowanie itp.). Kliknij wiersz, aby przejrzeć poszczególne pytania i odpowiedzi modelu.

Średnia
79.4
WynikJęzykZadanieMetryki
87.3Swahili (Tanzania)
swahili_sib200
swahili classification
f1_macro: 87.3sample_len: 204.0
f1_macro: 87.3sample_len: 204.0
80.8Swahili (Tanzania)
swahili_afrimgsm
swahili afrimgsm
exact_match: 80.8sample_len: 250.0
exact_match: 80.8sample_len: 250.0
70.1Swahili (Tanzania)
swahili_afrixnli
swahili nli
f1_macro: 70.1sample_len: 600.0
f1_macro: 70.1sample_len: 600.0