ModelChorusModelChorus
WyzwanieCzatRankingPrzesuńBenchmarki
Jak to działaAPIWarunki korzystania z usługiPolityka prywatności

Prawa autorskie 2026 MeetKai Inc.

Benchmarki/Functionary Swahili Large/French (France) zadań

Functionary Swahili Large

3 zadań

Każdy poniższy wiersz to jedno zadanie benchmarkowe, na którym oceniano ten model. Kolumna Wynik przedstawia średnią ze wszystkich metryk zadania (dokładność, F1, dokładne dopasowanie itp.). Kliknij wiersz, aby przejrzeć poszczególne pytania i odpowiedzi modelu.

Średnia
76.8
WynikJęzykZadanieMetryki
90.9French (France)
french_sib200
french classification
f1_macro: 90.9sample_len: 204.0
f1_macro: 90.9sample_len: 204.0
72.0French (France)
french_mgsm
french math
exact_match: 72.0sample_len: 250.0
exact_match: 72.0sample_len: 250.0
67.5French (France)
french_fquad
french qa
exact_match: 57.0f1: 77.9sample_len: 400.0
exact_match: 57.0f1: 77.9sample_len: 400.0