ModelChorusModelChorus
WyzwanieCzatRankingPrzesuńBenchmarki
Jak to działaAPIWarunki korzystania z usługiPolityka prywatności

Prawa autorskie 2026 MeetKai Inc.

Benchmarki/GPT-5 Nano/Spanish (Spain) zadań

GPT-5 Nano

3 zadań

Każdy poniższy wiersz to jedno zadanie benchmarkowe, na którym oceniano ten model. Kolumna Wynik przedstawia średnią ze wszystkich metryk zadania (dokładność, F1, dokładne dopasowanie itp.). Kliknij wiersz, aby przejrzeć poszczególne pytania i odpowiedzi modelu.

Średnia
61.7
WynikJęzykZadanieMetryki
67.7Spanish (Spain)
spanish_xquad_es
spanish xquad es
exact_match: 57.1f1: 78.4sample_len: 1190.0
exact_match: 57.1f1: 78.4sample_len: 1190.0
61.0Spanish (Spain)
spanish_belebele
spanish mcq
f1_macro: 61.0sample_len: 900.0
f1_macro: 61.0sample_len: 900.0
56.5Spanish (Spain)
spanish_global_mmlu
spanish mcq
f1_macro: 56.5sample_len: 400.0
f1_macro: 56.5sample_len: 400.0