ModelChorusModelChorus
DesafioConversaTabela de classificaçãoDeslizarBenchmarksHistórico
Como funcionaAPITermos de serviçoPolítica de privacidade

Direitos de autor 2026 MeetKai Inc.

Benchmarks/GPT-5 Nano/English (US) tarefas

GPT-5 Nano

5 tarefas

Cada linha abaixo é uma única tarefa de benchmark em que este modelo foi avaliado. A coluna Pontuação calcula a média de todas as métricas que a tarefa reporta (precisão, F1, correspondência exata, etc.). Clique numa linha para explorar as perguntas individuais e as respostas do modelo.

Média
63.9
PontuaçãoIdiomaTarefaMétricas
87.3English (US)
english_gsm8k
english math
exact_match: 87.3sample_len: 1319.0
exact_match: 87.3sample_len: 1319.0
87.2English (US)
english_mgsm
english math
exact_match: 87.2sample_len: 250.0
exact_match: 87.2sample_len: 250.0
61.6English (US)
english_mmlu_pro
english mmlu pro
exact_match: 61.6sample_len: 2100.0
exact_match: 61.6sample_len: 2100.0
51.2English (US)
english_belebele
english mcq
f1_macro: 51.2sample_len: 900.0
f1_macro: 51.2sample_len: 900.0
32.5English (US)
ifeval
ifeval
inst_level_loose_acc: 39.3inst_level_strict_acc: 38.5prompt_level_loose_acc: 26.6prompt_level_strict_acc: 25.7sample_len: 541.0
inst_level_loose_acc: 39.3inst_level_strict_acc: 38.5prompt_level_loose_acc: 26.6prompt_level_strict_acc: 25.7sample_len: 541.0