ModelChorusModelChorus
DesafioConversaTabela de classificaçãoDeslizarBenchmarksHistórico
Como funcionaAPITermos de serviçoPolítica de privacidade

Direitos de autor 2026 MeetKai Inc.

Benchmarks/GLM 5/ifeval

ifeval

GLM 5 · ifeval · English (US) · 0 amostras

Cada linha da lista é uma pergunta do benchmark. O ícone de marca ou cruz indica se a resposta do modelo correspondeu ao alvo; clique numa linha para ler o pedido completo, a resposta esperada e o que o modelo realmente produziu.

inst_level_loose_acc
45.0
inst_level_strict_acc
43.0
prompt_level_loose_acc
29.8
prompt_level_strict_acc
27.5
sample_len
541.0
Média
36.3
Ainda não foram sincronizadas amostras por pergunta para esta tarefa.