ModelChorusModelChorus
DesafíoChatTabla de ClasificaciónDeslizarEvaluacionesHistorial
Cómo funcionaAPITérminos de servicioPolítica de privacidad

Derechos de autor 2026 MeetKai Inc.

Evaluaciones/GLM 5/ifeval

ifeval

GLM 5 · ifeval · English (US) · 0 muestras

Cada fila de la lista es una pregunta del benchmark. El icono de verificación o cruz indica si la respuesta del modelo coincidió con la esperada; haz clic para leer el mensaje completo, la respuesta esperada y lo que el modelo realmente produjo.

inst_level_loose_acc
45.0
inst_level_strict_acc
43.0
prompt_level_loose_acc
29.8
prompt_level_strict_acc
27.5
sample_len
541.0
Promedio
36.3
Aún no se han sincronizado muestras por pregunta para esta tarea.