ModelChorusModelChorus
DéfiChatClassementBalayerBenchmarksHistorique
Comment ça marcheAPIConditions d'utilisationPolitique de confidentialité

Droits d'auteur 2026 MeetKai Inc.

Benchmarks/GPT-oss-120B/ifeval

ifeval

GPT-oss-120B · ifeval · English (US) · 0 échantillons

Chaque ligne de la liste correspond à une question du benchmark. L'icône coche ou croix indique si la réponse du modèle correspondait à la cible ; cliquez sur une ligne pour lire le prompt complet, la réponse attendue, et ce que le modèle a effectivement produit.

inst_level_loose_acc
56.0
inst_level_strict_acc
45.8
prompt_level_loose_acc
44.0
prompt_level_strict_acc
31.6
sample_len
541.0
Moyenne
44.3
Aucun échantillon par question n'a encore été synchronisé pour cette tâche.