ModelChorusModelChorus
WyzwanieCzatRankingPrzesuńBenchmarki
Jak to działaAPIWarunki korzystania z usługiPolityka prywatności

Prawa autorskie 2026 MeetKai Inc.

Benchmarki/GPT-5 Nano/ifeval

ifeval

GPT-5 Nano · ifeval · English (US) · 0 próbek

Każdy wiersz na liście to jedno pytanie z benchmarku. Ikona znacznika lub krzyżyka pokazuje, czy odpowiedź modelu była zgodna z oczekiwaną. Kliknij wiersz, aby przeczytać pełny prompt, oczekiwaną odpowiedź i to, co model faktycznie wygenerował.

inst_level_loose_acc
39.3
inst_level_strict_acc
38.5
prompt_level_loose_acc
26.6
prompt_level_strict_acc
25.7
sample_len
541.0
Średnia
32.5
Nie zsynchronizowano jeszcze żadnych próbek dla poszczególnych pytań tego zadania.