ModelChorusModelChorus
HamonChatLeaderboardSwipeMga BenchmarkKasaysayan
Paano ito gumaganaAPIMga Tuntunin ng SerbisyoPatakaran sa Privacy

Copyright 2026 MeetKai Inc.

Mga Benchmark/GPT-oss-120B/ifeval

ifeval

GPT-oss-120B · ifeval · English (US) · 0 mga sample

Ang bawat row sa listahan ay isang tanong mula sa benchmark. Ipinapakita ng check o cross icon kung nakatugma ang sagot ng modelo sa target; i-click ang isang row para basahin ang buong prompt, inaasahang sagot, at kung ano talaga ang ginawa ng modelo.

inst_level_loose_acc
56.0
inst_level_strict_acc
45.8
prompt_level_loose_acc
44.0
prompt_level_strict_acc
31.6
sample_len
541.0
Average
44.3
Wala pang na-sync na mga sample bawat tanong para sa gawaing ito.