ModelChorusModelChorus
DéfiChatClassementBalayerBenchmarksHistorique
Comment ça marcheAPIConditions d'utilisationPolitique de confidentialité

Droits d'auteur 2026 MeetKai Inc.

Benchmarks/Functionary Swahili Large/urdu_uquad

urdu_uquad

Functionary Swahili Large · urdu qa · Urdu (Pakistan) · 0 échantillons

Chaque ligne de la liste correspond à une question du benchmark. L'icône coche ou croix indique si la réponse du modèle correspondait à la cible ; cliquez sur une ligne pour lire le prompt complet, la réponse attendue, et ce que le modèle a effectivement produit.

llm_judge_score
79.1
sample_len
139.0
Moyenne
79.1
Aucun échantillon par question n'a encore été synchronisé pour cette tâche.