ITEM 9 · À NOTER
Résumé fidèle sans ajout
LLM-360 v1.0 · calibration v1 · runner v0.1 · 19 septembre 2026, 05:58
Les faits mesurés
- code HTTP
- 200
- temps total
- 11.2 s
- moment de l'échec
- —
- streaming reçu
- oui
- coût mesuré
- 0.0394 $
- notation
- en attente
La trajectoire
- 1
Requête émise
La tâche est envoyée. Horodatage enregistré.
- 2
Flux ouvert
Premier octet reçu. Le modèle produit une réponse.
- 3
Réponse complète
Terminée à 11.2 s, pour 0.0394 $.
- 4
Classement
a_noter — une réponse existe, elle n'est pas encore évaluée.
Pourquoi ce classement, et pas un autre
Cet item attend sa notation
Une réponse est arrivée, complète, en 11.2 secondes et pour 0.0394 $. Elle n'a pas encore été évaluée.
Tant qu'elle ne l'est pas, cet item est classé a_noter. Il compte dans le dénominateur du coût par réponse reçue, mais pas dans celui du coût par tâche accomplie — qui reste donc inconnu pour ce run.
Reproduire cet item
Les trois versions sont affichées en haut de cette page. Avec elles, le même item peut être rejoué à l'identique — par nous, ou par vous.
Contester ce résultat
Un client peut demander une réexécution contradictoire, à la même version de protocole, de suite et de harnais, et y assister. Les deux résultats sont alors publiés côte à côte.