5 — HERMES USAGE · efficacite reelle
Metrique reine du §12 : le cout par resultat accepte. Elle ne se remplace jamais par un cout par appel — un modele deux fois moins cher qui se fait refuser deux fois plus coute pareil, plus le temps perdu.
Cellules (agent x modele x route)
Grain impose par §28 : un modele servi par deux routes fait deux lignes — leurs couts et leurs quotas ne sont pas les memes. 40 cellule(s) affichee(s) sur 184, par volume d'appels.
Colonne attribution : part des appels de la cellule relies a un verdict. Un cout par resultat accepte calcule sur une attribution faible est vrai pour les travaux juges, pas pour la cellule entiere.
| Cellule | Appels | Tok in | Tok out | Cout chiffre | Attribution | Jugees | Taux d'acceptation | $/accepte | Etat de preuve | Pourquoi cet etat |
|---|---|---|---|---|---|---|---|---|---|---|
| nomadapp · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 121 481 | 195 758 767 | 93 840 908 | 82.73 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| nomadapp · deepseek-flash · deepseek · https://api.deepseek.com/v1 | 35 085 | 53 234 506 | 29 664 405 | 34.83 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| nomadapp · glm-5.2 · zai · https://api.z.ai/api/paas/v4 | 29 793 | 169 264 177 | 13 283 182 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| papi · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 3 603 | 25 635 979 | 2 675 965 | 6.64 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| codemaster · claude-opus-5 · anthropic · https://api.anthropic.com | 3 097 | 6 194 | 2 511 912 | 0.00 $ | 52.21 % | 13 | 100 % (n=13) IC95 77–100 % | — | PROVISIONAL | 13 unite(s) jugee(s) sur 30 requis en 30 j (classe medium) — signal utile, pas un rang |
| rnrj · deepseek-flash · deepseek · https://api.deepseek.com/v1 | 2 834 | 9 015 701 | 2 097 290 | 3.05 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| marketer · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 2 186 | 6 548 723 | 1 747 694 | 2.50 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| nomadapp · openai/gpt-4o-mini · openrouter · https://openrouter.ai/api/v1 | 2 093 | 4 494 495 | 220 255 | 2.30 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| neo · deepseek-flash · deepseek · https://api.deepseek.com/v1 | 2 066 | 3 285 187 | 1 791 573 | 2.06 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| bridge · deepseek-v4-flash · zai · https://api.z.ai/api/anthropic | 1 953 | 21 405 153 | 935 182 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| ianes · gpt-5.6-terra · openai-api · https://api.openai.com/v1 | 1 671 | 10 232 008 | 846 293 | 143.45 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| ianes · glm-5.2 · zai · https://api.z.ai/api/paas/v4 | 1 665 | 3 799 583 | 248 667 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| rnrj · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 1 659 | 7 090 485 | 2 236 349 | 2.37 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| ianes · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 1 527 | 3 743 304 | 1 307 307 | 1.27 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| neo · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 1 460 | 3 863 853 | 1 340 891 | 1.57 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| codemaster · deepseek-flash · deepseek · https://api.deepseek.com | 1 372 | 3 916 680 | 1 645 977 | 1.92 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| ianes · deepseek-flash · deepseek · https://api.deepseek.com/v1 | 1 283 | 2 190 114 | 1 007 919 | 1.23 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| nomadapp · deepseek-v4-flash · (route non renseignee) | 1 098 | 490 899 | 329 044 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| rnrj · deepseek-v4-pro · deepseek · https://api.deepseek.com/v1 | 956 | 5 091 833 | 1 738 166 | 6.24 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| bridge · gpt-5.6-sol · custom · https://api.openai.com/v1 | 849 | 4 871 469 | 411 569 | 0.16 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| marketer · deepseek-v4-flash · zai · https://api.z.ai/api/paas/v4 | 728 | 11 317 451 | 293 064 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| ianes · deepseek-v4-flash · zai · https://open.bigmodel.cn/api/paas/v4 | 720 | 16 821 347 | 292 569 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| zero · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 714 | 3 010 578 | 817 422 | 0.69 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| crypto · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 628 | 6 390 691 | 414 093 | 0.43 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| marketer · glm-5.2 · zai · https://api.z.ai/api/paas/v4 | 616 | 2 648 978 | 340 520 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| gino · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 607 | 2 769 283 | 580 523 | 0.70 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| director · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 588 | 1 204 224 | 564 036 | 0.44 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| director · deepseek-flash · deepseek · https://api.deepseek.com/v1 | 577 | 1 185 926 | 485 407 | 0.61 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| nomadapp · glm-5.2 · auto · https://api.z.ai/api/paas/v4 | 568 | 337 561 | 161 762 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| papi · glm-5.2 · zai · https://api.z.ai/api/coding/paas/v4 | 538 | 3 378 551 | 205 245 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| immoboy · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 492 | 2 169 751 | 491 128 | 0.55 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| zero · glm-5.2 · zai · https://api.z.ai/api/paas/v4 | 491 | 3 072 281 | 398 647 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| codemaster · deepseek-flash · deepseek · https://api.deepseek.com/v1 | 476 | 856 373 | 401 358 | 0.43 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| marketer · deepseek-flash · deepseek · https://api.deepseek.com/v1 | 419 | 1 202 101 | 409 280 | 0.53 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| papi · deepseek-flash · deepseek · https://api.deepseek.com/v1 | 371 | 1 953 697 | 367 687 | 0.51 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| bridge · deepseek-v4-flash · deepseek · https://api.deepseek.com/v1 | 362 | 3 118 178 | 263 036 | 0.73 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| immoboy · deepseek-flash · deepseek · https://api.deepseek.com/v1 | 361 | 1 185 662 | 472 954 | 0.43 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| rnrj · openai/gpt-4o-mini · openrouter · https://openrouter.ai/api/v1 | 315 | 3 418 941 | 89 040 | 0.77 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| gino · glm-5.2 · deepseek · https://api.deepseek.com/v1 | 298 | 1 992 367 | 127 874 | 0.00 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
| codemaster · deepseek-v4-pro · deepseek · https://api.deepseek.com | 273 | 1 167 618 | 358 826 | 2.45 $ | 0.00 % | 0 | — | — | INSUFFICIENT_EVIDENCE | 0 unite(s) jugee(s) — plancher absolu 10, seuil provisoire 8 (classe medium) |
Ce que cette page NE mesure pas
Une couverture partielle affichee comme complete est exactement le faux verdict que le plan d'execution interdit. Voici les trous, nommes.
Doctrine Outcome v1 — 3/8 etats produits
Produits : ACCEPTED, REJECTED, UNKNOWN. Les autres n'ont aucune source aujourd'hui :
- GENERATED — aucune source ne distingue « une sortie a ete produite » d'une session qui a simplement consomme des tokens
- TECH_PASS — aucune table n'ecrit de validation technique (parse/schema/tests verts) ; l'inferer de l'absence d'erreur violerait A.2.2 (TECH_PASS n'est pas ACCEPTED, et no_error n'est ni l'un ni l'autre)
- BUSINESS_VALIDATED — aucune validation metier tardive n'est instrumentee ; l'append-only du ledger la permettrait, la source n'existe pas
- RETRIED — le ledger voit plusieurs tentatives d'une meme tache mais pas le lien « re-essai APRES correctif » — les confondre compterait un ordonnancement comme un echec de modele
- ESCALATED — aucun signal de passage a un modele ou un humain superieur
Jointure depense ↔ verdict
- lignes de depense jointes : 13/11497 (0.11 %)
- sessions jugees retrouvees : 13/13 (100.0 %)
- appels sans verdict : 232242 (cout chiffre 316.1330 $)
Rattachement au Registry (objet UsageAggregate du §20)
- profils du Registry couverts par un agregat d'usage : 7/130 (5.4 %)
- TROU DE MODELISATION : 34 cellule(s) dont la ModelVersion existe au Registry mais qu'aucun ExecutionProfile ne sert par cette route (ex. deepseek-v4-flash @ zai, gpt-5.6-sol @ custom, openai/gpt-5.6-sol @ zai)
- TROU DE COLLECTE : 9 cellule(s) dont le modele est totalement absent du Registry (ex. glm-4.6 @ zai, glm-4.5 @ zai, grok-4.3 @ xai)
- appels non rattaches : 145119
Un agregat sans profil correspondant n'est jamais force dans le profil « le plus proche » : cela melangerait deux routes ou deux quantifications.
Seuils de volume (B.2, PROVISOIRES)
- high — HERMES_RANKED a N ≥ 100, fenetre 30 j, PROVISIONAL a N ≥ 20
- medium — HERMES_RANKED a N ≥ 30, fenetre 30 j, PROVISIONAL a N ≥ 8
- low — HERMES_RANKED a N ≥ 10, fenetre 60 j, PROVISIONAL a N ≥ 3
DASH-3 mesure, il ne classe pas : il n'emet jamais HERMES_RANKED, qui exige la relecture de Greg (B.4). Son meilleur etat est RANKABLE_PENDING_REVIEW.