Méthodologie du score AgentReadyGo
Le score est déterministe : à résultats de missions identiques, il est identique. Le modèle décide de ce qu’il observe, pas de la note. Cette page documente le calcul complet.
1. Les étapes du parcours
Chaque mission traverse un sous-ensemble d’étapes. L’agent déclare le résultat de chacune au moment où il la franchit.
| Étape | Identifiant |
|---|---|
| Découverte du site | discovery |
| Recherche produit | search |
| Compréhension produit | product_understanding |
| Comparaison | comparison |
| Sélection de variante | variant_selection |
| Disponibilité / stock | availability |
| Ajout au panier | cart |
| Livraison | shipping |
| Retours | returns |
| Checkout | checkout |
Trois verdicts sont possibles, convertis en points : pass = 100, warn = 62, fail = 0. Une étape hors du périmètre de la mission n’est pas comptée.
2. Les dimensions
Les étapes alimentent huit dimensions, pondérées selon leur poids commercial réel.
| Dimension | Étapes agrégées | Poids |
|---|---|---|
| Discoverability Capacité d'un agent à trouver le site, comprendre sa structure et localiser un produit précis. | discovery, search | 14 % |
| Product Understanding Lisibilité machine de la fiche produit : caractéristiques, prix, cohérence avec les données structurées. | product_understanding | 14 % |
| Comparison Possibilité de comparer plusieurs références sur des critères objectifs. | comparison | 8 % |
| Availability Détermination fiable du stock et des variantes réellement achetables. | availability, variant_selection | 12 % |
| Cart Ajout au panier sans ambiguïté et confirmation explicite du contenu. | cart | 14 % |
| Shipping Disponibilité du coût et du délai de livraison avant le checkout. | shipping | 12 % |
| Returns Accessibilité et clarté de la politique de retour. | returns | 8 % |
| Checkout Capacité à atteindre le tunnel de commande et à en comprendre les étapes. | checkout | 18 % |
3. Les pénalités de friction
Chaque friction retire des points à la dimension correspondante, plafonnés à 45 points : au-delà, le score d’étape reflète déjà l’échec.
4. La part technique
Les vérifications de lisibilité machine — robots.txt, sitemap, données structurées, recherche interne — représentent 30 % des dimensions Discoverability et Product Understanding, et rien ailleurs. Un site techniquement irréprochable sur lequel les agents échouent obtient un mauvais score, et c’est voulu.
5. Le score global
Moyenne pondérée des dimensions effectivement mesurées, les poids étant renormalisés lorsqu’une dimension n’a pas été testée. Deux plafonds s’appliquent ensuite :
- score maximal 58 si aucune mission n’a atteint le checkout ;
- score maximal 65 si aucun ajout au panier n’a abouti.
6. Les niveaux
| 85 – 100 | Excellent | Les agents IA réussissent généralement le parcours d'achat. |
| 70 – 84 | Correct | Le parcours aboutit, avec quelques frictions significatives. |
| 50 – 69 | Risqué | Certaines missions échouent ou demandent un effort anormal. |
| 0 – 49 | Critique | Les agents rencontrent des blocages majeurs. |
7. Ce que le score ne mesure pas
Il ne mesure ni la conversion humaine, ni la qualité graphique, ni la performance technique brute. Il mesure une seule chose : la capacité d’un agent autonome à mener une transaction à son terme sur votre vitrine publique.