AI Cert Prep
Saisissez un mot-clé pour rechercher dans la documentation.

Annexes · AWS

Bibliothèque de KPI et de métriques

Un catalogue de KPI IA mesurables par fonction métier avec formules, références et risques de détournement, plus bénéfices tangibles vs intangibles, paires leading vs lagging, métriques d’adoption, un arbre de KPI, des méthodes de construction de référence et des vanity metrics à éviter — pour l’AIB-C01.

Voici un catalogue de travail pour la mesure que teste le Domaine 2 (tâches 2.2.1–2.2.4) : des KPI par fonction métier, bénéfices tangibles versus intangibles, indicateurs avancés versus retardés, métriques d’adoption et de santé, un arbre de KPI, et comment bâtir une référence quand il n’en existe aucune. C’est une préparation indépendante. L’examen bêta AIB-C01 ne vous demande pas d’instrumenter quoi que ce soit ; il vous demande de choisir la bonne métrique, de définir une référence défendable, et de repérer une métrique qui mesure l’activité au lieu de la valeur. Chaque formule ici reste à ce niveau de décision.

La référence avant le déploiement

Le discriminant le plus répété du Domaine 2 : une valeur que vous n’avez pas mise en référence est une valeur que vous ne pouvez pas revendiquer. Quand un énoncé dit qu’une équipe veut prouver le ROI après le lancement et n’a jamais mesuré l’état antérieur, la bonne réponse reconstruit une référence (§9) — un chiffre d’après seulement n’est pas une preuve.

Comment les métriques s’articulent

text
BUSINESS OBJECTIVE (e.g. cut cost-to-serve 15%)
│
▼
VALUE KPI (lagging) ── cost per contact, ROI, revenue
│
▼
OPERATIONAL KPI ──── handle time, containment, rework rate
│
▼
ADOPTION / HEALTH (leading) ── activation, weekly active use,
│ task completion, quality score
▼
INSTRUMENTED SIGNAL ── events you can actually count

Lisez-le de haut en bas pour concevoir, de bas en haut pour expliquer. Les dirigeants s’intéressent à l’objectif ; les indicateurs avancés près du bas sont ce qui vous dit, au bout de trois semaines, si la valeur retardée du haut arrivera un jour.

1. KPI par fonction métier

Chaque KPI ci-dessous porte une définition, une formule, d’où vient la référence, comment fixer une cible, et la façon dont il se fait détourner. Choisissez le plus petit ensemble qui se rattache à l’objectif ; plus de métriques n’est pas plus d’intelligence.

KPIDéfinition / formuleSource de la référenceConseil de cibleRisque de détournement
Containment rateContacts résolus sans humain / total des contactsJournaux de self-service actuelsFixer sous 100 % ; le sur-containment piège les clientsRediriger les cas difficiles vers une impasse pour gonfler le ratio
Average handle time (AHT)Temps de traitement total / contacts traitésHorodatages historiques du CRMMinutes économisées réalistes, pas zéroBâcler la clôture, nuisant à la qualité de résolution
First-contact resolutionRésolus au premier contact / totalÉchantillonnage QAAméliorer, pas maximiser au détriment de la précisionMarquer les problèmes rouverts comme nouveaux
CSAT / CESScore d’enquête après un contact traité par l’IAMoyenne d’enquête pré-IAÉgaler ou battre la référence humaineSélectionner qui est enquêté

Chaque tableau partage une règle : la source de la référence est un chiffre d’avant, et chaque KPI a un risque de détournement. Un KPI sans colonne de risque de détournement est un KPI auquel vous n’avez pas assez réfléchi.

2. Bénéfices tangibles vs intangibles

La tâche 2.2.1 sépare explicitement les bénéfices. Les bénéfices tangibles se convertissent directement en monnaie ; les intangibles non, c’est pourquoi ils sont écartés des dossiers métier — et pourquoi l’erreur est de ne pas les rendre défendables.

TypeExemplesComment le défendre
TangibleRéduction des coûts, croissance du chiffre d’affaires, heures économisées × taux chargé, coût d’erreur évitéRattacher à une ligne du GL ou à un taux d’effectif ; montrer l’avant et l’après
IntangibleSatisfaction client, productivité des employés, confiance dans la marque, rapidité de décision, réduction du risqueLe remplacer par un proxy : delta CSAT, gain de rétention, temps économisé mesuré par enquête, incidents évités × coût attendu

La technique pour les intangibles est d’attacher un proxy mesurable et, si possible, un pont monétaire prudent. « Les employés sont plus heureux » n’est pas défendable ; « l’eNPS a augmenté de 8 points et l’attrition regrettée a baissé de 3 points, valant environ un remplacement évité par trimestre à £X » l’est. Marquez toujours de tels chiffres comme indicatifs.

IntangibleProxy défendablePont monétaire (prudent)
Productivité des employésHeures auto-déclarées + échantillonnées économisées par semaineHeures × taux horaire chargé × utilisateurs actifs
Satisfaction clientDelta CSAT / CES / NPS sur les interactions traitées par l’IAGain de rétention × valeur vie client
Qualité/rapidité de décisionTemps jusqu’à la décision ; taux de repriseValeur d’un cycle plus rapide ; coût de la reprise évitée
Réduction du risqueIncidents évités vs taux de référencePerte attendue évitée × probabilité

3. Indicateurs avancés vs retardés

La tâche 2.2.4 vous demande d’identifier les indicateurs avancés qui prédisent le succès. Les indicateurs retardés confirment la valeur après coup ; les indicateurs avancés vous disent tôt si elle arrive. Appariez-les.

Objectif de programmeIndicateur avancé (précoce, prédictif)Indicateur retardé (confirme la valeur)
Réduction du coût de supportAgents actifs hebdomadaires utilisant l’assistant ; taux d’achèvement des tâchesCoût par contact ; AHT ; CSAT
Croissance des ventesCommerciaux adoptant l’outil ; opportunités assistées crééesTaux de conversion ; revenu par commercial
Vélocité développeurSuggestions acceptées ; PR assistéesCycle time ; change-failure rate
Programme de contenuBrouillons démarrés avec l’IA ; taux de passage en revueCycle de publication ; campaign ROI

Si un indicateur avancé est plat au bout de trois semaines, la valeur retardée n’arrivera pas — c’est tout l’intérêt de le surveiller. Un programme qui ne rapporte que des métriques retardées l’apprend trop tard.

4. Métriques d’adoption et de santé

La valeur nécessite l’usage. Ces métriques vous disent si l’outil est réellement bien adopté, et ce sont les indicateurs avancés que la plupart des programmes oublient d’instrumenter.

MétriqueDéfinitionCe dont elle vous avertit
ActivationUtilisateurs ayant atteint un premier usage réussi / provisionnésFriction d’onboarding ; licences achetées mais inutilisées
Weekly active useUtilisateurs distincts l’utilisant sur une semaine glissante / utilisateurs ciblesEnthousiasme du pilote qui s’estompe ; aucune habitude ne se forme
Task completion rateTâches terminées avec l’IA / tâches démarréesL’outil échoue sur le vrai travail, pas les démos
Containment rateTraité sans transfert humain / totalSur- ou sous-automatisation
Escalation rateTransferts vers un humain / totalLà où l’outil atteint ses limites
Rework rateSorties nécessitant une correction / totalProblème de qualité déguisé en productivité
Quality sampling scoreÉchantillon noté par un humain contre une grilleLe chiffre que le CSAT peut masquer

Le containment et l’escalade sont les deux faces d’une même pièce : lisez-les ensemble, car un taux de containment élevé avec un taux de reprise en hausse signifie que vous piégez les utilisateurs au lieu de les aider.

5. Un arbre de KPI travaillé

Partez de l’objectif et décomposez jusqu’à atteindre quelque chose que vous pouvez compter. C’est l’artefact qui relie un objectif de direction à un signal instrumenté, et c’est la forme que l’examen récompense.

text
OBJECTIVE: Reduce cost-to-serve in support by 15% in 12 months
│
├── Value KPI: Cost per contact (lagging)
│ │
│ ├── Driver: Contacts handled without a human → Containment rate
│ ├── Driver: Time per human-handled contact → AHT
│ └── Guardrail: Customer satisfaction → CSAT (must not fall)
│
└── Leading indicators (weeks 1–6):
├── Weekly active agents using the assistant
├── Task-completion rate on real tickets
└── Escalation rate trend (falling = tool coping)

Arithmétique travaillée : 500 000 contacts/an à £6.00 chacun = £3.0m. Un taux de containment de 30 % à £0.40 par contact contenu, avec les 70 % restants à un coût réduit ajusté à l’AHT de £5.40, donne 500 000 × (0,30 × 0,40 + 0,70 × 5,40) = 500 000 × (0,12 + 3,78) = £1.95m — une réduction de coût de 35 % si le CSAT tient. La métrique garde-fou est la raison pour laquelle l’arbre inclut le CSAT : un gain de coût qui fait chuter la satisfaction n’est pas un gain.

6. Références : en construire une quand il n’en existe aucune

La tâche 2.2.2 exige une référence avant la mise en œuvre, mais le blocage courant dans la réalité est qu’aucune référence n’a jamais été enregistrée. Il y a quatre façons défendables d’en bâtir une ; choisissez selon la disponibilité des données et le coût.

MéthodeCommentQuand l’utiliserFaiblesse
Échantillon de time-and-motionObserver/mesurer un échantillon représentatif du processus actuelAucun journal historique n’existeBiais d’échantillonnage ; effet d’observateur
Proxy historiqueUtiliser les journaux système existants (CRM, ERP, ATS) comme état antérieurHorodatages/enregistrements déjà capturésLe proxy peut ne pas correspondre à la métrique exacte
Groupe de contrôleFaire tourner l’IA pour un groupe, en laisser un autre inchangé, comparerVous pouvez répartir de façon juste et éthiqueContamination ; comparabilité des groupes
Déploiement par étapesComparer des cohortes avant et après l’activation progressiveUn lancement big-bang est risqué de toute façonLes tendances temporelles brouillent la comparaison

La réponse préférée de l’examen à « nous n’avons pas de référence » est en construire une maintenant par la méthode crédible la moins chère — jamais « mesurer après le lancement et supposer que l’écart est l’IA ». Un groupe de contrôle ou un déploiement par étapes est le plus fort car il isole l’effet de l’IA du changement de fond.

7. Des métriques qui font bonne figure et ne signifient rien

Les vanity metrics donnent l’impression de progrès et ne prédisent rien. Les reconnaître est une compétence directement testée à l’examen.

Vanity metricPourquoi elle est tentanteRemplacer par
Nombre de prompts / requêtes exécutésGrand chiffre, facile à sortirTask-completion rate ; value KPI
Licences achetéesRessemble à de l’adoptionWeekly active use ; activation
Précision du modèle isolémentTechnique et impressionnanteLe résultat métier que la précision sert
Total des sorties généréesMontre que l’outil est « occupé »Sorties ayant passé la revue ; rework rate
NPS du pilote issu de volontairesAdopteurs précoces enthousiastesScore de qualité échantillonné sur tous les utilisateurs

Le signe d’une vanity metric : elle peut monter tandis que le résultat métier est plat ou en baisse. Si une métrique peut augmenter tandis que le coût par contact et le CSAT ne bougent pas, elle mesure l’activité, pas la valeur.

Points clés

  • Choisissez le plus petit ensemble de KPI qui se rattache à l’objectif ; chaque KPI a besoin d’une formule, d’une référence d’avant et d’un risque de détournement reconnu.
  • Rendez les bénéfices intangibles défendables avec un proxy mesurable et un pont monétaire prudent et clairement étiqueté — ne les écartez pas.
  • Appariez un indicateur avancé (adoption, achèvement des tâches) à chaque KPI de valeur retardé pour apprendre tôt, pas tard.
  • Lisez le containment face à l’escalade et à la reprise ; un taux de containment élevé avec une reprise en hausse signifie que vous piégez les utilisateurs.
  • Bâtissez l’arbre de KPI de l’objectif au signal instrumenté, et gardez une métrique garde-fou (comme le CSAT) pour qu’un gain de coût ne détruise pas discrètement la qualité.
  • Sans référence, construisez-en une maintenant — time-and-motion, proxy historique, groupe de contrôle ou déploiement par étapes — ne mesurez jamais après le lancement en supposant que le delta est l’IA.
  • Une métrique qui peut monter tandis que le résultat métier est plat est une vanity metric ; remplacez-la.

Dernière mise à jour le 18 sept. 2026