AI Cert Prep
Saisissez un mot-clé pour rechercher dans la documentation.

Agents and Workflows

Agents – Examen blanc 1

Un examen blanc indépendant de 50 items, pondéré par domaine, pour la piste Agents and Workflows, avec explications complètes et indicateur de préparation.

Ceci est un examen blanc indépendant complet, pondéré par domaine, pour la piste Agents and Workflows. Il est construit à partir des objectifs d’apprentissage OpenAI accessibles au public et n’est pas une évaluation officielle OpenAI. Les 50 questions sont inédites et ne reprennent pas les items des pages de domaine. Utilisez-le comme diagnostic : passez-le en premier pour repérer vos deux domaines les plus faibles, puis révisez avant l’examen blanc 2.

Consignes

  • Durée : 60 minutes, correspondant à la durée de la session interactive.
  • Items : 50 questions à choix multiple et à réponses multiples. Chaque item indique combien de réponses sélectionner.
  • Sélection : pour un item à réponses multiples, vous devez sélectionner toutes les bonnes options et aucune mauvaise pour obtenir le point ; il n’y a pas de crédit partiel.
  • Aucune pénalité pour les mauvaises réponses : répondez à chaque question — une mauvaise réponse ne coûte rien au-delà du point.
  • Objectif : visez au moins 80 % brut (40 sur 50) avant de passer la véritable évaluation Academy Agents and Workflows. La barre des 80 % correspond au seuil du badge Academy.
  • Traitez chaque question avant de déployer la réponse.

Répartition par domaine

#DomainePondérationItems ici
1What an Agent Is and When to Use One16 %8
2Defining Objectives and Tasks18 %9
3Context, Tools and Permissions18 %9
4Boundaries and Guardrails16 %8
5Reviewing and Verifying Agent Work16 %8
6Reliability and Iteration16 %8

Total : 8 + 9 + 9 + 8 + 8 + 8 = 50 items.

Interprétation de la préparation

Ceci est un indicateur de préparation indépendant, pas un score officiel.

Score brut (sur 50)PalierInterprétation
45–5090 %+Forte préparation sur tous les domaines
40–4480–89 %Prêt pour l’évaluation ; revoyez tout domaine faible
35–3970–79 %Confiance en construction ; révision ciblée conseillée
Moins de 35moins de 70 %Continuez à apprendre ; revoyez d’abord D2 et D3

Le palier des 80 % correspond au seuil du badge Academy ; traitez donc 40 sur 50 comme votre minimum avant de passer la véritable évaluation.

Passer l’examen blanc

Deux façons d’utiliser les questions ci-dessous : le mode interactif lance une session chronométrée, une question à la fois, et se termine par votre indicateur de préparation, une ventilation par domaine et une correction complète ; le mode révision en dessous liste chaque question avec ses options une par ligne et la réponse masquée jusqu’à ce que vous la demandiez.

Mode interactif

Passer l’examen d’entraînement

50 questions · une à la fois · compte à rebours de 60 minutes · résultats avec répartition par domaine et correction complète à la fin. Votre progression est enregistrée dans ce navigateur si vous quittez la page.

Toutes les questions (mode révision)

Les options sont présentées une par ligne. La réponse et l’explication restent masquées jusqu’à ce que vous cliquiez sur Afficher la réponse. Utilisez le mode interactif ci-dessus pour une session chronométrée.

  1. Q1D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Un analyste financier a besoin qu’un seul chiffre trimestriel soit revérifié par rapport à un unique tableur joint, et il lira la réponse avant d’en faire quoi que ce soit. Quel mode convient le mieux ?

    • A. Un agent doté d’un plafond de dépense et d’un web connector
    • B. Un simple prompt
    • C. Un workflow en cinq étapes avec des points de contrôle
    • D. Un agent qui envoie le chiffre par e-mail à l’équipe
    Afficher la réponse

    Réponse : B.

    Une seule question traitée à partir d’une seule source fournie, lue avant d’agir, relève du prompt — autonomie, outils et durée minimaux. Un agent (A, D) ajoute de la mise en place, du coût et du rayon d’impact sans bénéfice, et l’e-mail en D est une étape irréversible inutile. Un workflow en cinq étapes (C) sur-conçoit une simple recherche.

  2. Q2D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Quelle caractéristique signale le plus clairement qu’une tâche a réellement besoin d’un agent plutôt que d’un workflow ?

    • A. La tâche est émotionnellement importante pour le demandeur
    • B. L’étape suivante dépend de ce que les étapes précédentes découvrent, si bien que le chemin ne peut pas être scripté à l’avance
    • C. La tâche comporte plus de 200 mots d’instructions
    • D. Le demandeur est un cadre supérieur
    Afficher la réponse

    Réponse : B.

    Un agent devient utile lorsque le chemin ne peut pas être fixé à l’avance et qu’il doit donc planifier au fur et à mesure qu’il apprend. Le poids émotionnel (A), la longueur des instructions (C) et l’ancienneté du demandeur (D) ne changent rien au fait que les étapes soient connues d’avance, ce qui est précisément ce qui distingue un workflow d’un agent.

  3. Q3D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Un responsable des opérations planifie chaque mois un rapprochement de fin de mois identique, avec les mêmes étapes fixes, et vérifie entre chaque étape. Quel mode est le plus approprié ?

    • A. Un prompt
    • B. Un workflow
    • C. Un agent qui planifie lui-même ses étapes
    • D. Un agent doté d’un large accès aux connectors
    Afficher la réponse

    Réponse : B.

    Des étapes fixes et connues avec des points de contrôle entre elles constituent la définition même d’un workflow, moins coûteux à construire et plus facile à vérifier. Un simple prompt (A) ne peut pas porter un processus séquencé en plusieurs étapes, et un agent (C, D) ajoute une autonomie qu’un chemin entièrement connu ne requiert pas.

  4. Q4D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Pourquoi une longue exécution d’agent non surveillée exige-t-elle une supervision différente d’un court prompt que vous observez ?

    • A. Les longues exécutions coûtent toujours plus cher
    • B. Vous ne pouvez pas arrêter une erreur en direct, donc la confiance doit venir de limites conçues à l’avance et d’une vérification a posteriori
    • C. Les longues exécutions utilisent toujours un modèle plus grand
    • D. Les courts prompts ne peuvent pas utiliser d’outils
    Afficher la réponse

    Réponse : B.

    Un travail surveillé est auto-correcteur car vous pouvez stopper une mauvaise étape ; une exécution non surveillée a déjà agi au moment où vous regardez, si bien que le contrôle se déplace vers les limites et la vérification. Le coût (A) et la taille du modèle (C) ne sont pas la différence déterminante, et les courts prompts peuvent utiliser des outils que vous invoquez (D).

  5. Q5D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Un collègue dit « ce rapport est vraiment compliqué, donc il faut évidemment un agent ». Quelle est la réponse la plus solide ?

    • A. Approuver — le travail compliqué est exactement ce à quoi servent les agents
    • B. La difficulté seule ne décide pas du mode ; jugez plutôt le chemin, l’accès, la durée et la réversibilité
    • C. Le découper en cinquante prompts quoi qu’il arrive
    • D. Utiliser le modèle le plus performant disponible pour tout ce qui est complexe
    Afficher la réponse

    Réponse : B.

    L’adéquation se décide selon les quatre axes, et non selon la difficulté ressentie d’une tâche ; une tâche compliquée au chemin fixe reste un workflow. Traiter la difficulté comme facteur décisif (A) est le piège, découper aveuglément (C) ignore si les étapes sont fixes, et le choix du modèle (D) est sans rapport avec le mode.

  6. Q6D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Un travailleur du savoir veut déléguer la compilation d’une synthèse hebdomadaire de l’actualité des marchés, dont les sources varient d’une semaine à l’autre, s’exécutant sans surveillance pendant environ dix minutes et ne produisant qu’un brouillon. Quel mode convient et pourquoi ?

    • A. Un prompt, parce qu’il ne produit qu’un brouillon
    • B. Un workflow, parce que les étapes ne changent jamais
    • C. Un agent, parce que le chemin ne peut pas être scripté et qu’il s’exécute sans surveillance vers un brouillon réversible
    • D. Un seul très long prompt couvrant toutes les sources possibles
    Afficher la réponse

    Réponse : C.

    Des sources qui varient signifient que le chemin est découvert au fur et à mesure, et une exécution non surveillée en plusieurs étapes produisant un brouillon réversible relève de l’agent. Ce n’est pas un prompt (A, D) car ce n’est pas une seule étape surveillée, ni un workflow (B) car les étapes ne sont pas fixes.

  7. Q7D1 · Ce qu’est un agent et quand en utiliser unSélectionnez deux réponses

    Quelles sont les DEUX situations qui font le plus clairement d’un agent le mauvais outil pour la tâche ?

    • A. Vous ne pouvez pas énoncer une définition claire de « terminé » pour la tâche
    • B. La tâche tire parti de plusieurs outils sur une exécution non surveillée
    • C. Vérifier la sortie non surveillée prendrait plus de temps que de faire la tâche vous-même
    • D. Le chemin dépend de ce que les étapes précédentes découvrent
    • E. Les actions sont des brouillons réversibles à l’intérieur du workspace
    Afficher la réponse

    Réponse : A et C.

    Une définition de « terminé » manquante (A) signifie que vous ne pouvez ni briefer ni vérifier le travail, et une vérification plus coûteuse que le travail lui-même (C) fait de la délégation une perte nette — deux signaux classiques de « mauvais outil ». Les exécutions non surveillées multi-outils (B) et les chemins guidés par la découverte (D) orientent vers un agent, et les brouillons réversibles (E) maintiennent simplement le risque bas.

  8. Q8D1 · Ce qu’est un agent et quand en utiliser unSélectionnez une réponse

    Qu’est-ce qui capture le mieux ce que signifie « autonomie » pour distinguer un agent d’un workflow détaillé ?

    • A. Le nombre de mots que contiennent les instructions
    • B. Qui choisit l’étape suivante — vous, ou le système
    • C. La vitesse à laquelle la réponse se diffuse en retour
    • D. Le fait que la sortie soit un tableau ou du texte
    Afficher la réponse

    Réponse : B.

    L’autonomie porte sur qui décide du chemin : dans un workflow, vous séquencez les étapes, tandis qu’un agent les planifie et les choisit. La longueur des instructions (A) mesure la taille et non l’autonomie, et la vitesse de diffusion (C) comme le format de sortie (D) sont sans rapport.

  9. Q9D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Quel objectif délégué est le plus prêt à être confié à un agent ?

    • A. Aidez à régler la situation de l’onboarding
    • B. Jetez un œil aux réponses à l’enquête et voyez ce qui ressort
    • C. Produisez une synthèse d’une page des trois plaintes les plus fréquentes dans l’export d’enquête joint, avec un décompte et un exemple textuel pour chacune
    • D. Améliorez l’onboarding d’une manière ou d’une autre
    Afficher la réponse

    Réponse : C.

    L’option C énonce un résultat concret, un périmètre borné et une source de vérité nommée, si bien que l’agent peut exécuter et que vous pouvez vérifier. A, B et D sont des souhaits sans artefact défini ni test d’acceptation.

  10. Q10D2 · Définir les objectifs et les tâchesSélectionnez deux réponses

    Quelles DEUX propriétés rendent une définition de « terminé » utile à la fois pour l’agent et pour votre vérification ultérieure ?

    • A. Elle est observable, si bien que vous pouvez cocher chaque critère sans jugement subjectif
    • B. Elle est consciente de l’échec, indiquant à l’agent de signaler ce qu’il ne peut pas satisfaire plutôt que de le fabriquer
    • C. Elle nomme le modèle et le niveau de raisonnement à utiliser
    • D. Elle fixe la durée maximale d’exécution en minutes
    • E. Elle liste chaque connector que l’agent peut ouvrir
    Afficher la réponse

    Réponse : A et B.

    Une définition de « terminé » observable (A) vous permet de vérifier en cochant les critères, et une définition consciente de l’échec (B) fait remonter les lacunes au lieu de masquer une fabrication — les deux servent l’exécution et la vérification. Les réglages du modèle (C), une durée d’exécution (D) et une liste de connectors (E) sont d’autres parties d’un brief, dont aucune n’est ce qui rend « terminé » vérifiable.

  11. Q11D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un brief indique « ne citez jamais les tarifs confidentiels d’un fournisseur » et « essayez de garder le mémo sous une page ». Comment l’agent doit-il traiter ces deux instructions ?

    • A. Les deux sont des suggestions qu’il peut abandonner sous la pression du temps
    • B. La règle de confidentialité est une contrainte stricte qu’il ne doit pas enfreindre ; l’objectif de longueur est une préférence
    • C. Les deux sont des contraintes strictes de poids égal
    • D. Les deux sont des préférences
    Afficher la réponse

    Réponse : B.

    Une règle de confidentialité formulée par « ne jamais » est une contrainte stricte, tandis qu’un objectif de longueur du type « essayez de garder » est une préférence qu’il peut dépasser au besoin. Traiter la règle de confidentialité comme facultative (A, D) n’est pas sûr, et traiter l’objectif de longueur comme strict (C) pourrait bloquer un travail par ailleurs bon.

  12. Q12D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un agent mélange l’effectif de cette année avec un chiffre qui s’avère vieux de deux ans. Quelle est la cause racine la plus probable et le correctif ?

    • A. Niveau de raisonnement trop élevé ; baissez-le
    • B. Aucune source de vérité nommée ; précisez et hiérarchisez les sources faisant autorité
    • C. Le modèle est trop petit ; passez à un plus grand
    • D. Le brief était trop court ; rallongez-le pour lui-même
    Afficher la réponse

    Réponse : B.

    Le mélange de données périmées et actuelles est le symptôme classique d’une source de vérité manquante, corrigé en nommant la source qui fait autorité et la manière de résoudre les conflits. Le niveau de raisonnement (A) régit l’intensité de la réflexion, la taille du modèle (C) et la simple longueur (D) ne lui indiquent pas quel chiffre croire.

  13. Q13D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un brief demande à un agent d’appliquer une nouvelle convention de nommage à 80 fichiers. Où se situe généralement le point de contrôle à la plus forte valeur ?

    • A. Seulement après que les 80 fichiers ont été renommés
    • B. Après le premier fichier, afin que vous puissiez approuver le schéma avant que les 79 autres ne s’exécutent
    • C. Toutes les 15 secondes, quel que soit l’avancement
    • D. Jamais — les points de contrôle ne font que ralentir l’agent
    Afficher la réponse

    Réponse : B.

    Le point de contrôle « un avant plusieurs » transforme une erreur en 80 exemplaires en une erreur unique en approuvant l’approche avant qu’elle ne passe à l’échelle. Vérifier seulement à la fin (A) signifie que l’erreur s’est déjà répétée, les pauses temporelles (C) ne s’alignent pas sur le risque, et l’absence de point de contrôle (D) supprime votre pilotage.

  14. Q14D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un objectif est ambigu sur un point précis et identifiable — savoir laquelle de deux équipes est la destinataire du rapport. Quelle est la meilleure instruction à donner à l’agent ?

    • A. Choisir une interprétation en silence et poursuivre
    • B. Faire une pause et demander quelle équipe avant de continuer
    • C. Ignorer entièrement la partie ambiguë
    • D. Rédiger deux rapports complets, un pour chaque équipe
    Afficher la réponse

    Réponse : B.

    Une seule bifurcation identifiable se gère au mieux par un point de contrôle : faire une pause et demander avant que l’hypothèse ne se propage. Décider en silence (A) risque un mauvais chemin, l’ignorer (C) laisse la tâche inachevée, et produire deux versions complètes (D) est du gaspillage quand une seule question la résout.

  15. Q15D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Un agent n’a pas pu trouver un chiffre dont il avait besoin, il a donc produit un nombre à l’apparence plausible pour compléter le tableau. Qu’aurait dû prescrire le brief ?

    • A. Toujours renseigner les valeurs manquantes pour que la sortie paraisse complète
    • B. Signaler toute valeur qu’il ne peut pas vérifier plutôt que d’en fabriquer une
    • C. Abandonner toute la tâche à la première valeur manquante
    • D. Utiliser un modèle plus grand la prochaine fois
    Afficher la réponse

    Réponse : B.

    Une définition de « terminé » consciente de l’échec indique à l’agent de faire remonter les lacunes au lieu d’inventer des données. Combler les lacunes (A) masque une fabrication, arrêter toute la tâche (C) est disproportionné quand une seule lacune peut être signalée, et la taille du modèle (D) ne change pas le comportement de fabrication.

  16. Q16D6 · Fiabilité et itérationSélectionnez une réponse

    Dans la taxonomie des cinq modes d’échec, quel mode est décrit comme le plus dangereux parce que l’agent signale une réussite alors qu’il n’a fait qu’une partie du travail ?

    • A. Objectif mal compris
    • B. Achèvement partiel silencieux
    • C. Contexte manquant
    • D. Dérive sur les longues exécutions
    Afficher la réponse

    Réponse : B.

    L’achèvement partiel silencieux est le mode le plus dangereux car rien ne signale de problème — l’agent prétend une couverture complète alors qu’une partie du travail manque. L’objectif mal compris (A) produit un travail adjacent, le contexte manquant (C) produit une sortie hors marque ou aux faits erronés, et la dérive (D) est une dégradation progressive sur une longue exécution — chacun est visible d’une manière différente.

  17. Q17D2 · Définir les objectifs et les tâchesSélectionnez deux réponses

    Quels DEUX éléments ont leur place dans une définition de « terminé » solide pour une synthèse concurrentielle prête pour une diapositive ?

    • A. Couvre les quatre concurrents nommés
    • B. Utilise le modèle disponible le plus récent
    • C. Tient sur une diapositive avec au plus six puces
    • D. Se termine en moins de cinq minutes
    • E. Emploie un ton enjoué et marketing du début à la fin
    Afficher la réponse

    Réponse : A et C.

    La couverture des quatre concurrents (A) et une borne de taille d’une diapositive avec six puces (C) sont des critères d’acceptation observables que vous pouvez cocher. Le choix du modèle (B) et la durée d’exécution (D) sont opérationnels, et le ton (E) est une préférence plutôt qu’un test d’acceptation pour une synthèse de données.

  18. Q18D2 · Définir les objectifs et les tâchesSélectionnez une réponse

    Pourquoi « énoncer le résultat, pas les frappes clavier » est-il la façon recommandée d’écrire un objectif ?

    • A. Les étapes sont toujours plus courtes que les résultats
    • B. Décrire vos propres étapes contraint l’agent à suivre votre chemin et masque le test d’acceptation, alors qu’un résultat le laisse planifier et reste vérifiable
    • C. Les résultats exigent toujours un modèle plus grand
    • D. Les agents ne peuvent pas du tout suivre des instructions pas à pas
    Afficher la réponse

    Réponse : B.

    Un résultat laisse l’agent planifier le chemin tout en restant vérifiable, alors qu’une liste de vos frappes clavier le contraint et obscurcit ce que « terminé » signifie. La longueur (A) n’est pas le sujet, les résultats n’exigent pas de modèles plus grands (C), et les agents peuvent suivre des étapes (D) — ils planifient simplement mieux à partir d’un résultat.

  19. Q19D3 · Contexte, outils et permissionsSélectionnez une réponse

    Un agent renvoie un texte compétent mais générique et hors marque. Quel correctif est le plus approprié ?

    • A. Lui accorder davantage de connectors et d’outils
    • B. Fournir la voix de marque, la charte éditoriale et les faits produit en tant que connaissances d’entreprise faisant autorité
    • C. Passer à un modèle plus grand
    • D. Lui donner un accès en écriture au site web
    Afficher la réponse

    Réponse : B.

    Une sortie hors marque est un symptôme de contexte manquant : l’agent n’a pas les connaissances d’entreprise qui définissent la marque. Davantage d’outils (A) et un accès en écriture (D) ajoutent de l’accès plutôt que du contexte, et un modèle plus grand (C) ne connaîtra toujours pas votre marque sans qu’on la lui indique.

  20. Q20D3 · Contexte, outils et permissionsSélectionnez une réponse

    Une tâche exige seulement que l’agent réponde à des questions à partir d’un document de politique téléchargé. Quel accès doit-il recevoir ?

    • A. La recherche web plus un accès en écriture au lecteur partagé
    • B. Un accès en lecture à ce document et rien de plus
    • C. Un connector vers tous les systèmes de l’entreprise, par sécurité
    • D. La capacité d’envoyer des e-mails pour pouvoir partager les réponses
    Afficher la réponse

    Réponse : B.

    Le moindre privilège consiste à accorder exactement l’accès en lecture dont la tâche a besoin. Le web et l’écriture (A), de larges connectors (C) et l’envoi (D) ajoutent tous du rayon d’impact dont la tâche n’a jamais besoin.

  21. Q21D3 · Contexte, outils et permissionsSélectionnez une réponse

    Quel ensemble nomme le mieux les quatre types de contexte dont un agent a généralement besoin ?

    • A. Brief de tâche, documents sources, connaissances d’entreprise, décisions antérieures
    • B. Temperature, top-p, max tokens, seed
    • C. Modèle, région, niveau d’abonnement, langue
    • D. Police, couleur, mise en page, longueur
    Afficher la réponse

    Réponse : A.

    Les quatre types de contexte sont le brief de tâche, les documents sources de la tâche, les connaissances d’entreprise pertinentes et les décisions déjà arrêtées. B liste des réglages d’échantillonnage, C liste des faits de compte et D liste des éléments de mise en forme — aucun n’est le contexte à partir duquel un agent raisonne.

  22. Q22D3 · Contexte, outils et permissionsSélectionnez une réponse

    Vous connectez un agent à un lecteur partagé entier pour qu’il ouvre un fichier précis. Quel est le risque ?

    • A. Aucun ; il n’ouvrira que le fichier que vous visiez
    • B. L’agent peut atteindre tous les fichiers du lecteur et peut puiser dans des fichiers que vous n’aviez jamais prévus
    • C. Il s’exécutera plus lentement
    • D. Il changera silencieusement de modèle
    Afficher la réponse

    Réponse : B.

    Un connector expose tout ce qu’il atteint, et un agent autonome peut utiliser n’importe quelle partie de cela pour atteindre l’objectif, faisant remonter des données bien au-delà du fichier visé. Il ne se restreindra pas poliment de lui-même (A), et la vitesse (C) comme le choix du modèle (D) ne sont pas affectés par le périmètre.

  23. Q23D3 · Contexte, outils et permissionsSélectionnez une réponse

    Un agent signale « je ne peux pas accéder au CRM » et s’arrête. Quel est le bon correctif ?

    • A. Coller davantage de documents de contexte dans la tâche
    • B. Accorder un connector en lecture au périmètre restreint aux enregistrements du CRM dont la tâche a besoin
    • C. Utiliser un modèle plus grand
    • D. Baisser le niveau de raisonnement
    Afficher la réponse

    Réponse : B.

    « Ne peut pas accéder » est un problème d’accès manquant, corrigé en accordant le connector précis restreint aux enregistrements requis. Coller des documents (A) traite le contexte, et la taille du modèle (C) ou le niveau de raisonnement (D) n’accordent pas d’accès.

  24. Q24D3 · Contexte, outils et permissionsSélectionnez une réponse

    Pourquoi fournir trop de contexte peut-il en réalité nuire à la sortie d’un agent ?

    • A. Cela ne nuit jamais ; plus de contexte vaut toujours mieux
    • B. Les documents excédentaires et périmés noient le signal pertinent et peuvent ancrer l’agent sur la mauvaise source
    • C. Cela change le palier tarifaire du modèle
    • D. Cela désactive les outils de l’agent
    Afficher la réponse

    Réponse : B.

    Tout déverser noie le signal faisant autorité et peut amener l’agent à surpondérer un contenu non pertinent ou obsolète. Plus ne vaut pas toujours mieux (A), et cela ne change ni la tarification (C) ni ne désactive les outils (D).

  25. Q25D3 · Contexte, outils et permissionsSélectionnez une réponse

    Une tâche doit produire un brouillon d’e-mail que vous enverrez vous-même après relecture. Comment organiser l’accès pour respecter le moindre privilège ?

    • A. Lui donner l’envoi autonome pour qu’il puisse terminer de bout en bout
    • B. Lui donner la création de brouillon maintenant, l’outil d’envoi n’étant disponible que derrière un point de contrôle d’approbation
    • C. Lui donner un accès en écriture à tout le système de messagerie
    • D. Ne lui donner aucun outil ; il peut simplement décrire l’e-mail en texte
    Afficher la réponse

    Réponse : B.

    Le brouillon-avant-envoi, avec l’envoi irréversible verrouillé derrière une approbation, est l’organisation sûre et au moindre privilège. L’envoi autonome (A) supprime le verrou, l’écriture sur tout le système (C) est bien plus large que nécessaire, et l’absence d’outils (D) sous-dote une tâche qui doit produire un brouillon.

  26. Q26D3 · Contexte, outils et permissionsSélectionnez une réponse

    Un agent rouvre sans cesse une question que l’équipe a tranchée le trimestre dernier. Quel type de contexte manquait ?

    • A. Les décisions antérieures — ce qui a déjà été tranché
    • B. Une fenêtre de contexte plus grande
    • C. Un accès à la recherche web
    • D. Un accès en écriture au projet
    Afficher la réponse

    Réponse : A.

    Rejuger une question tranchée est la signature d’un contexte de « décisions antérieures » manquant ; fournissez le compte rendu de ce qui a été décidé. Une fenêtre plus grande (B) n’aidera pas si la décision n’a jamais été fournie, et le web (C) comme l’écriture (D) sont de l’accès, pas le contexte manquant.

  27. Q27D3 · Contexte, outils et permissionsSélectionnez deux réponses

    Quelles DEUX actions réduisent le mieux le rayon d’impact d’un agent sans réduire sa capacité à effectuer une tâche de recherche en lecture seule ?

    • A. Accorder un accès en lecture plutôt qu’en écriture
    • B. Restreindre un connector au dossier précis plutôt qu’à tout le lecteur
    • C. Activer tous les connectors disponibles
    • D. Activer l’envoi autonome par commodité
    • E. Supprimer la définition de « terminé »
    Afficher la réponse

    Réponse : A et B.

    La lecture-plutôt-qu’écriture (A) et la restriction d’un connector au dossier nécessaire (B) réduisent le rayon d’impact tout en laissant une tâche en lecture seule pleinement réalisable. Tous les connectors (C) et l’envoi autonome (D) élargissent le rayon d’impact, et supprimer la définition de « terminé » (E) nuit à la tâche sans améliorer la sécurité.

  28. Q28D6 · Fiabilité et itérationSélectionnez une réponse

    Un agent a parfaitement fonctionné sur l’unique entrée propre testée mais a échoué sur le lot réel. Quelle leçon en amont cela enseigne-t-il sur la manière de prouver une délégation ?

    • A. Un seul succès propre prouve que le brief est fiable
    • B. Un seul succès facile peut relever de la chance ; la fiabilité doit être prouvée sur des entrées variées et plus difficiles avant le déploiement
    • C. Le modèle était simplement trop petit sur le lot
    • D. Le lot était trop grand pour jamais être délégué
    Afficher la réponse

    Réponse : B.

    L’entrée propre était le cas chanceux ; la fiabilité ne s’établit qu’en retestant sur des entrées variées et des cas limites. Traiter un seul succès comme une preuve (A) est précisément le piège, la taille du modèle (C) explique rarement un brief qui n’a jamais été mis à l’épreuve, et la taille du lot seule (D) ne rend pas la délégation impossible.

  29. Q29D4 · Limites et garde-fousSélectionnez une réponse

    Quelle action requiert le plus un point de contrôle d’approbation imposé avant de pouvoir se déclencher ?

    • A. Rédiger une synthèse dans le workspace
    • B. Publier un message dans un canal client externe
    • C. Analyser un tableur que vous avez fourni
    • D. Réécrire un paragraphe que vous lirez juste après
    Afficher la réponse

    Réponse : B.

    Publier dans un canal client externe est irréversible, ce qui exige un verrou imposé avant le déclenchement. Rédiger (A), analyser (C) et réécrire (D) sont réversibles et sûrs avec une relecture légère, car rien n’a quitté le workspace.

  30. Q30D4 · Limites et garde-fousSélectionnez une réponse

    Quelle est la différence essentielle entre une limite respectée et une limite imposée ?

    • A. Les limites respectées sont simplement rédigées sur un ton plus ferme
    • B. Une limite respectée demande à l’agent de ne pas franchir une ligne ; une limite imposée rend ce franchissement impossible
    • C. Les limites imposées ne s’appliquent qu’aux grands modèles
    • D. Il n’y a pas de différence significative
    Afficher la réponse

    Réponse : B.

    Une limite respectée est une instruction que l’agent honore habituellement, tandis qu’une limite imposée est un contrôle système qui supprime la possibilité de franchissement. Le ton (A) est sans importance, l’imposition n’est pas propre au modèle (C), et la différence est centrale (D).

  31. Q31D4 · Limites et garde-fousSélectionnez une réponse

    Pour une action irréversible, pourquoi « il suffit d’instruire clairement l’agent de ne pas le faire » est-il insuffisant ?

    • A. C’est suffisant ; les instructions claires tiennent toujours
    • B. Un objectif mal lu ou un chemin imprévu peut conduire l’agent à franchir une ligne simplement demandée, et l’action ne peut pas être annulée
    • C. Les instructions coûtent trop de tokens
    • D. Les agents ignorent chaque instruction qu’on leur donne
    Afficher la réponse

    Réponse : B.

    L’instruction dépend d’une compréhension correcte, et un agent autonome peut franchir une ligne demandée en mal interprétant l’objectif — inacceptable lorsque l’action est irréversible. Les instructions claires ne tiennent pas toujours (A), le coût en tokens (C) est sans rapport, et les agents n’ignorent pas toutes les instructions (D) — ils peuvent les mal interpréter.

  32. Q32D4 · Limites et garde-fousSélectionnez une réponse

    Un agent capable d’itérer et d’appeler des outils payants reçoit la consigne « merci de ne pas trop dépenser ». Quel est le problème ?

    • A. Aucun ; l’instruction suffit
    • B. C’est une limite respectée qui n’arrêtera pas une exécution en boucle ; posez un plafond de dépense imposé
    • C. Les outils payants ne peuvent pas boucler
    • D. Les plafonds de dépense ralentissent le modèle
    Afficher la réponse

    Réponse : B.

    Une limite floue et demandée n’arrêtera pas un emballement ; un plafond de dépense imposé rend le pire cas borné et connu. L’instruction seule ne suffit pas (A), des boucles peuvent survenir avec des outils payants (C), et un plafond imposé arrête un emballement au lieu de ralentir le modèle (D).

  33. Q33D4 · Limites et garde-fousSélectionnez une réponse

    Quelle est la limite de données la PLUS forte contre la fuite d’un document interne sensible par un agent ?

    • A. Lui indiquer de ne pas partager le document
    • B. Ne pas accorder du tout à l’agent la portée d’atteindre le document sensible
    • C. Lui demander de résumer le document avec soin
    • D. Utiliser un modèle plus grand
    Afficher la réponse

    Réponse : B.

    La limite de données la plus forte est architecturale : un agent ne peut pas divulguer ce qu’il n’a jamais pu atteindre. L’instruction (A) peut être manquée, un résumé soigné (C) touche quand même les données, et la taille du modèle (D) ne crée aucune limite de données.

  34. Q34D4 · Limites et garde-fousSélectionnez une réponse

    Pourquoi verrouiller chaque action peut-il être aussi nuisible que n’en verrouiller aucune ?

    • A. Ce ne l’est pas ; plus de verrous sont toujours plus sûrs
    • B. Des verrous excessifs amènent les humains à approuver par réflexe, si bien qu’un vrai risque passe inaperçu
    • C. Les verrous désactivent les outils de l’agent
    • D. Les verrous changent silencieusement le modèle
    Afficher la réponse

    Réponse : B.

    Le sur-verrouillage produit une fatigue de validation automatique, ce qui neutralise le verrou au moment où il compte. Plus de verrous ne valent pas toujours mieux (A), et les verrous ne désactivent pas les outils (C) ni ne changent le modèle (D).

  35. Q35D4 · Limites et garde-fousSélectionnez deux réponses

    Quelles DEUX limites devraient être imposées par le système plutôt que simplement écrites dans le brief ?

    • A. Une préférence pour les puces plutôt que le texte
    • B. Un point de contrôle d’approbation avant tout envoi externe
    • C. Un plafond de dépense strict sur une tâche qui utilise des outils payants
    • D. Une suggestion de garder un ton amical
    • E. Un souhait de terminer avant la fin de la journée
    Afficher la réponse

    Réponse : B et C.

    Un point de contrôle d’approbation sur les envois irréversibles (B) et un plafond de dépense strict sur l’usage d’outils payants (C) protègent contre un préjudice réel et difficile à annuler, et doivent être imposés. Le style (A), le ton (D) et un souhait de calendrier souple (E) sont des préférences pour lesquelles des limites respectées conviennent.

  36. Q36D4 · Limites et garde-fousSélectionnez une réponse

    Un agent « améliorant » un document a écrasé l’original, perdant la version précédente. Quelle limite aurait empêché cela ?

    • A. Un ton plus amical dans le brief
    • B. Un verrou imposé sur l’écrasement des originaux, ou l’obligation d’enregistrer dans une nouvelle version
    • C. Une fenêtre de contexte plus grande
    • D. Un outil de recherche web
    Afficher la réponse

    Réponse : B.

    L’écrasement peut être irréversible, donc verrouiller les écrasements ou imposer des enregistrements versionnés préserve l’original. Le ton (A), la fenêtre de contexte (C) et la recherche web (D) ne font rien pour protéger le fichier.

  37. Q37D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Un agent termine une exécution par « j’ai accompli toutes les tâches avec succès ». Quelle est la meilleure prochaine étape ?

    • A. Clôturer la tâche ; la synthèse confirme le succès
    • B. Vérifier le résultat par rapport à la définition de « terminé » et inspecter les artefacts qu’il a produits
    • C. Demander à l’agent, dans la même session, s’il en est sûr
    • D. Relancer toute la tâche pour comparer
    Afficher la réponse

    Réponse : B.

    La synthèse est une affirmation ; vérifier signifie contrôler les artefacts et les critères d’acceptation de manière indépendante. Faire confiance à la synthèse (A) est le piège de l’aisance, une autovérification dans la même session (C) réutilise le propre raisonnement de l’agent, et tout relancer (D) gaspille la délégation sans vérifier l’original.

  38. Q38D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Pourquoi « demander à l’agent s’il a correctement effectué le travail » est-elle une méthode de vérification faible ?

    • A. Elle consomme trop de tokens
    • B. Une autovérification dans la même session repose sur le même raisonnement que celui qui a produit le résultat, si bien qu’elle peut confirmer sa propre erreur
    • C. Les agents ne peuvent pas décrire leur propre travail
    • D. C’est en réalité la méthode la plus forte
    Afficher la réponse

    Réponse : B.

    Demander à l’agent de s’auto-évaluer dans la même session emporte le raisonnement et le biais d’origine, si bien qu’il peut confirmer une erreur. Le coût en tokens (A) n’est pas le problème, les agents peuvent décrire leur travail (C) — c’est cette affirmation qui n’est pas fiable — et ce n’est pas la méthode la plus forte (D).

  39. Q39D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Dans la vérification du travail d’un agent, qu’est-ce qu’un « artefact » ?

    • A. La synthèse par l’agent de ce qu’il a fait
    • B. La sortie ou la modification concrète qu’il a produite — le fichier, le brouillon, la liste de modifications ou les enregistrements
    • C. Le réglage du niveau de raisonnement
    • D. L’heure de début de l’exécution
    Afficher la réponse

    Réponse : B.

    Un artefact est le produit de travail réel que vous pouvez inspecter et contrôler, contrairement à la description qu’en fait l’agent. La synthèse (A) est une assertion, et le réglage du niveau d’effort (C) comme l’heure de début (D) sont des métadonnées d’exécution, pas le produit de travail.

  40. Q40D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Vous contrôlez par échantillonnage 6 éléments sur 60 d’un traitement en masse et l’un échoue. Que devez-vous conclure ?

    • A. Les 54 autres vont bien ; un échec est acceptable
    • B. L’échantillon en échec invalide l’hypothèse d’une qualité uniforme ; élargissez le contrôle ou rejetez le lot
    • C. Corriger seulement l’élément en échec et livrer le reste
    • D. Rien ; les contrôles par échantillonnage ne sont pas fiables
    Afficher la réponse

    Réponse : B.

    Un échec dans l’échantillon signifie que vous ne pouvez plus supposer que les éléments non contrôlés sont corrects, donc vous élargissez le contrôle ou rejetez. Supposer que le reste va bien (A) ignore le signal, corriger un seul (C) laisse 53 éléments non vérifiés, et les contrôles par échantillonnage sont utiles, pas peu fiables (D).

  41. Q41D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Quelle est la façon la plus efficace de relire une longue exécution d’agent essentiellement non surveillée ?

    • A. Lire toute la transcription de haut en bas
    • B. Lire le plan et les points de contrôle, vérifier par rapport à la définition de « terminé », inspecter les artefacts, puis contrôler par échantillonnage — ne lire la transcription complète que si quelque chose échoue
    • C. Faire confiance à la synthèse finale
    • D. Demander à l’agent de raccourcir sa transcription
    Afficher la réponse

    Réponse : B.

    Une relecture structurée — plan, points de contrôle, critères de « terminé », artefacts, contrôle par échantillonnage — est plus rapide et détecte davantage qu’une lecture linéaire. La transcription complète (A) est un dernier recours, faire confiance à la synthèse (C) ne vérifie rien, et raccourcir la transcription (D) ne vérifie pas le travail.

  42. Q42D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Pour un unique chiffre à fort enjeu dans le rapport d’un agent, quel est le contrôle le plus fort ?

    • A. Lui faire confiance parce que l’agent a montré son calcul
    • B. Le reproduire de manière indépendante — le recalculer ou rouvrir la source vous-même
    • C. Demander à l’agent de le recalculer dans la même session
    • D. L’arrondir pour masquer une petite erreur éventuelle
    Afficher la réponse

    Réponse : B.

    Reproduire de manière indépendante l’affirmation critique la confirme sans dépendre du propre raisonnement de l’agent. Un calcul montré (A) peut tout de même être faux, un recalcul dans la même session (C) réutilise le raisonnement d’origine, et l’arrondi (D) dissimule au lieu de contrôler.

  43. Q43D5 · Relire et vérifier le travail de l’agentSélectionnez deux réponses

    Quels DEUX contrôles vérifient le mieux l’affirmation d’un agent selon laquelle il a « mis à jour tous les chiffres obsolètes » d’un document ?

    • A. Échantillonner certains des chiffres qu’il dit avoir mis à jour et les confirmer par rapport à la source
    • B. Contrôler quelques chiffres qu’il n’a pas mentionnés, au cas où il les aurait manqués
    • C. Relire sa synthèse plus attentivement
    • D. Lui demander de confirmer dans le même chat
    • E. Supposer l’achèvement parce que le rapport est détaillé
    Afficher la réponse

    Réponse : A et B.

    Échantillonner les mises à jour revendiquées (A) contrôle le travail déclaré, et contrôler des chiffres qu’il n’a pas mentionnés (B) est le contrôle adverse qui attrape ce que la synthèse masque. Relire la synthèse (C) et demander dans la session (D) ne vérifient rien d’indépendant, et le niveau de détail (E) n’est pas une preuve d’achèvement.

  44. Q44D5 · Relire et vérifier le travail de l’agentSélectionnez une réponse

    Vous constatez que vous ne pouvez pas du tout vérifier l’une des affirmations d’un agent au regard d’une quelconque preuve. Qu’est-ce que cela indique le plus probablement ?

    • A. L’affirmation est certainement correcte
    • B. La définition de « terminé » du brief était trop vague pour être contrôlée — notez-le et affinez le brief à la prochaine itération
    • C. Le modèle est cassé
    • D. La vérification est tout simplement impossible pour les agents
    Afficher la réponse

    Réponse : B.

    Une affirmation invérifiable reflète généralement un défaut de brief en amont — aucun critère contrôlable — que vous corrigez à la prochaine itération. L’impossibilité de vérifier ne rend pas l’affirmation correcte (A), ce n’est pas un modèle cassé (C), et le travail d’un agent est vérifiable lorsque le brief le permet (D).

  45. Q45D6 · Fiabilité et itérationSélectionnez deux réponses

    Un agent signale « les 40 enregistrements traités » mais 6 manquent dans la sortie. Quelles DEUX réponses sont correctes ?

    • A. Le classer comme achèvement partiel silencieux — une affirmation de couverture complète que la sortie contredit
    • B. Ajouter une exigence de couverture à la définition de « terminé » afin que l’agent doive lister tout ce qu’il n’a pas pu achever
    • C. Faire confiance à l’affirmation d’achèvement parce que le rapport était détaillé
    • D. Passer à un modèle plus grand pour corriger les enregistrements manquants
    • E. Supprimer la définition de « terminé » pour simplifier la prochaine exécution
    Afficher la réponse

    Réponse : A et B.

    Signaler un achèvement complet alors qu’il manque du travail est un achèvement partiel silencieux (A), et le correctif de fiabilité est une exigence de couverture qui force l’agent à signaler ce qu’il n’a pas pu faire (B). Faire confiance à l’affirmation (C) ignore l’écart, un modèle plus grand (D) ne traite pas un contrôle de couverture manquant, et supprimer la définition de « terminé » (E) supprime votre seul moyen de l’attraper.

  46. Q46D6 · Fiabilité et itérationSélectionnez une réponse

    Un agent démarre bien une longue exécution, puis les entrées ultérieures s’écartent de la tâche et se sur-développent. De quoi s’agit-il et quel est le bon correctif ?

    • A. Contexte manquant ; collez davantage de documents
    • B. Dérive sur une longue exécution ; ajoutez des points de contrôle et découpez l’exécution en morceaux plus courts
    • C. Mauvais accès ; accordez davantage d’outils
    • D. Une limite de capacité ; utilisez un modèle plus grand
    Afficher la réponse

    Réponse : B.

    Un écartement progressif sur une longue exécution non surveillée est une dérive ; le correctif structurel est des points de contrôle qui réancrent plus des exécutions plus courtes et délimitées. Davantage de documents (A), davantage d’outils (C) et un modèle plus grand (D) ne traitent pas une perte de concentration liée à la durée.

  47. Q47D6 · Fiabilité et itérationSélectionnez une réponse

    Une délégation a réussi sur l’unique entrée que vous avez essayée. Que devez-vous conclure ?

    • A. Elle est fiable et prête à être déployée
    • B. Elle relève peut-être de la chance ; prouvez la fiabilité en retestant sur des entrées variées et plus difficiles avant de lui faire confiance
    • C. Relancer la même entrée plusieurs fois de plus
    • D. Passer à un modèle moins cher pour réduire les coûts
    Afficher la réponse

    Réponse : B.

    Un seul succès est une hypothèse ; la fiabilité se démontre sur des entrées variées et des cas limites. Déclarer la délégation fiable (A) risque un brief fragile, relancer la même entrée (C) ne prouve rien de nouveau, et les choix de coût (D) n’établissent pas la fiabilité.

  48. Q48D6 · Fiabilité et itérationSélectionnez une réponse

    Pourquoi ne changer qu’une seule chose à la fois en itérant sur un brief de délégation ?

    • A. Pour ralentir délibérément le processus
    • B. Pour pouvoir déterminer quel changement a corrigé le problème, la fiabilité s’accumulant au lieu de reposer sur des suppositions
    • C. Parce que les agents ne peuvent lire qu’une seule instruction
    • D. Pour utiliser moins de tokens
    Afficher la réponse

    Réponse : B.

    Changer une seule chose isole la cause et l’effet, si bien que vous apprenez ce qui fonctionne et bâtissez la fiabilité de manière délibérée. Il ne s’agit pas de ralentir (A) ni de l’usage des tokens (D), et les agents lisent des briefs complets, pas une seule instruction (C).

  49. Q49D6 · Fiabilité et itérationSélectionnez une réponse

    Une délégation échoue et un collègue suggère aussitôt de passer au modèle le plus performant. Quelle est la meilleure réponse ?

    • A. Approuver ; la capacité est toujours le correctif
    • B. Diagnostiquer d’abord — la plupart des échecs sont des défauts de brief, de contexte, d’accès ou de limite, et le modèle est le dernier levier
    • C. Essayer deux modèles et choisir le plus rapide
    • D. Abandonner la tâche comme impossible
    Afficher la réponse

    Réponse : B.

    La démarche disciplinée consiste à classer l’échec et à corriger sa cause en amont ; le modèle est le dernier levier car il traite rarement un brief vague ou un contexte manquant. La pensée « modèle d’abord » (A, C) saute le diagnostic, et abandonner (D) renonce avant de diagnostiquer.

  50. Q50D6 · Fiabilité et itérationSélectionnez deux réponses

    Quels DEUX éléments sont des correctifs structurels contre la dérive sur une longue exécution non surveillée ?

    • A. Ajouter des points de contrôle qui réancrent sur l’objectif
    • B. Découper l’exécution en délégations plus courtes et délimitées
    • C. Ajouter « merci de rester concentré » au brief
    • D. Augmenter le niveau de raisonnement
    • E. Supprimer la définition de « terminé »
    Afficher la réponse

    Réponse : A et B.

    Les points de contrôle (A) et les exécutions plus courtes et délimitées (B) sont des contrôles structurels qui empêchent la dérive de s’accumuler. « Restez concentré » (C) est une limite respectée qui ne tiendra pas sur une longue exécution, un niveau de raisonnement plus élevé (D) ne traite pas l’écartement lié à la durée, et supprimer la définition de « terminé » (E) supprime votre contrôle de couverture.

Dernière mise à jour le 18 sept. 2026