Agents and Workflows
Agents – Examen blanc 2
Un examen blanc indépendant plus difficile de 50 items, pondéré par domaine, pour la piste Agents and Workflows, conçu comme un test de préparation chronométré.
Ceci est le second examen blanc indépendant complet pour la piste Agents and Workflows, construit à partir des objectifs d’apprentissage OpenAI accessibles au public et n’est pas une évaluation officielle OpenAI. Il est délibérément plus difficile que l’examen blanc 1 — plus d’énoncés à contraintes multiples et plus de qualificatifs FIRST / BEST / MOST cost-effective / TWO. Les 50 questions sont inédites et distinctes de l’examen blanc 1 comme des items des pages de domaine. Utilisez-le comme test de préparation en conditions chronométrées une fois l’examen blanc 1 et votre révision derrière vous.
Consignes
- Durée : 60 minutes. Passez celui-ci chronométré, en un seul bloc ininterrompu.
- Items : 50 questions à choix multiple et à réponses multiples. Chaque item indique combien de réponses sélectionner.
- Sélection : pour un item à réponses multiples, vous devez sélectionner toutes les bonnes options et aucune mauvaise pour obtenir le point ; il n’y a pas de crédit partiel.
- Aucune pénalité pour les mauvaises réponses : répondez à chaque question — une mauvaise réponse ne coûte rien au-delà du point.
- Objectif : visez au moins 80 % brut (40 sur 50) en conditions chronométrées avant de passer la véritable évaluation Academy Agents and Workflows. La barre des 80 % correspond au seuil du badge Academy.
- Lisez attentivement les énoncés à contraintes multiples : le qualificatif (
FIRST,BEST,TWO) départage généralement deux options défendables.
Répartition par domaine
| # | Domaine | Pondération | Items ici |
|---|---|---|---|
| 1 | What an Agent Is and When to Use One | 16 % | 8 |
| 2 | Defining Objectives and Tasks | 18 % | 9 |
| 3 | Context, Tools and Permissions | 18 % | 9 |
| 4 | Boundaries and Guardrails | 16 % | 8 |
| 5 | Reviewing and Verifying Agent Work | 16 % | 8 |
| 6 | Reliability and Iteration | 16 % | 8 |
Total : 8 + 9 + 9 + 8 + 8 + 8 = 50 items.
Interprétation de la préparation
Ceci est un indicateur de préparation indépendant, pas un score officiel.
| Score brut (sur 50) | Palier | Interprétation |
|---|---|---|
| 45–50 | 90 %+ | Forte préparation ; vous êtes prêt pour la véritable évaluation |
| 40–44 | 80–89 % | Prêt pour l’évaluation ; revoyez tout domaine faible |
| 35–39 | 70–79 % | Confiance en construction ; une autre passe de révision conseillée |
| Moins de 35 | moins de 70 % | Continuez à apprendre ; cette série plus difficile a révélé de vrais écarts |
Comme cet examen blanc est plus difficile que l’examen blanc 1, un score dans le palier 80–89 % ici est un signal fort de préparation. Traitez 40 sur 50 comme votre seuil minimal.
Passer l’examen blanc
Deux façons d’utiliser les questions ci-dessous : le mode interactif lance une session chronométrée, une question à la fois, et se termine par votre indicateur de préparation, une ventilation par domaine et une correction complète ; le mode révision en dessous liste chaque question avec ses options une par ligne et la réponse masquée jusqu’à ce que vous la demandiez.
Mode interactif
Passer l’examen d’entraînement
50 questions · une à la fois · compte à rebours de 60 minutes · résultats avec répartition par domaine et correction complète à la fin. Votre progression est enregistrée dans ce navigateur si vous quittez la page.
Par domaine
| Domaine | Correctes | Score |
|---|
Correction
Toutes les questions (mode révision)
Les options sont présentées une par ligne. La réponse et l’explication restent masquées jusqu’à ce que vous cliquiez sur Afficher la réponse. Utilisez le mode interactif ci-dessus pour une session chronométrée.
Un chef d’équipe a une tâche dont les étapes sont entièrement connues et identiques à chaque exécution, mais qui touche un envoi externe irréversible. En considérant ensemble le chemin, l’accès, la durée et la réversibilité, quelle construction est la plus appropriée ?
Afficher la réponse
Réponse : B.
Un chemin fixe et connu oriente vers un workflow plutôt qu’un agent, et l’envoi irréversible doit se situer derrière un verrou humain. L’envoi autonome (A) supprime le seul contrôle qui compte, un simple prompt (C) ne peut pas porter un processus séquencé, et un agent à large accès (D) ajoute une autonomie dont le chemin fixe n’a pas besoin plus un rayon d’impact inutile.
Deux tâches semblent de difficulté comparable. La tâche X a des étapes qui dépendent de ce que les étapes précédentes trouvent et s’exécute sans surveillance ; la tâche Y a une séquence fixe que vous vérifiez entre les étapes. Quel est le meilleur classement ?
Afficher la réponse
Réponse : B.
L’adéquation se décide selon que le chemin est connu d’avance : X doit planifier (agent), Y est fixe avec des relectures (workflow). Traiter la difficulté comme décisive (A) est le piège, considérer les deux comme des prompts (C) ignore leur nature multi-étapes, et D inverse la bonne correspondance.
Un manager veut automatiser de bout en bout une tâche récurrente, y compris une étape de publication publique, en arguant que c’est la partie la plus fastidieuse. Quelle est la PREMIÈRE chose que vous devez établir ?
Afficher la réponse
Réponse : B.
La réversibilité gouverne la sûreté de l’automatisation : une étape irréversible qui ne peut pas être verrouillée est un signal de ne pas automatiser cette étape. Le coût du modèle (A) et la longueur du brief (C) sont secondaires, et ce que fait un concurrent (D) est sans rapport avec la possibilité de déléguer cette action en toute sécurité.
Une partie prenante insiste sur le fait que, parce qu’une tâche prendra vingt minutes non surveillées à un agent, elle doit être « plus puissante » qu’un prompt de deux minutes. Quelle est la correction la plus exacte ?
Afficher la réponse
Réponse : B.
La durée est un axe de supervision : les exécutions non surveillées plus longues déplacent le contrôle de l’observation en direct vers des limites conçues et une vérification a posteriori. Elle n’équivaut pas à la puissance (A), elle dépasse une question de coût (C), et les courts prompts produisent couramment un travail utile (D).
Une tâche est réellement multi-étapes et tire parti d’outils, mais vous ne pouvez pas énoncer à quoi ressemble un résultat achevé et correct. Qu’est-ce que cela implique le plus fortement ?
Afficher la réponse
Réponse : B.
Sans définition de « terminé », vous ne pouvez ni briefer ni vérifier le travail, si bien que le caractère multi-étapes et compatible avec les outils ne le rend pas encore délégable. Déléguer malgré tout (A) produit une sortie invérifiable, et un modèle plus grand (C) ou davantage d’outils (D) ne peuvent pas remplacer un test d’acceptation manquant.
Un travailleur du savoir évalue un agent pour l’assemblage trimestriel d’un dossier de conseil d’administration. Quels DEUX facteurs plaident le plus fortement CONTRE un agent et POUR un workflow avec verrous ?
Afficher la réponse
Réponse : A et B.
Un chemin fixe et documenté (A) rend un workflow moins coûteux et plus vérifiable qu’un agent, et la diffusion externe irréversible (B) exige un verrou plutôt que de l’autonomie. La longueur et les multiples documents (C) n’exigent pas à eux seuls un agent, l’ennui (D) est sans rapport, et un brouillon privé (E) abaisserait le risque plutôt que de plaider contre un agent.
Quel raisonnement distingue le MIEUX un agent d’un prompt très long et très détaillé ?
Afficher la réponse
Réponse : B.
L’autonomie, c’est qui choisit l’étape suivante : un long prompt reste à faible autonomie si vous le pilotez, alors qu’un agent planifie lui-même le chemin. La longueur ne confère pas l’autonomie (A), le coût du modèle (C) est sans rapport, et les prompts peuvent tout à fait inclure des contraintes (D).
Une tâche manuelle de cinq minutes nécessiterait une heure de mise en place et de vérification à chaque exécution en tant qu’agent. En appliquant l’angle réversibilité-et-coût, quelle est la MEILLEURE décision ?
Afficher la réponse
Réponse : B.
Lorsque contrôler la sortie coûte plus que de simplement faire la tâche, un agent est une perte nette — un signal fondamental de « mauvais outil ». Automatiser quand même (A) ignore le coût, sauter la vérification (C) échange une petite économie contre un risque non borné, et un second agent (D) augmente à la fois le coût et la charge de vérification.
Un agent a renvoyé un rapport qui a fait quelque chose d’adjacent à ce qui était voulu, a silencieusement supprimé une section et a cité un chiffre périmé. En appliquant la discipline « brief d’abord », quel changement unique devriez-vous faire en PREMIER ?
Afficher la réponse
Réponse : B.
Les trois symptômes renvoient à des défauts de brief — un objectif en forme de tâche, une définition de « terminé » manquante et une source non nommée — donc la première démarche disciplinée est de réparer le brief. Un modèle plus grand (A) reproduit les mêmes erreurs de forme, relancer le même brief (C) reproduit le défaut, et un large accès (D) ne traite aucune de ces causes.
Plusieurs sources fournies donnent des chiffres de chiffre d’affaires contradictoires. Que doit fournir un brief bien formé pour que l’agent reste ancré ?
Afficher la réponse
Réponse : B.
Hiérarchiser les sources et indiquer à l’agent quand signaler l’incertitude maintient la sortie ancrée quand les données divergent. Faire la moyenne (A) mélange bonnes et mauvaises données, toujours faire confiance au web (C) est souvent le choix le moins faisant autorité, et une fenêtre plus grande (D) ne résout pas quelle source croire.
Un brief pour un traitement en masse de plus de 200 éléments a un résultat clair et une définition de « terminé », mais aucun point de contrôle. Quel point de contrôle UNIQUE ajoute le PLUS de sécurité pour le moindre coût de relecture ?
Afficher la réponse
Réponse : B.
Le point de contrôle « un avant plusieurs » empêche une erreur en 200 exemplaires au prix d’une seule relecture. Faire une pause à chaque élément (A) contrarie l’intérêt de déléguer, les pauses temporelles (C) ne s’alignent pas sur le risque, et l’absence de pause (D) supprime tout pilotage sur une action en masse.
Un manager a écrit dans un brief « privilégiez un style concis », « ne partagez jamais de données financières provisoires en externe » et « visez à terminer aujourd’hui ». Laquelle est la PLUS importante à faire passer d’une formulation à un contrôle imposé, et pourquoi ?
Afficher la réponse
Réponse : B.
La règle de confidentialité est une contrainte stricte protégeant une divulgation irréversible et sensible, elle mérite donc une imposition système plutôt qu’une simple formulation. Le style (A) et le souhait de calendrier (C) sont des préférences, et traiter les trois comme égales (D) manque le fait qu’une seule protège contre un préjudice réel et difficile à annuler.
Quel objectif est le MIEUX écrit comme un résultat délégable plutôt qu’une liste de tâches ?
Afficher la réponse
Réponse : B.
L’option B nomme un artefact concret, un périmètre borné, une source faisant autorité et un comportement en cas d’échec, elle est donc à la fois exécutable et vérifiable. A décrit des frappes clavier plutôt qu’un résultat, et C et D sont des souhaits vagues sans test d’acceptation.
Un chef de projet délègue la migration de la mise en forme de 150 documents avec un résultat clair et une définition de « terminé ». Quels DEUX points de contrôle ajoutent le PLUS de sécurité ?
Afficher la réponse
Réponse : A et B.
Approuver le schéma sur le premier document (A) empêche une erreur en 150 exemplaires, et verrouiller les écrasements irréversibles (B) protège les originaux. Faire une pause à chaque document (C) contrarie la délégation, les pauses temporelles (D) ne s’alignent pas sur le risque, et l’absence de pause (E) supprime tout pilotage sur une action irréversible en masse.
Un objectif contient de nombreuses petites inconnues que vous ne pouvez pas pré-résoudre et il n’y a pas de bifurcation unique à verrouiller. Quelle est la MEILLEURE instruction à donner à l’agent ?
Afficher la réponse
Réponse : B.
Lorsqu’il y a de nombreuses petites inconnues et aucune bifurcation unique où faire une pause, la meilleure démarche est de faire remonter par l’agent ses hypothèses pour relecture. Les choix silencieux (A) masquent les mauvais virages, refuser d’emblée (C) est disproportionné, et énumérer chaque version complète (D) est du gaspillage et peu pratique.
Un brief dit « résumez l’incident » sans périmètre. L’agent renvoie une note de deux lignes alors que la direction attendait une chronologie complète. Qu’est-ce que cela révèle le PLUS directement à propos du brief ?
Afficher la réponse
Réponse : B.
Sans périmètre dans la définition de « terminé », l’agent a fixé sa propre borne et s’est arrêté, produisant moins qu’attendu. La taille du modèle (A) et le niveau de raisonnement (C) ne définissent pas le périmètre, et une lacune d’accès (D) se manifesterait par un blocage ou des données erronées, pas par une synthèse sous-dimensionnée.
Quel énoncé explique le MIEUX pourquoi « avancer vite, laisser l’agent supposer » est un mauvais défaut pour un objectif ambigu ?
Afficher la réponse
Réponse : B.
Une hypothèse erronée non remontée s’aggrave en reprises et, sur une étape irréversible, en préjudice irrécupérable, si bien que la vitesse apparente est une fausse économie. Ce n’est pas toujours plus lent au départ (A), les agents peuvent poser des hypothèses (C), et l’usage des tokens (D) n’est pas le risque de fond.
Un agent rédigeant des e-mails de renouvellement a cité une politique obsolète ET a extrait des détails des fichiers de clients sans rapport. Quelle paire de correctifs traite les DEUX causes distinctes ?
Afficher la réponse
Réponse : A.
La politique obsolète est une lacune de contexte corrigée en fournissant la politique en vigueur, tandis que la fuite entre comptes est un problème d’accès/de portée corrigé en restreignant le connector. Un modèle plus grand (B) ne corrige aucune cause, un large accès en écriture et davantage de documents (C) aggravent le risque et manquent le correctif de contexte, et baisser l’effort avec l’envoi autonome (D) ne traite ni l’un ni l’autre et ajoute du danger.
En appliquant l’échelle lecture puis écriture puis envoi pour le moindre privilège, quelles DEUX postures sont des défauts corrects ?
Afficher la réponse
Réponse : A et B.
L’échelle sûre commence par la lecture et n’ajoute l’écriture que pour modifier des données (A), et verrouille toujours l’envoi (B). Commencer par l’envoi (C) expose d’abord des actions irréversibles, l’écriture par défaut (D) sur-dote, et l’envoi-sans-lecture (E) est incohérent car l’agent pourrait agir sans ancrer son action.
Un chef d’équipe veut élargir l’accès d’un agent après qu’il s’est réellement bloqué sur une vraie tâche faute de portée. Quand l’élargissement est-il justifié dans le cadre du moindre privilège ?
Afficher la réponse
Réponse : B.
Le moindre privilège s’élargit sur preuve : une exécution réelle montrant un besoin authentique justifie l’octroi additionnel le plus étroit qui débloque. Un accès figé pour toujours (A) ignore les besoins réels, la commodité (C) est le piège du sur-dimensionnement, et l’ancienneté (D) n’est pas la base d’un accès délimité à la tâche.
Un agent produit un travail compétent mais ignore systématiquement une décision que l’équipe a déjà prise, tout en ne signalant aucun problème d’accès. Quelle est la cause la PLUS probable et le correctif ?
Afficher la réponse
Réponse : B.
Ignorer une décision tranchée sans plainte d’accès est une lacune de contexte de décisions antérieures, corrigée en fournissant ce compte rendu. Accorder des connectors (A) traite l’accès, qui n’est pas le problème, et un modèle plus grand (C) ou plus d’effort (D) ne feront pas remonter une décision qui ne lui a jamais été donnée.
Un workspace agent reçoit un connector vers un canal pour répondre à une seule question sur un fil récent. Quelle est la question CLÉ à poser avant de l’activer ?
Afficher la réponse
Réponse : B.
Un connector de canal expose tout l’historique, si bien que la question clé de moindre privilège est de savoir si la tâche a réellement besoin de cette portée ou peut être restreinte plus étroitement. La police (A), le nombre de tokens (C) et une préférence imaginaire (D) sont sans rapport avec la portée que le connector accorde.
La sortie d’un agent est compétente mais générique, et il s’est aussi arrêté prématurément en disant qu’il « ne pouvait pas atteindre le système de tarification ». Quels DEUX correctifs traitent correctement les DEUX problèmes distincts ?
Afficher la réponse
Réponse : A et B.
Une sortie générique est un problème de contexte manquant corrigé en fournissant le contexte de marque et de produit (A), tandis que « ne pouvait pas atteindre » est un problème d’accès manquant corrigé par un connector restreint (B). Un modèle plus grand (C) ne traite ni l’un ni l’autre, tout coller (D) noie le signal, et l’envoi autonome (E) est sans rapport et risqué.
Pourquoi « par sécurité, connectez l’agent à tout ce dont il pourrait éventuellement avoir besoin » est-il le MAUVAIS défaut ?
Afficher la réponse
Réponse : B.
Chaque connector ajouté est une portée ajoutée qu’un agent autonome peut exercer, si bien que le moindre privilège commence minimal et n’élargit que sur besoin démontré. Un large accès a de réels inconvénients (A), et il ne dicte ni la vitesse (C) ni la taille du modèle (D).
Une tâche nécessite que l’agent lise dans deux systèmes internes et produise un brouillon que vous enverrez. Quel provisionnement est le PLUS aligné sur le moindre privilège ?
Afficher la réponse
Réponse : B.
La lecture restreinte aux seuls enregistrements nécessaires, la création de brouillon et un envoi verrouillé constituent l’ensemble minimal qui permet à la tâche de réussir en toute sécurité. L’écriture plus l’envoi autonome (A) sur-dote et supprime le verrou d’envoi, un large connector de lecteur (C) accorde une portée excessive, et l’absence de connectors (D) force à deviner.
Un agent a cité une note interne sur les marges dans un brouillon destiné au client. Quelle est la cause RACINE et le correctif le plus fort ?
Afficher la réponse
Réponse : B.
L’agent a pu citer la note parce qu’il en avait la portée — une défaillance de sur-dimensionnement dont le correctif le plus fort est de rendre les données internes inatteignables. Il n’a pas halluciné une note réelle à laquelle il avait accès (A), et une définition de « terminé » stricte (C) ou la taille de la fenêtre (D) sont sans rapport avec la fuite.
Un agent a envoyé un e-mail à plusieurs nouveaux contacts externes malgré un brief disant « ne contactez jamais personne de nouveau sans vérifier ». Quel est le bon correctif ?
Afficher la réponse
Réponse : B.
La défaillance est une limite respectée sur une action irréversible ; le correctif consiste à l’imposer comme un point de contrôle d’approbation au niveau système. Une formulation plus ferme (A) reste une simple limite respectée, un modèle plus grand (C) peut toujours mal lire, et supprimer la définition de « terminé » (D) est sans rapport et nuisible.
Un manager doit borner le pire cas d’une exécution d’agent nocturne sur une file d’attente non bornée. Quel contrôle UNIQUE garantit le plus directement que l’exécution ne peut pas traiter plus d’un nombre connu d’éléments ?
Afficher la réponse
Réponse : B.
Un plafond de périmètre imposé limite directement le nombre d’éléments que l’exécution peut toucher, bornant le pire cas. Une note polie (A) est une limite respectée qui n’arrêtera pas un emballement, le ton (C) est sans rapport, et supprimer les points de contrôle (D) augmente le risque.
Quelle description correspond au point de contrôle d’approbation le MIEUX conçu pour un envoi externe irréversible ?
Afficher la réponse
Réponse : B.
Un bon verrou fait une pause avant l’étape irréversible et montre assez de contexte — le brouillon et les destinataires — pour une décision réelle et peu coûteuse. Faire une pause après (A) ne contrôle rien, une invite sans détail (C) invite à une approbation aveugle, et verrouiller chaque étape (D) provoque une fatigue de validation automatique.
Un agent « examinant les demandes de partenariat » a interprété largement « oui clair » et a écrit à des entreprises avec lesquelles il n’avait jamais traité, un message citant des conditions internes. Quelle combinaison de correctifs est la PLUS complète ?
Afficher la réponse
Réponse : B.
Les deux préjudices provenaient de limites respectées sur des actions irréversibles/sensibles, donc le correctif complet impose le verrou d’envoi, ajoute un verrou à plus fort enjeu pour les nouveaux contacts et retire la portée vers les conditions internes. Reformuler et faire confiance (A) laisse une limite respectée, un modèle plus grand avec envoi autonome (C) supprime le contrôle, et un plafond de dépense seul (D) ne traite ni l’envoi ni la fuite.
Pour un brouillon interne à faible enjeu que vous lirez avant d’en faire quoi que ce soit, quelle posture de limite est la PLUS appropriée ?
Afficher la réponse
Réponse : B.
Les limites doivent correspondre aux enjeux : un brouillon interne réversible que vous relirez ne nécessite qu’une relecture légère. Des verrous lourds (A) gaspillent l’attention, un plafond de zéro (C) bloque la tâche, et désactiver tous les outils (D) empêche un travail inoffensif.
Quels DEUX contrôles doivent être IMPOSÉS par le système plutôt que simplement demandés lorsqu’un agent s’exécute sans surveillance sur des outils payants avec une étape de publication externe ?
Afficher la réponse
Réponse : A et B.
La publication irréversible nécessite un point de contrôle d’approbation imposé (A) et les outils payants nécessitent un plafond de dépense imposé (B) pour que le pire cas soit borné et connu. Le ton (C), un souhait de calendrier (D) et la mise en forme (E) sont des préférences pour lesquelles des limites respectées suffisent.
Un dirigeant soutient que « l’agent s’est parfaitement comporté en test, donc nous pouvons lui faire confiance pour respecter la règle de non-envoi en production ». Quel est le contre-argument le plus fort ?
Afficher la réponse
Réponse : B.
Une limite respectée peut tenir 99 % du temps et échouer une seule fois de manière catastrophique sur une action irréversible, si bien que l’imposition est requise quel que soit le comportement en test. Faire confiance au comportement en test (A) confond habituel et garanti, les tests ne sont pas sans rapport (C), et aucun modèle (D) ne supprime le besoin de verrouiller une action irréversible.
Quelle est la façon la PLUS forte de garantir qu’un agent ne peut pas déplacer un jeu de données réglementé dans un message sortant ?
Afficher la réponse
Réponse : B.
La limite de données la plus forte est architecturale : un agent ne peut pas déplacer ce qu’il n’a jamais pu atteindre. L’instruction (A) peut être manquée, un résumé soigné (C) touche quand même les données, et un effort plus élevé (D) ne crée pas de limite de données.
Une partie prenante s’appuiera sur un livrable produit par un agent dans une heure. Quelle approche UNIQUE offre le plus de valeur de vérification dans ce temps limité ?
Afficher la réponse
Réponse : B.
Cocher les critères d’acceptation, pondérer l’échantillon selon le risque et reproduire l’affirmation à plus fort enjeu concentrent le temps limité là où les erreurs comptent le plus. Relire la synthèse (A) et l’autonotation (D) ne vérifient rien d’indépendant, et tout relancer (C) gaspille l’heure.
Un agent affirme avoir « examiné les 90 pages » mais la trace de preuve montre qu’il n’en a ouvert que 66. Qu’est-ce qui s’est le PLUS probablement produit, et que devez-vous faire ?
Afficher la réponse
Réponse : B.
Signaler une couverture complète alors que la trace montre un travail partiel est un achèvement partiel silencieux, détecté en confrontant la trace à l’affirmation ; le correctif traite le reste et ajoute une exigence de couverture. Ce n’est pas normal (A), ce n’est pas un « modèle halluciné » (C), et ce n’est pas un réglage d’effort (D) — c’est un écart entre la couverture et l’affirmation.
Quel énoncé explique le MIEUX pourquoi la synthèse d’achèvement est la partie la MOINS fiable d’un livrable non surveillé ?
Afficher la réponse
Réponse : B.
La synthèse est un compte rendu du même raisonnement qui a fait le travail, et son aisance peut dissimuler une couverture manquante, elle doit donc être confrontée aux artefacts et à la définition de « terminé ». La longueur (A), la langue (C) et l’usage des tokens (D) ne sont pas la raison de son manque de fiabilité.
Vous vérifiez une sortie d’agent en masse en échantillonnant 8 éléments sur 80 ; deux échouent. Quelle est la conclusion la PLUS défendable ?
Afficher la réponse
Réponse : B.
Des échecs dans l’échantillon signifient que vous ne pouvez plus supposer que les éléments non contrôlés sont corrects, donc vous élargissez le contrôle ou rejetez le lot. Supposer que le reste va bien (A) et livrer 78 éléments non contrôlés (C) ignorent le signal, et le contrôle par échantillonnage est une technique valable (D).
En temps limité, quels DEUX contrôles vérifient le mieux l’affirmation d’un agent selon laquelle il a « corrigé tous les liens cassés » dans une grande base de connaissances ?
Afficher la réponse
Réponse : A et B.
Un échantillon pondéré selon le risque parmi les corrections revendiquées (A) et un contrôle adverse des liens qu’il n’a pas mentionnés (B) concentrent l’effort sur les échecs probables et à fort enjeu. Relire la synthèse (C) et demander dans la session (D) ne vérifient rien d’indépendant, et le niveau de détail (E) n’est pas une preuve d’achèvement.
Pourquoi devriez-vous préférer relire l’artefact plutôt que l’assertion de l’agent à son sujet ?
Afficher la réponse
Réponse : B.
L’artefact est le produit de travail concret et vérifiable, tandis que l’assertion n’est qu’une description qui pourrait être fausse. Préférer l’assertion par facilité (A) fait confiance au récit, ils ne sont pas identiques (C), et la longueur (D) ne détermine pas l’exactitude.
Le rapport d’un agent se lit aisément, mais vous ne pouvez pas vérifier une affirmation au regard d’un quelconque artefact ou source. En appliquant la discipline de relecture, quelle est la MEILLEURE interprétation ?
Afficher la réponse
Réponse : B.
Une affirmation invérifiable signale généralement un défaut de brief en amont — aucun critère contrôlable — donc traitez-la comme non vérifiée et corrigez le brief la prochaine fois. L’aisance n’est pas une preuve (A), ce n’est pas un modèle cassé (C), et le travail d’un agent est vérifiable lorsque le brief le permet (D).
Quelle séquence est la relecture structurée la PLUS efficace d’une exécution d’agent de quarante minutes avant de consacrer du temps à la transcription complète ?
Afficher la réponse
Réponse : B.
L’ordre structuré — plan, points de contrôle, critères de « terminé », artefacts, contrôle par échantillonnage — vous permet de vous arrêter tôt si une étape en amont échoue, réservant la transcription pour la fin. Lire la transcription d’abord (A) est la démarche lente, la synthèse seule (C) ne vérifie rien, et reproduire chaque affirmation (D) est peu pratique et saute des contrôles moins coûteux.
Un agent de tri hebdomadaire présente trois symptômes à la fois : montants erronés, enregistrements manquants alors qu’il signale « tout traité », et entrées ultérieures dérivant en ton. Quelle approche est la PLUS disciplinée ?
Afficher la réponse
Réponse : B.
Les symptômes renvoient à une mauvaise source, un achèvement partiel silencieux et une dérive — trois modes ayant chacun son propre correctif — donc vous instrumentez, puis changez une chose à la fois et retestez sur des entrées variées. Un modèle plus grand (A) ne corrige aucune cause, tout réécrire d’un coup (C) masque ce qui fonctionnait, et faire confiance à l’affirmation d’achèvement (D) ignore l’achèvement partiel.
Dans la taxonomie des échecs, quel correctif s’apparie correctement avec « l’agent s’est bloqué et n’a pas pu atteindre le système de ticketing » ?
Afficher la réponse
Réponse : B.
Un blocage faute de portée est une défaillance de mauvais outil/d’accès, corrigée en provisionnant le connector précis au moindre privilège. Affiner l’objectif (A) traite les objectifs mal compris, une exigence de couverture (C) traite l’achèvement partiel, et la taille du modèle (D) est sans rapport avec l’accès.
Un agent a « fait quelque chose d’adjacent à ce que vous vouliez ». Quels DEUX énoncés diagnostiquent et corrigent correctement cela ?
Afficher la réponse
Réponse : A et B.
Produire quelque chose de proche mais pas conforme à l’objectif est un objectif mal compris (A), corrigé en le reformulant comme un résultat vérifiable (B). La dérive (C) est une dégradation progressive, l’achèvement partiel silencieux (D) est une fausse affirmation d’exhaustivité, et l’accès manquant (E) se manifeste par un blocage ou des données erronées — aucun ne correspond à « adjacent à ce que vous vouliez ».
Qu’est-ce qui distingue le MIEUX une délégation fiable d’une délégation chanceuse ?
Afficher la réponse
Réponse : B.
La fiabilité se définit par la tenue sur des entrées variées et des cas limites, alors que la chance est une seule entrée facile qui réussit. Le coût du modèle (A) et la longueur du brief (C) ne déterminent pas la fiabilité, et la distinction est bien réelle (D).
Vous avez observé un échec et voulez itérer. En appliquant la boucle LEARN, quel est l’ordre correct des étapes intermédiaires ?
Afficher la réponse
Réponse : B.
LEARN examine l’instrumentation, attribue l’échec à un mode, puis révise une chose avant de retester sur une nouvelle entrée. Réviser avant d’examiner ou d’attribuer (A, D) saute le diagnostic, et tout réviser d’un coup (C) vous empêche de savoir ce qui a fonctionné.
Pourquoi l’instrumentation est-elle un prérequis pour une itération fiable, plutôt qu’un supplément facultatif ?
Afficher la réponse
Réponse : B.
L’instrumentation rend le comportement observable pour que vous puissiez classer l’échec et cibler le correctif au lieu de deviner. Il ne s’agit pas de vitesse (A) ni de mise à niveau du modèle (C), et c’est une discipline de délégation pour tout travailleur du savoir, pas seulement les développeurs (D).
Une délégation a réussi une fois sur une entrée facile. Quelles DEUX actions établissent le mieux si elle est réellement fiable ?
Afficher la réponse
Réponse : A et B.
La fiabilité se prouve en retestant sur des entrées plus difficiles et sur des entrées différentes et réalistes tout en confirmant que la définition de « terminé » tient toujours (A, B). Relancer la même entrée facile (C) ne prouve rien de nouveau, un modèle moins cher (D) n’établit pas la fiabilité, et un seul succès (E) n’est qu’une hypothèse.
Un agent en dérive sur une longue exécution reçoit la consigne, plus ferme, de « rester sur la tâche », et pourtant il dérive de nouveau. Qu’est-ce que cela démontre le PLUS clairement ?
Afficher la réponse
Réponse : B.
La dérive sur une longue exécution non surveillée nécessite des correctifs structurels — des points de contrôle qui réancrent ou des exécutions plus courtes et délimitées — car une instruction respectée ne peut pas tenir sur toute la durée. Une formulation plus ferme (A) reste une simple limite respectée, le modèle n’est pas nécessairement défectueux (C), et la tâche n’est pas impossible (D).
Dernière mise à jour le 18 sept. 2026