Choisir le système IA le plus simple qui améliore vraiment le travail.
Le guide sépare trois questions souvent confondues : le travail confié à l’IA, ce qu’elle peut faire sans vous et les règles du territoire où elle opère. Il transforme ensuite ces choix en un premier test petit et mesurable.
DÉPART GUIDÉ · ENVIRON 3 MINUTES
Construisez votre parcours, un choix simple à la fois.
Répondez à quatre questions courtes. Le guide explique chaque idée avant d’afficher son code technique. Rien de ce qui est saisi ici n’est transmis.
PARTIR DE VOTRE RÉALITÉ
Étape 1/5
?
Pourquoi commencer ici ?
Un indépendant peut décider et corriger seul. Un service public doit réunir davantage de rôles, un mandat formel, l’accessibilité et une voie de recours. Le premier pilote utile n’est donc pas le même.
Quel type d’organisation accompagnez-vous ?
Ce choix modifie les responsabilités, le rythme et les premières protections. La méthode centrale reste la même.
01
Comprendre les différencesModes d’usage, cas non agentiques, niveaux d’intégration et revue des preuves publiques.
+
UN SUJET À LA FOIS
Choisissez ce dont vous avez besoin maintenant.
Seul le sujet choisi apparaît ensuite. Vos choix précédents restent disponibles pendant l’exploration.
Ouvert maintenantQuel travail fait l’IA ?
Séparez génération, recherche, prévision, conversation, multimodal et action.
RÉPONSES PRATIQUES
Explorez les questions qui éclairent la décision.
Chaque guide apporte une réponse directe, une comparaison, un exemple réaliste et les sources qui bornent la conclusion.
Choisissez le mode d’usage avant le niveau d’intégration.
Un chatbot, un prédicteur, un système de recherche et un agent peuvent utiliser des modèles proches, mais ils n’exigent pas les mêmes preuves. Sélectionnez le mode dominant, puis consignez chaque mode secondaire dans la fiche de cas d’usage.
QUATRE CAS SYNTHÉTIQUES · AUCUNE ACTION AUTONOME
Même avec une faible autonomie, quatre contrats de preuve différents.
Un RAG, une prédiction, un chatbot externe et un assistant multimodal peuvent tous rester en A0 ou A1. Leurs données, échecs, déclencheurs juridiques et métriques d’acceptation restent pourtant très différents.
RAGRecherche + génération · A1 · R1
Assistant de procédures terrain en lecture seule
Helvetia Facilities · interne
Périmètre borné
Retrouve les passages actuels et autorisés, puis prépare une réponse citée. Aucun accès aux tickets, e-mails, ordres de travail ou équipements.
Contrat de preuve figé
80 questions figées
20 tests de frontière d’accès
0 outil d’écriture
PRÉDPrédiction · A0 · R1
Prévision hebdomadaire de pièces
Léman Pièces · traitement par lot interne
Périmètre borné
Produit prévisions et intervalles pour un planificateur. Les nouveaux produits restent manuels et aucune commande fournisseur n’est créée.
Contrat de preuve figé
26 semaines figées
5 segments produit
0 commande automatique
CHATConversation + recherche · A1 · R2
Chatbot externe d’information client
Alpina Outdoor · CH + UE
Périmètre borné
Répond depuis les pages publiques, s’identifie comme IA et transfère. Aucun accès aux comptes, paiements, remboursements ou garanties.
Contrat de preuve figé
160 conversations
4 langues
24 transferts obligatoires
MMMultimodal + génération · A1 · R1
Assistant d’accessibilité du catalogue
Asteria Home · CH + UE
Périmètre borné
Lit images et emballages autorisés, prépare le texte alternatif et signale les écarts. Il ne peut ni modifier un média ni publier.
Contrat de preuve figé
140 jeux d’images
16 incohérences provoquées
0 droit de publication
NOMMEZ LE SYSTÈME AVANT D’ANNONCER LE GAIN
Copilote, agent métier et agence orchestrée correspondent à trois niveaux d’intégration différents.
Ils déplacent des volumes de travail différents, exigent des permissions différentes et se mesurent par des résultats différents. Un pourcentage sans son niveau induit en erreur.
01A0–A1
Copilote
Ce que fait le système
Recherche, extrait ou rédige une étape. La personne déclenche, apporte le contexte, contrôle la réponse et réalise chaque action externe.
Rôle humain
Opérateur à chaque cycle
Ancrage dans les preuves publiques
Les effets publiés vont d’un ralentissement mesuré à de forts gains sur des tâches étroites. Il n’existe pas de plage universelle.
Preuve de bout en bout
0 % sans finalisation humaine
02A2–A3
Agent métier
Ce que fait le système
Reçoit un dossier borné, utilise les outils et la mémoire autorisés, suit le processus, termine les cas éligibles et transmet les exceptions à une personne.
Rôle humain
Validateur et responsable des exceptions
Ancrage dans les preuves publiques
Essai terrain direct : 16,8 % plus rapide sur les échanges éligibles, 3,2 % sur tout le flux, avec une baisse de la note client.
Preuve de bout en bout
5,8 % éligibles ; 35 % des échanges éligibles traités par l’agent sans intervention humaine dans ce contexte
03A3–A4
Agence orchestrée
Ce que fait le système
Un orchestrateur délègue recherche, exécution, contrôle qualité et coordination entre systèmes à des agents spécialisés soumis à des règles communes.
Rôle humain
Gouverne objectifs, limites et exceptions
Ancrage dans les preuves publiques
Aucune étude de terrain indépendante ne soutient un multiplicateur générique de 5 à 12 sur les résultats métier acceptés.
Preuve de bout en bout
CORPGEN : 15,2 % terminés avec 46 tâches concurrentes dans un test comparatif, pas en production
CLÉ DE LECTURE
Cinq chiffres à ne jamais mélanger
01Temps de cycle
Délai écoulé entre demande et résultat.
02Temps humain actif
Minutes réellement consacrées par une personne.
03Débit accepté
Sorties acceptées par heure du responsable.
04Taux de bout en bout
Cas éligibles terminés sans intervention.
05Résultat livré
Effet réel en aval, pas l’activité du modèle.
CE QUE CHANGE LE DÉNOMINATEUR
Six constats qui empêchent de gonfler les gains IA.
Chaque chiffre répond à une question différente. Le résultat mesuré et la limite de transfert doivent être lus ensemble.
Construire et exploiter un piloteScénario, plan de test, preuves observées, fiche d’exploitation, transmission et brouillon terrain.
+
UN SUJET À LA FOIS
Choisissez ce dont vous avez besoin maintenant.
Seul le sujet choisi apparaît ensuite. Vos choix précédents restent disponibles pendant l’exploration.
Ouvert maintenantCompter le temps humain
Comparez une tâche aux preuves mesurées, puis rendez visible chaque minute qui reste humaine.
MESURER LA TÂCHE, PAS LA PROMESSE
Voyez ce que la preuve permet de transférer, puis comptez le travail humain qui reste.
Définissez une tâche répétable, examinez une source comparable et comptez préparation, supervision, vérification, corrections, exceptions et mise en place. La source encadre le test. Votre pilote apporte la réponse.
01
01 · Définir une seule tâche
Choisissez une unité de résultat que vous pouvez compter plusieurs fois. L’organisation est volontairement absente, car elle modifie les contrôles, pas la référence de la tâche.
Recherche et synthèse d’informationTrouver, comparer et résumer des informations existantes avec vérification des sources. une réponse ou synthèse vérifiée
02
02 · Choisir un ancrage de preuve
Une source comparable peut encadrer un test. Une source seulement contextuelle reste visible, mais ne peut pas générer un pourcentage transférable.
TT-2025-ANTHROPIC-MODEL-ESTIMATELa plage décrit la concentration annoncée des estimations du modèle. La méthode ne voit ni validation, ni correction, ni travail après la conversation et ne dispose pas d’une validation terrain complète.
Ne présentez jamais l’estimation du modèle comme une productivité mesurée et ne l’utilisez pas automatiquement dans le calcul de transfert.
Le temps machine reste séparé. Saisissez uniquement les minutes des personnes, y compris la revue et les cas en échec.
DU SCÉNARIO AU PROTOCOLE
Une fourchette n’est pas un plan. La prochaine décision doit pouvoir échouer proprement.
Le calibrateur rend les hypothèses visibles. Ce protocole fixe maintenant l’ordre, l’échantillon pratique, les preuves et la décision avant que le système ne touche au travail réel.
01Scénario calibré
02Pilote préenregistré
03Preuves observées
04Décision de périmètre
05Exploiter et réévaluer
Horizon minimal30jours
Jeu d’évaluation figé40cas
Cas réels bornés20cas
Collecte réelle à ce volume≈ 3,1semaines
01
Figer la décision
Écrire le responsable, le périmètre du processus, la situation initiale, la règle d’éligibilité, les effets permis, les seuils et l’autorité d’arrêt.
02
Évaluer hors ligne
Tester des cas réels figés, des segments critiques, des abstentions, des attaques, des pannes d’outils et des événements dupliqués avant tout usage réel.
03
Observer sans effet
Exécuter le processus complet sans effet externe. Comparer les résultats acceptés à la situation manuelle initiale, pas l’activité du modèle.
04
Opérer dans les limites
Ne libérer que le niveau choisi. Maintenir la validation humaine, le droit de blocage du gardien, le moindre privilège, le journal et le retour arrière lorsque le niveau l’exige.
05
Prendre la décision
Juger séparément la valeur, la qualité, la sécurité et l’éligibilité. Continuer le même périmètre, corriger et rejouer, ou arrêter et revenir en arrière.
UNE DATE · TROIS DÉCISIONS POSSIBLES
01
CONTINUER DANS LES LIMITES
Tous les seuils critiques sont franchis. Conserver le même processus et les mêmes permissions ; fixer la prochaine revue.
02
CORRIGER ET REJOUER
La valeur existe, mais la qualité, l’éligibilité ou la fiabilité restent sous le seuil. Corriger la cause sans augmenter l’autonomie.
03
ARRÊTER ET REVENIR EN ARRIÈRE
Un seuil critique échoue ou aucune valeur utile n’apparaît. Revenir au processus sûr et conserver les preuves.
DU PILOTE À LA DÉCISION
Saisissez les preuves observées. Le seuil critique le plus faible décide de la suite.
Une bonne moyenne n’annule pas un incident critique, et des traces manquantes ne constituent pas un résultat négatif : elles rendent le pilote non évaluable. La sortie autorise une seule prochaine action, jamais une hausse automatique de l’autonomie.
01Scénario calibré
02Pilote préenregistré
03Preuves observées
04Décision de périmètre
05Exploiter et réévaluer
RÉSULTATS OBSERVÉS DU PILOTE
Agent métier · A2–A3
EXPLOITER SANS PERDRE LA FRONTIÈRE
La production est un état réversible d’exploitation. L’évaluation continue.
Transformez la décision en responsabilités nommées, fenêtres de surveillance, déclencheurs d’arrêt fermes, retour arrière reproductible et réévaluation datée. Tout changement de modèle, outil, permission, règle ou donnée rouvre la question de la preuve.
01Scénario calibré
02Pilote préenregistré
03Preuves observées
04Décision de périmètre
05Exploiter et réévaluer
Cadence de revue formelle14jours · 1 septembre 2026
Objectif de délai de confinement60 minobjectif à tester par exercice
Périmètre autorisé1Uniquement le processus éprouvé
LES QUATRE FENÊTRES À SURVEILLER
01
QUALITÉ
Chaque sortie acceptée, correction, rejet, abstention et exception, ventilés par segment.
02
EFFETS
Chaque appel d’outil, validation, destination, effet externe, relecture d’état, doublon et résultat du retour arrière.
03
DÉRIVE + CHANGEMENT
Évolutions du modèle, des instructions, de la source RAG, des règles, des permissions, du fournisseur, du mélange de données, de la latence et du coût.
04
MÉTIER
Éligibilité observée, temps humain actif, débit, file, reprises, goulots déplacés et résultat réellement livré.
SUSPENDRE IMMÉDIATEMENT SI
01
Un effet critique, non autorisé, irréversible, mal dirigé ou non traçable se produit.
02
La validation requise, le droit de blocage du gardien, la frontière d’identité, la limite d’écriture ou la solution de repli est indisponible.
03
La version exploitée diffère du modèle, des instructions, des outils, des sources, des permissions ou des règles évalués.
04
La qualité acceptée passe sous son seuil pendant deux fenêtres consécutives, ou un segment protégé franchit un plancher critique.
05
Le coût, la latence, la file ou la charge humaine dépasse la limite opérationnelle écrite.
RETOUR ARRIÈRE EN CINQ ÉTAPES VÉRIFIABLES
01
Contenir
Arrêter l’entrée et révoquer ou désactiver l’exécution capable d’écrire.
02
Rediriger en sécurité
Envoyer les cas en attente et les nouveaux cas vers la solution manuelle testée.
03
Préserver
Figer les journaux, versions, validations, reçus d’outils, destinations et horodatages.
04
Réconcilier
Relire l’état externe, identifier chaque effet, réparer ce qui est réversible sans risque et transmettre le reste à la personne responsable.
05
Réautoriser
Ne reprendre qu’après consignation de la cause, correction, preuves rejouées et nouvelle décision.
GESTION DU CHANGEMENT
Une modification de configuration est une nouvelle affirmation de preuve. Un changement cosmétique peut faire l’objet d’un test de non-régression ; modèle, données, RAG, outil, permission, règle ou processus exigent de rejouer les tests figés concernés et de reprendre la décision avant remise en service.
RÉÉVALUER SIGNIFIE AUSSI RETIRER
À la date de revue, comparez au processus manuel actuel plutôt qu’à la démonstration d’origine. Continuez, réduisez, remplacez ou retirez. Préservez l’export, la suppression, la sortie du fournisseur, la révocation des accès et le processus manuel.
TRANSMETTRE LA DÉCISION · PAS LA DÉMO
Rassemblez toute la chaîne de preuves dans un dossier de décision vérifiable.
Un futur responsable doit pouvoir reconstruire les hypothèses, le protocole, le résultat observé, le périmètre autorisé et le retour arrière sans dépendre d’une mémoire orale ou d’un diaporama.
ÉTAT ACTUEL DU DOSSIERDOSSIER BROUILLON
2éléments encore manquants
01PRÊT
Scénario calibré
Volume, situation manuelle initiale, part éligible, fourchette de planification et hypothèse de mise en place.
02PRÊT
Protocole préenregistré
Niveau, horizon, jeu figé, échantillon réel borné, seuils et décisions possibles.
03CONSIGNÉ
Décision
Valeur, qualité, sécurité, trace, éligibilité et dénominateur observés, puis prochaine action autorisée.
04À COMPLÉTER
Fiche d’exploitation
Responsables nommés, périmètre, surveillance, arrêts, retour arrière, gestion du changement et date de revue.
JOINDRE OU RÉFÉRENCER CES SIX ENREGISTREMENTS
01
Mandat signé, périmètre, personnes affectées et situation manuelle actuelle avec dénominateur.
02
Inventaire exact du système : modèle, instructions, sources RAG, outils, permissions, règles, fournisseurs et versions.
03
Identifiant ou empreinte du jeu d’évaluation figé, segments, cas adversariaux, seuils et résultats reproductibles.
04
Registre des cas réels avec éligibilité, validations, corrections, appels d’outils, destinations, effets externes, relectures et retours arrière.
Responsables d’exploitation et d’incident nommés, contact, preuve de la solution de repli, exercice de retour arrière, prochaine revue et voie de retrait.
DE LA MÉTHODE À UN VRAI PILOTE
Préparez un vrai pilote sans publier les preuves brutes.
Cadrez l’observation, conservez le dénominateur complet, révisez l’anonymisation et exportez un brouillon local. Rien de ce qui est saisi ici n’est transmis à un serveur ni admis dans le registre public.
01Cadrer
Un processus, une version, une situation initiale, une population et une règle d’arrêt.
02Observer
Conserver les cas acceptés, échoués, exclus, transmis à une personne et les traces manquantes.
03Réviser
Une personne indépendante contrôle la provenance, l’anonymisation et les limites de transfert.
04Admettre ou retenir
Seuls les rapports révisés et anonymisés peuvent rejoindre le registre public.
FRONTIÈRE DE CONFIDENTIALITÉBrouillon local uniquement · Ne saisissez ni nom de client, donnée personnelle, secret, contenu privilégié, instruction brute ou détail de sécurité exploitable.
03
Explorer les cas et contrôlesParcours par structure, secteurs, onze cas, orientation du risque, contrôles et modèles.
+
UN SUJET À LA FOIS
Choisissez ce dont vous avez besoin maintenant.
Seul le sujet choisi apparaît ensuite. Vos choix précédents restent disponibles pendant l’exploration.
Ouvert maintenantChoisir le parcours de la structure
Adaptez responsabilités, rythme et protections à l’indépendant, l’entreprise, l’association ou le service public.
PARTEZ DE VOTRE RÉALITÉ
Choisissez la structure dans laquelle vous intervenez.
Même méthode. Profondeur différente pour les contrôles, les preuves et les responsabilités.
VOTRE PLAN DE DÉPART · 01
Indépendant
Un processus peu risqué, mesuré et doté d’une procédure manuelle.
Responsabilité minimale
Le propriétaire du processus prend aussi la décision finale.
Bon premier pilote
Brouillon, extraction structurée ou comparaison de fournisseurs avec validation humaine.
Jours 1–2
Choisir le problème
Mesurer cinq tâches répétitives et exclure les décisions à fort impact.
Jours 3–7
Poser les limites
Choisir l’outil le plus simple et construire 20 à 50 tests représentatifs.
Jours 8–10
Observer en parallèle
Produire sans envoyer, publier ou modifier quoi que ce soit.
Jours 11–14
Décider
Continuer, corriger ou arrêter selon le seuil écrit.
Le processus reste universel. Les conditions de mise en service, non.
Choisissez d’abord le parcours de la structure, puis ajoutez chaque extension qui touche le service. Un hôpital peut cumuler les conditions propres à la santé et aux infrastructures critiques.
01
Processus universel
Responsable, situation initiale, risque, évaluations et pilote.
02
Condition bloquante du secteur
Nommer le dommage qu’un gain d’efficacité ne compense pas.
03
Mise en service bornée
Ne conserver que l’autorité dont la sûreté est démontrée dans ce contexte.
Ces extensions sont opérationnelles, pas des qualifications juridiques. Vérifiez rôle, juridiction, produit, population et règles sectorielles avant la mise en service.
LA BOUCLE OPÉRATIONNELLE
Douze phases du cycle de vie, regroupées en huit étapes de travail.
Il s’agit des étapes de la méthode, pas de numéros de version. N’ouvrez que l’étape utile maintenant. Chacune se termine par une preuve concrète, pas par une présentation.
CYCLE DE VIE INTERACTIF
Parcourez les phases 0 à 11 sans tout ouvrir en même temps.
Vos saisies peuvent être enregistrées dans ce navigateur et reprises plus tard. Utilisez seulement des informations de travail non identifiantes. L’atelier guide une décision ; il ne certifie aucune conformité.
StructureIndépendant
Mode d’usageRecherche augmentée
IntégrationElle exécute un processus borné
TerritoireSuisse + UE
Phase actuelle · 0/11
Mandat
Quel problème observable mérite d’être changé, et qui peut décider ?
?
Pourquoi c’est important
Une demande d’outil sans responsable, limite et date de décision ne peut pas devenir un projet redevable.
Preuve à conserver
Mandat validé avec responsable, personnes affectées, limites et date de décision.
Contrôles déjà associés
AAP-GOV-001Mandat et autorité de décision nommésSOCLE
ENREGISTREMENTS PROJET RELIÉS
Transformer les réponses en documents réellement exploitables.
Le guide préremplit les champs reliés. Modifiez seulement ce qui exige une décision propre au projet, puis gardez responsables, dates et références de preuve avec le travail.
Mode d’usageRecherche augmentée
Route juridiqueSuisse + UE
REG
Registre du système IA
Conserver une identité opérationnelle unique pour le système, sa finalité, ses limites, son responsable, son fournisseur et sa revue.
?
Utilité de cet enregistrement
Un registre rend le périmètre et les responsabilités accessibles sans rouvrir toutes les discussions du projet.
REVUE DES CHANGEMENTS
Voir ce qui a changé avant qu’une ancienne décision devienne une hypothèse silencieuse.
Chargez un ancien export de ce dossier. La comparaison reste dans ce navigateur, présente une différence à la fois et consigne la réponse avec le changement.
Aucun dossier de référence chargé
Exportez le dossier avant un changement significatif, puis utilisez ce fichier ici comme version de référence.
Dossier projet local
Reprendre ce projet plus tard
Les réponses et contrôles sélectionnés sont enregistrés uniquement dans ce navigateur. Exportez le fichier JSON pour déplacer ou sauvegarder le dossier de travail.
Ne saisissez aucune preuve client brute, aucun secret ni aucune donnée personnelle identifiante. Le stockage du navigateur n’est pas un dépôt de preuves autorisé.
Chaque cas possède sa structure, sa tâche, sa limite d’autonomie et son contrat de preuve. Choisissez le cas le plus proche, pas le chiffre le plus élevé.
Ouvert maintenantCopilote de petite entreprise
Une boîte partagée avec revue humaine et aucun envoi automatique.
CAS COMPLET · TPE FICTIVE
Une boîte mail partagée devient un copilote mesuré.
Suivez un cas borné, de sa situation initiale sur quatre semaines jusqu’à une décision conditionnelle. Les chiffres sont synthétiques ; la structure de preuve est réutilisable.
8 personnes · 30 jours · validation humaine
Atelier Horizon
Atelier Horizon reçoit devis, pannes, questions de facturation et réclamations dans une boîte partagée. L’objectif reste volontairement étroit : proposer l’attribution et préparer un brouillon, sans jamais envoyer ni modifier un système.
360demandes / mois
11 mintraitement initial
8 min 35traitement pilote
0envoi automatique
01 · JOURS 1–7
Mesurer
Temps, réponses le jour même, reprises et erreurs d’attribution sont relevés avant de choisir l’outil.
02 · JOURS 8–14
Borner
Aucun envoi, promesse de prix, écrit CRM, changement de planning ou réponse à une demande ambiguë.
03 · AVANT PILOTE
Évaluer
Quarante cas gelés doivent franchir les seuils d’attribution, extraction, escalade, affirmation, correction et temps.
04 · JOURS 15–21
Observer sans effet
Le copilote propose sans influencer les réponses réelles ; chaque version de configuration est conservée.
05 · JOURS 22–30
Utiliser en copilote
Trois personnes formées acceptent, corrigent ou rejettent chaque catégorie et brouillon avant l’envoi.
06 · GATE
Continuer sous conditions
Valeur et fiabilité passent. Envoi automatique et écriture restent interdits pendant que les segments faibles reçoivent plus de tests.
GATE 03 · DECISION
La décision utile n’est pas « l’IA fonctionne ».
Elle est : conserver le copilote mesuré pendant 60 jours, revoir les erreurs chaque semaine, répéter le jeu gelé après chaque changement et n’envisager l’automatisation que pour un sous-ensemble stable et réversible.
Le devis devient un dossier gouverné, pas un paragraphe plus rapide.
Cette PME industrielle fictive de 42 personnes teste un agent métier sur un seul processus de devis catalogue. Les bornes basse et haute restent visibles, les demandes exclues restent au dénominateur et chaque prix exige toujours une approbation.
42 personnes · 160 demandes/mois · pilote 90 jours · fictif
Noroît Mécanique SA
Noroît Mécanique SA reçoit ses demandes de devis par courriel, avec PDF et tableaux. L’agent qualifie la demande, contrôle client autorisé, catalogue, matrice de prix et délai, puis prépare et vérifie le devis. Il attend une approbation explicite avant d’écrire dans l’ERP et le CRM et d’envoyer au destinataire affiché.
A2PROCESSUS COMPLET · APPROBATION HUMAINE
01Qualifier
Client connu, produit catalogue, unités complètes
02Extraire
Références, quantités, destinataire, date demandée
03Ancrer
CRM, catalogue, matrice de remise, délai ERP
04Calculer
Règles déterministes de prix et de marge
05Vérifier
Faits, conflits, règles et effets prévus
06Approuver
Une personne voit prix, sources et destination
07Exécuter
Devis ERP, journal CRM, courriel et relecture
BAS / CENTRAL / HAUT
Une formule. Trois scénarios de planification honnêtes.
160 demandes × part éligible × 76 minutes initiales × réduction sur l’éligible. La capacité n’est pas du revenu.
BAS
60,8 h60 % éligible · −50 %
CENTRAL
97,3 h75 % éligible · −64 %
HAUT
129,2 h85 % éligible · −75 %
76 → 27 mintemps humain médian des devis éligibles acceptés
Ces sources rendent l’enveloppe plausible ; elles ne valident pas le résultat synthétique de Noroît. Le jeu gelé local, le journal des cas réels, les erreurs, les approbations, les coûts complets et les résultats en aval déterminent la décision.
DÉCISION 04 · NIVEAU D’AUTONOMIE
Conserver A2. Ne pas transformer un bon processus d’approbation en revendication A3.
Le cas observé se place près du central : 89,8 heures de capacité mensuelle, environ 4 500 CHF nets des coûts récurrents et un retour simple de la mise en place proche de 3,5 mois. Pièces sur plan, remises exceptionnelles, contrats et prix final restent humains.
CAS COMPLET 03 · FONDATION · DOSSIERS DE SUBVENTION · A2
L’agent prépare les preuves. Le comité décide.
Cette fondation fictive de 14 personnes teste un agent A2 sur l’administration des subventions, pas sur le jugement. Chaque canal exclu reste ouvert, chaque décision de financement reste humaine et un dommage à la mission annule le gain de productivité.
La Fondation Lien Local traite 720 demandes de micro-subvention par an en trois langues. L’agent contrôle l’entrée du processus, inventorie et cite les pièces, applique une liste de contrôle publiée, puis prépare un dossier pseudonymisé. Après approbation, il enregistre et attribue ce dossier. Il ne note jamais le mérite, le besoin ou la probabilité de financement.
Conserver l’A2 administratif. Interdire le jugement automatisé des subventions.
Le cas observé libère 37,5 heures administratives par mois, environ 1 575 CHF nets des coûts récurrents, avec un retour simple proche de 7,6 mois. C’est une capacité, pas une subvention supplémentaire. Toute extension exige consultation, échantillons plus larges par langue et canal, et recours testé.
CAS COMPLET · SERVICE PUBLIC · DOSSIERS D’URBANISME · A2
L’autorité reste visible à chaque décision.
Cette commune suisse fictive teste un agent A2 sur la complétude administrative, pas sur le jugement urbanistique. Le processus ne peut accélérer que si le mandat, l’achat, les preuves, l’information publique, le recours, les archives et le service sans IA avancent avec lui.
62 000 habitants · service de 17 personnes · 90 jours · fictif
Ville de Mont-Rive
La Ville de Mont-Rive reçoit 1 080 demandes d’autorisation par an en français et en allemand. L’agent inventorie les pièces, extrait des faits administratifs cités et applique une checklist publiée. Après approbation, il envoie, enregistre et attribue. Il ne déclare jamais la complétude, n’interprète pas le droit et ne recommande ni octroi, ni refus, ni condition, ni priorité.
P0–P5DÉCISIONS PUBLIQUES FORMELLES
01Admettre
Autorité, signature, canal et type de demande connu
02Inventorier
Pièces, versions et données nécessaires
03Extraire
Parcelle et projet avec citations de page ou de plan
04Recouper
Checklist publiée et sources officielles contrôlées
05Préparer
Liste de compléments ou paquet neutre
06Approuver
Sources, incertitude, destinataire et effets
07Enregistrer
Envoi, registre, attribution et relecture des effets
L’AGENT A2 TRANSPORTE
État versionné et extraction reliée aux sources
Checklist administrative publiée
Projet de demande de complément
Paquet neutre avec incertitudes
Écriture au registre et attribution après approbation
LES PERSONNES ET L’AUTORITÉ GARDENT
Assistance et canaux hors ligne
Qualification juridique et égalité de traitement
Visites, oppositions et contexte local
Octroi, refus, conditions, motifs et signature
Accès au dossier, contestation, recours et responsabilité
BAS / CENTRAL / HAUT
Un cas public peut échouer même si l’outil gagne du temps.
90 demandes × part du processus × 145 minutes initiales × réduction. Mise en place : 48 000 CHF ; coût récurrent : 3 200 CHF par mois, gouvernance et sortie incluses.
BAS
39,2 h45 % du processus · −40 % · coût récurrent non couvert
CENTRAL
71,8 h60 % du processus · −55 % · retour 20,0 mois
HAUT
106,5 h72 % du processus · −68 % · retour 9,4 mois
145 → 58 mintemps humain médian par paquet accepté
×2,50débit théorique par heure de collaborateur
121/166prêts à approuver sans correction
≈ −35 %plafond portefeuille sur les 270 demandes
100 %décisions publiques prises par des personnes qualifiées
P0 → P5
Six décisions avant la production publique
P0Opportunité
Mandat, situation initiale, options non-IA et autorité de décision.
P1Droit + impacts
Droit applicable, droits, langues, accessibilité et recours.
P2Achat
Audit, sous-traitants, conservation, changements, export et sortie.
P3Preuve indépendante
Cas représentatifs, segments, sécurité, abus et pannes.
P4Pilote contrôlé
Observation sans effet, approbateurs nommés, plainte et arrêt immédiat.
P5Production redevable
Décision signée, information publique, archives, solution de repli et retrait.
Résultat terrain, borne haute de tâche, analogue de gouvernance
Autoriser l’A2 administratif pendant six mois. Maintenir le pouvoir de décision humain.
L’observation normalisée indique 76,4 heures de capacité mensuelle, environ 2 757 CHF nets du coût récurrent et un retour simple proche de 17,4 mois. Le cas bas échoue au seuil économique. Une analyse de conformité, un changement de motifs ou de priorité, ou un changement de modèle fournisseur renvoie le système à P0.
Quatorze jours pour tester une seule frontière utile.
Un petit pilote doit éclairer une petite décision. Suivez une consultante indépendante, des notes de rendez-vous au suivi relu, sans connecter messagerie, calendrier ou systèmes clients.
PILOTE14JOURSCOPILOTE · 1 personne · 14 jours · R2/A1
CAMILLE REY · CLIENT FOLLOW-UP
Des notes au suivi relu.
Camille Rey consacre une médiane de 44 minutes à transformer ses notes en compte rendu, actions et courriel de suivi. Le pilote teste un premier brouillon structuré ; prix, engagements, destinataires et envoi restent exclusivement humains.
Aucun enregistrement
Aucune connexion mail
Aucun prix ni engagement
L’humain choisit et envoie
−23 %temps médian de préparation
12/14prêts en moins de 24 h
4/14reprises majeures
0engagement inventé
01JOURS 01–02Mesurer
Confirmer 22 suivis historiques, la solution manuelle de repli, les règles de données et un plafond de huit heures de préparation.
02JOURS 03–07Geler
Régler sur 12 cas autorisés, puis décider sur 12 cas distincts avec des seuils écrits à l’avance.
03JOURS 08–10Shadow
Produire cinq brouillons, révélés seulement après la rédaction manuelle du véritable suivi.
04JOURS 11–14Copilote
Relire neuf brouillons avec les notes. Ajouter le commercial, choisir le destinataire et envoyer manuellement.
DÉCISION 02 · PÉRIMÈTRE
Prolonger 30 jours le copilote de brouillon.
La médiane passe de 44 à 34 minutes et les seuils critiques sont franchis, mais 29 % des brouillons exigent encore une reprise majeure. Aucun envoi automatique, proposition complète ou raccordement système n’est justifié.
Le même suivi devient un processus complet soumis à approbation.
La phase 2 conserve la même professionnelle, la même situation initiale et le même résultat attendu. Ce qui change, c’est le système : outils autorisés, état persistant du dossier, contrôle qualité, exécution après approbation et traitement explicite des exceptions.
1 personne · 30 jours · R2/A2 · cas fictif
Camille Rey · Phase 2
Après le pilote copilote A1, Camille teste un agent métier sur 20 suivis éligibles. Il lit le contexte CRM autorisé, prépare le compte rendu et les actions, puis vérifie faits et règles. Il attend une approbation explicite avant de mettre à jour le CRM, de créer les tâches et d’envoyer le courriel relu.
A2ACTION APRÈS APPROBATION
01Capturer
Notes structurées et test d’éligibilité
02Contextualiser
CRM en lecture et règles client
03Composer
Compte rendu, actions et suivi
04Vérifier
Faits, dates, règles et conflits
05Approuver
Une décision humaine informée
06Exécuter
Courriel, CRM, tâches et journal d’audit
L’AGENT PREND EN CHARGE
État du dossier et séquence des outils
Contrôles des faits et des règles
Brouillon, fiche CRM et préparation des tâches
Exécution après approbation
Journal complet des actions et erreurs
LA PERSONNE GARDE
Éligibilité et finalité
Prix, périmètre et engagements
Approbation ou refus
Exceptions ambiguës ou sensibles
Revue hebdomadaire des erreurs et de la valeur
44 → 14 mintemps humain actif médian · −68 %
×3,1suivis acceptés par heure du responsable
13/20prêts à approuver sans correction
3/20correctement escaladés
0action externe sans approbation
Même travail. Trois affirmations différentes.
A1 · Copilote44 → 34 min
Rédige une étape ; la personne pilote et termine le processus.
A2 · Agent métier44 → 14 min
Exécute le processus borné complet, uniquement après approbation.
A3 · CandidatNon revendiqué
L’envoi autonome à faible risque exige 50 cas supplémentaires et une nouvelle décision.
01JOURS 01–05Connecter sans ouvrir
Identité séparée, moindre privilège, CRM d’abord en lecture, écritures idempotentes, coupe-circuit et solution manuelle de repli testée.
02JOURS 06–12Rejouer les cas gelés
Exécuter 40 cas représentatifs avec conflits, contexte manquant, demandes de prix, injection d’instructions, actions dupliquées et outils indisponibles.
03JOURS 13–20Observer sans effet
Comparer le processus complet proposé au véritable suivi manuel ; aucun courriel ni écrit n’atteint un système réel.
04JOURS 21–30Exploiter en A2
Camille examine un dossier de preuves, approuve ou refuse, puis l’agent exécute les actions autorisées et journalise chaque effet.
GATE 04 · DÉCISION D’AUTONOMIE
Conserver A2 pendant 60 jours. Ne pas revendiquer A3.
Le gain devient important parce que le système prend désormais en charge le processus, pas parce que le modèle écrit simplement plus vite. L’envoi autonome reste bloqué jusqu’à 50 cas éligibles supplémentaires, zéro erreur critique, des exceptions stables, au plus 10 % de reprises majeures et un retour arrière vérifié.
CAS COMPLET 04 · AGENCE ORCHESTRÉE · INDÉPENDANT · A3
Une agence multi-agents transforme un diagnostic standard en chaîne de production gouvernée.
L’orchestration devient utile lorsque le travail contient des rôles distincts de recherche, d’analyse, de qualité et d’exécution qui peuvent avancer en parallèle. Le périmètre reste un service éligible, pas toute l’entreprise.
1 responsable · 60 jours · 60 cas gelés + 12 cas réels · fictif
Camille Rey · Diagnostic standard
Camille réalise un diagnostic opérationnel standardisé pour des petites entreprises déjà clientes. Après l’entretien, l’agence qualifie le dossier, collecte les preuves autorisées, note le processus, produit rapport et plan d’action, conteste ses propres conclusions puis exécute les opérations CRM, tâches, livraison et planification à faible risque prévues par la politique du service.
A3AUTONOMIE BORNÉE
ORCHESTRATEUR
Une politique. Six spécialistes.
Distribue le travail, impose la politique du dossier, résout les dépendances, s’arrête en cas de désaccord et n’accepte jamais le succès déclaré d’un spécialiste sans preuve de l’effet.
01Admission
Identité, éligibilité, minimisation
02Preuves
Sources autorisées et citations traçables
03Analyste
Diagnostic, score et incertitude
04Livraison
Rapport, actions et structure client
05Gardien
Faits, contradictions, risque et permissions
06Exécuteur
Livraison, CRM, tâches et planification
PLAN DE CONTRÔLE PARTAGÉ
État du dossier versionné
Identités au moindre privilège
Journal des événements et effets
Évaluations gelées
Limites de coût et concurrence
Fallback manuel + coupe-circuit
COMPARAISON À TRAVAIL IDENTIQUE
Temps humain actif pour le même diagnostic accepté
Manuel
7 h 40Référence
A1 · Copilote
5 h 50−24 %
A2 · Agent unique
2 h 35−66 %
A3 · Agence orchestrée
58 min−87 %
×7,9diagnostics acceptés par heure du responsable
9/12acceptés sans reprise majeure
8/12cas éligibles terminés de bout en bout
4/12arrêtés et escaladés avant effet
5 h 20cycle interne médian contre 18 h
0engagement ou écrit non autorisé
01JOURS 01–10Décomposer le service
Séparer les rôles, les entrées, les sorties, les permissions, les frontières de panne, les preuves des effets et les situations qui doivent rester humaines.
02JOURS 11–25Geler la comparaison
Faire passer 60 cas par les conditions manuelle, copilote, agent unique et agence orchestrée ; mesurer la sortie acceptée, pas l’activité des agents.
03JOURS 26–40Observer l’agence
Exécuter les spécialistes en parallèle sans effet réel. Injecter un désaccord, une mémoire périmée, une panne d’outil, un événement dupliqué et une source empoisonnée.
04JOURS 41–60Exploiter A3 dans ses limites
N’autoriser que les effets catalogués à faible risque sur les cas éligibles. Le droit de blocage du gardien, les limites de coût, le retour arrière et la transmission à une personne restent actifs.
GATE 05 · DÉCISION DE PÉRIMÈTRE
A3 est validé pour un service standard. A4 reste à démontrer.
L’agence peut continuer pour le diagnostic défini et ses effets catalogués. Elle ne peut choisir de nouveaux services, prix, contrats, clients, classes de données ou permissions. Une large autonomie sur plusieurs systèmes exige un mandat distinct, un audit indépendant et des preuves sur plusieurs processus.
Montez d’un niveau à la fois. Arrêtez-vous dès qu’un système plus simple répond au besoin.
1Processus manuel documenté
2Règle déterministe
3Automatisation classique
4Appel de modèle unique
5Recherche contrôlée
6Workflow avec approbation
7Agent métier borné
8Orchestration multi-agents
9Agence multi-systèmes supervisée
ORIENTATION RAPIDE DES CONTRÔLES
Voyez comment l’impact et l’autonomie modifient le niveau de contrôle.
Il s’agit d’un triage interne, pas d’une qualification juridique.
RÉFÉRENTIEL VERSIONNÉ · JSON 1.1
Transformez un niveau de risque en contrôles qui laissent des preuves.
La structure, l’impact, l’autonomie, le mode d’usage et la juridiction conduisent à des identifiants de contrôle stables. Chaque ligne expose son déclencheur, ses preuves, ses points de décision, ses phases et ses sources datées.
18contrôles candidats
Indépendantorganisation
R1 × A1profil actif
Recherche augmentéemode d’usage
Suisse + UEroute juridique
12sources versionnées
AAP-GOV-001Mandat et autorité de décision nommésSOCLE
Relier le système à un problème mesurable, un mandat borné, des actions interdites et une personne responsable de la décision finale.
AAP-DAT-001Carte des données et traitements liée à la finalitéRENFORCÉ
Documenter provenance, finalité, accès, lieux de traitement, réutilisation, conservation, suppression et sous-traitants avant toute donnée personnelle ou confidentielle.
Preuves requises
EV-DATA-MAP · Carte des données et traitements / EV-RISK-ASSESSMENT · Évaluation risque et autonomie
Gates de décision
G1 · G2 · G5 · P1 · P2 · P5
Phases du cycle de vie
2 · 4 · 5 · 9 · 11
Références sources
AAP-PROCESS-02 · CH-FDPIC-AI-DP · NIST-AI-100-1
Condition de déclenchementLorsque des données personnelles ou confidentielles sont traitées
AAP-SUP-001Fournisseur auditable et conditions de sortieRENFORCÉ
Préserver audit, notification des changements, export, suppression, continuité et sortie lorsqu’un fournisseur externe participe au système.
Condition de déclenchementLorsque du contenu externe ou des outils franchissent une frontière de confiance
AAP-HUM-001Approbation, reprise en main et recours humain effectifsCRITIQUE
Garantir qu’une personne qualifiée dispose des informations, du temps, de l’autorité et du canal opérationnel nécessaires pour rejeter, corriger, reprendre et traiter les recours.
Preuves requises
EV-APPROVAL-RECOURSE · Registre d’approbation et de recours / EV-EVALUATION-REPORT · Rapport d’évaluation segmenté
Gates de décision
G2 · G3 · G4 · G5 · P1 · P3 · P4 · P5
Phases du cycle de vie
4 · 6 · 8 · 9 · 10
Références sources
AAP-PROCESS-02 · NIST-AI-100-1 · CH-FDPIC-AI-DP
Condition de déclenchementLorsque des personnes peuvent être matériellement affectées
AAP-TRC-001Trace de décision et d’effet de bout en boutRENFORCÉ
Relier chaque dossier à la configuration exacte, aux preuves, à l’approbation, aux paramètres d’outil, à l’effet externe, à sa relecture, à l’acteur et au temps.
Condition de déclenchementLorsque des personnes peuvent être matériellement affectées
AAP-OPS-002Réponse aux incidents attribuée et testéeCRITIQUE
Donner à un responsable joignable l’autorité et la procédure testée pour contenir, préserver les preuves, notifier, révoquer, rétablir et déclencher une réévaluation.
Condition de déclenchementLorsque du contenu externe ou des outils franchissent une frontière de confiance
AAP-MON-001Surveillance des résultats et réévaluation après changementSOCLE
Surveiller résultats métier, segments critiques, corrections, incidents, dérive et coût ; revenir au bon gate après tout changement matériel de modèle, donnée, outil, permission ou population.
Preuves requises
EV-CHANGE-REVIEW · Revue de changement et de surveillance / EV-EVALUATION-REPORT · Rapport d’évaluation segmenté
AAP-RET-001Retrait planifié, export, suppression et révocationSOCLE
Arrêter proprement le système en révoquant les accès, exportant ce qu’exige la continuité, traitant les données, conservant les preuves requises et rétablissant un processus sûr.
Preuves requises
EV-RETIREMENT · Dossier de retrait / EV-VENDOR-DOSSIER · Dossier fournisseur et sortie
AAP-EVA-003Évaluation adaptée au mode d’usage IASOCLE
Ajouter mesures et règles d’arrêt propres à la recherche, classification, prédiction, conversation, au multimodal ou à l’agentique lorsque ces modes sont présents.
Preuves requises
EV-EVALUATION-PLAN · Plan d’évaluation préenregistré / EV-EVALUATION-REPORT · Rapport d’évaluation segmenté
AAP-SEC-003Modèle de menace adapté au mode d’usage IARENFORCÉ
Étendre le modèle de menace à la recherche, au prédictif, à la conversation, au multimodal, à l’exécution de code, à la mémoire persistante et aux communications inter-agents selon le cas.
Preuves requises
EV-THREAT-MODEL · Modèle de menace du système IA / EV-SECURITY-TESTS · Registre des tests de sécurité adversariaux