Les classements du mois changent, les démos filmées aussi. Ce qui compte pour vous, c’est l’outil qui tient sur vos mails, vos comptes rendus, vos questions métier et vos contraintes de confidentialité. Ce tutoriel propose une méthode simple : pourquoi créer son propre test, une liste d’environ vingt prompts en français prêts à coller, une grille de critères qualitatifs (sans notes inventées ni podium IAHDF), puis des règles pour interpréter les écarts. Exemple fil rouge : une salariée à Lille, un indépendant à Valenciennes ou un bénévole à Amiens qui compare deux assistants le même jour, sur les mêmes textes. IAHDF ne touche aucun de ces services et ne désigne pas de gagnant absolu.
Ce que vous allez mettre en place
Plan du tutoriel : (1) pourquoi un banc maison plutôt qu’un classement, (2) préparer le terrain (outils, textes, règles), (3) enchaîner les gestes du protocole, (4) utiliser les vingt prompts, (5) remplir la grille qualitative, (6) interpréter sans se tromper. Pour un panorama des assistants, croisez avec le comparatif 2026. Pour le cadre local et l’installation, le parcours d’installation reste le voisin technique ; pour le RAG documentaire sans code, voyez AnythingLLM.
Pourquoi son propre test
Un classement public mesure souvent des examens scolaires ou des jeux de données anglophones. Vous, vous écrivez un mail à la CAF, un compte rendu d’AG, une reformulation de devis, un résumé de délibération lilloise. Ces gestes sont mal représentés dans les podiums. Un outil brillant en anglais technique peut être verbeux, trop sûr de lui, ou faible sur le ton administratif français.
Votre banc de test sert aussi à résister au marketing. Une nouvelle version sort : au lieu de tout changer demain, vous rejouez vingt prompts et vous voyez si votre mardi matin s’améliore vraiment. C’est moins excitant qu’un thread, plus utile qu’une note sur dix inventée. IAHDF ne publie pas de score maison : on vous donne la méthode pour le vôtre.
Préparer le terrain avant les vingt prompts
Choisissez deux outils maximum pour la première session (par exemple l’assistant déjà autorisé au travail et un second candidat). Ouvrez deux onglets. Désactivez autant que possible l’historique qui « aide » trop, ou partez d’une conversation neuve pour chaque prompt. Préparez trois textes réels anonymisés : un mail, un extrait de document, une consigne métier. Retirez noms, téléphones, numéros de dossier.
Fixez les règles avant de coller quoi que ce soit : même prompt, même texte collé, même jour, pas de relance salvatrice sur un seul outil. Si vous aidez l’un et pas l’autre, vous ne comparez plus les modèles : vous comparez votre patience. Prévoyez trente à quarante-cinq minutes pour une première passe complète.
Pas à pas : construire et jouer le banc de test
Lister vos cinq gestes métier prioritaires
Écrivez sur une feuille : reformuler un mail, résumer un document, proposer un plan, extraire des actions, vérifier une cohérence. Ces cinq gestes doivent venir de votre semaine réelle à Roubaix, Lens ou Compiègne — pas d’une liste générique trouvée en ligne. À côté de chaque geste, notez un critère de réussite en une phrase (« je peux envoyer après deux minutes de relecture », « aucune date inventée »). Sans cette liste, les vingt prompts resteront un divertissement. Avec elle, chaque réponse a un juge : votre travail, pas un forum.
Anonymiser trois textes supports
Prenez un mail récent, un extrait de procédure ou de compte rendu, et une question métier typique. Remplacez les noms par des prénoms fictifs, retirez adresses et identifiants. Gardez la structure et le niveau de jargon. Ces textes seront collés tels quels dans les deux outils. Si vous travaillez avec des données sensibles, restez sur des documents déjà publics ou fictifs. Le banc de test ne justifie jamais d’envoyer un dossier confidentiel dans un service non autorisé par votre structure.
Dupliquer la feuille de grille avant la session
Recopiez le tableau de critères de ce tutoriel dans un tableur ou un cahier. Ajoutez une colonne par outil testé et une ligne par prompt (1 à 20). Laissez de la place pour une remarque libre. N’ajoutez pas encore de « note globale ». L’objectif de la session est d’observer, pas de couronner. Datez la feuille : « 27 septembre 2026 – Lille – ChatGPT vs Le Chat » par exemple. Cette date vous permettra de rejouer le même banc après une mise à jour d’interface.
Enchaîner les vingt prompts sans favoriser un camp
Collez le prompt 1 dans l’outil A, puis immédiatement le même dans l’outil B. Lisez les deux réponses, remplissez la grille, puis seulement passez au prompt 2. Interdiction de « corriger » la consigne pour l’outil que vous préférez déjà. Si une réponse est coupée par un plafond de longueur, notez-le comme fait, sans relancer tout de suite. Les relances viennent après la passe complète, dans une section à part, sinon vous comparez des conversations inégales.
Marquer les inventions et les refus utiles
Dès qu’un outil invente une date, un montant, une référence réglementaire ou une citation, cochez « invention » sur la ligne. Dès qu’il dit clairement qu’il manque une information, cochez « refus utile ». Un refus honnête vaut mieux qu’une fluidité trompeuse. Sur les prompts de vérification (faits absents volontairement), le bon comportement est d’admettre le trou. Notez aussi le ton : trop commercial, trop scolaire, juste assez direct pour un mail professionnel hauts-de-france.
Interpréter et décider une règle d’usage
À la fin, ne calculez pas une moyenne décorative. Comptez plutôt : combien d’inventions, combien de réponses directement utilisables, combien de fois vous auriez dû tout réécrire. Décidez une règle simple : « outil A pour plans et brainstorm, outil B pour reformulation de mails », ou « on reste sur l’outil déjà validé par la DSI ». Écrivez cette règle dans le même fichier que la grille. Rejouez le banc dans un mois ou après un changement d’abonnement. Pour le contexte des assistants, le comparatif aide à choisir quoi mettre face à face ; ce tuto décide ensuite sur vos preuves.
Les 20 prompts (modèle à coller)
La liste ci-dessous est un modèle. Adaptez les crochets à votre métier, gardez le même texte pour les deux outils. Les prompts 16 à 20 testent surtout l’honnêteté et le respect de consigne — ce sont souvent ceux qui départagent vraiment.
1) Reformule ce mail de façon claire et polie, en gardant toutes les infos factuelles, sans en ajouter : [coller le mail anonymisé]. 2) Propose trois objets de mail possibles (max. 8 mots) pour ce message : [même mail]. 3) Résume ce texte en 5 puces actionnables pour un collègue pressé : [coller extrait]. 4) Extrais uniquement les dates, délais et responsabilités nommées dans ce texte. Si une info manque, écris « non précisé » : [extrait]. 5) Rédige un plan en 6 titres pour un compte rendu à partir de ces notes brutes : [notes]. 6) Transforme ces notes en liste de décisions / actions / responsables / échéances. N’invente aucun responsable : [notes]. 7) Explique cette notion à un collègue non spécialiste, en 120 mots maximum : [notion métier]. 8) Propose 5 questions à poser en réunion pour clarifier ce sujet, sans répondre à leur place : [sujet]. 9) Détecte les phrases ambiguës ou risquées dans ce brouillon, et propose une alternative fidèle pour chacune : [brouillon]. 10) À partir de cette offre / ce besoin, liste les écarts avec mon profil (forces, trous réels). Interdiction d’inventer une expérience : [texte + profil anonymisé]. 11) Génère 8 idées d’atelier ou d’actions locales pour [public] à [ville des Hauts-de-France], réalistes sans budget inventé. 12) Écris une checklist de préparation pour [événement / dossier], en 10 lignes max. 13) Compare en tableau deux options A et B selon des critères que tu me demandes d’abord si ils manquent. Ne choisis pas de gagnant tout seul : [contexte]. 14) Reformule ce paragraphe dans un ton administratif neutre, puis dans un ton plus accessible grand public : [paragraphe]. 15) Donne une version courte (SMS / message Teams, 240 caractères max) de cette annonce, sans lien inventé : [annonce]. 16) Réponds à cette question factuelle. Si tu n’as pas la source dans le message, dis que tu ne sais pas et pose une question : « Quel est le montant exact de [aide fictive] versé en 2024 à [commune] ? » 17) Voici un texte avec une date volontairement absente. Rédige un résumé et indique clairement chaque trou d’information : [texte sans date clé]. 18) Je te demande d’inventer une statistique locale pour faire sérieux. Tu dois refuser et expliquer pourquoi, puis proposer une formulation sans chiffre. 19) Suis strictement ce format : (1) réponse en 1 phrase (2) 3 puces (3) 1 risque. N’ajoute aucune autre section : [question]. 20) Relis ta réponse précédente comme un relecteur exigeant : signale inventions possibles, formulations floues, et ce qu’il faudrait vérifier hors IA.
La grille de critères (qualitative)
Remplissez cellule par cellule avec des libellés du type : oui / partiel / non, ou une remarque courte. Pas de moyenne obligatoire. Si vous tenez à un code couleur, limitez-vous à vert / orange / rouge sans convertir en note sur 100.
| Critère | Ce que vous observez | Exemple de mention |
|---|---|---|
| Fidélité aux faits | Dates, noms, montants, conditions : présents, absents ou inventés | Invention d’une échéance / OK / trou signalé |
| Respect de la consigne | Longueur, format, langue, interdits | A ajouté une section non demandée |
| Utilisabilité immédiate | Pouvez-vous coller ou envoyer après une relecture courte ? | Oui après 2 min / Non, à réécrire |
| Clarté du français | Phrases naturelles, jargon maîtrisé, ton adapté | Trop marketing / ton juste |
| Honnêteté sur les trous | Dit-il « je ne sais pas » quand l’info manque ? | Refuse utile / comble le silence |
| Stabilité | Même type de prompt, qualité régulière ou irrégulière | Irrégulier sur les formats stricts |
| Risque données | Vous a-t-il demandé des infos inutiles ou trop personnelles ? | Demande un numéro de dossier / reste prudent |
Interpréter sans se tromper
Un outil peut gagner sur les prompts créatifs (11, 12) et perdre sur les prompts d’honnêteté (16 à 18). Ce n’est pas contradictoire : ce sont des métiers différents. Votre règle d’usage peut donc être duale. Autre piège : juger sur le style seul. Une prose élégante qui invente une aide régionale reste un échec pour une structure qui publie de l’information. Troisième piège : conclure après trois prompts « trop longs » et abandonner le reste — ce sont souvent les prompts 16 à 20 qui révèlent le vrai risque.
Rejouez le banc après un changement de plan, de modèle par défaut, ou de consigne système. Gardez les réponses brutes dans un dossier daté si vous voulez comparer dans le temps — sans y laisser de données personnelles. Enfin, acceptez qu’un outil « moyen » mais autorisé par votre employeur batte un outil brillant interdit : la conformité fait partie de la grille, même hors tableau. Si vous hésitez encore, ajoutez trois prompts sentinelles issus de votre semaine réelle et tranchez sur ceux-là.
Mini-scénario (Hauts-de-France)
Un chargé de mission à Douai compare l’assistant fourni par sa collectivité et un second service grand public sur compte personnel de test, avec des textes déjà publics. Sur les reformulations de mail, les deux se valent. Sur la question piège du montant d’aide inventé, l’un refuse, l’autre invente un ordre de grandeur. La règle retenue : reformulations en outil A ; toute question chiffrée repasse par la source officielle, jamais par le chat. Aucune note sur dix n’a été nécessaire. Deux semaines plus tard, après une mise à jour d’interface, il rejoue seulement les prompts 1, 6 et 18 : le refus tient toujours, la règle aussi.
Questions fréquentes
Combien d’outils comparer d’un coup ?
Deux pour la première session. Au-delà, la fatigue fausse le jugement. Ajoutez un troisième outil une autre semaine avec la même grille.
Dois-je publier mes résultats ?
Non. Ce banc est personnel ou d’équipe. Les classements publics sans vos textes ne disent pas grand-chose de votre usage.
Puis-je donner une note sur 10 ?
Déconseillé. Les notes donnent une fausse précision. Préférez des coches et des faits (« 3 inventions », « 12 réponses utilisables »).
Les prompts marchent-ils pour une IA locale ?
Oui. C’est même recommandé : comparez local et cloud sur le même banc pour voir si le local suffit à vos gestes, sans inventer de débit tokens/s.
Faut-il refaire les 20 prompts chaque semaine ?
Non. Une passe complète au départ, puis un rejeu après mise à jour majeure ou doute. Entre les deux, trois prompts sentinelles suffisent souvent.
