En septembre 2026, IAHDF soumet GPT-5.6 Sol / Terra / Luna à un protocole d’épreuves en français, pensé pour des usages réels en Hauts-de-France — courriel de mairie, résumé de règlement, question piège sur le territoire. Ce texte décrit le geste, les critères qualitatifs et la façon de refaire le test chez vous, à partir d’une scène située près de Amiens. Aucune note sur dix, aucun pourcentage, aucun « gagnant » : les résultats bougent avec les versions et les offres. IAHDF n’est pas payé par OpenAI. Vérifiez toujours le nom exact du modèle sur la page de l’éditeur avant de conclure. Deux prompts copiables, une grille qualitative et une FAQ détaillée complètent le banc. Question des lecteurs : Est-ce le bon modèle pour moi ?
Ce que c’est
GPT-5.6 Sol / Terra / Luna désigne, dans ce test IAHDF daté du 27 septembre 2026, un modèle propriétaire accessible via ChatGPT. L’éditeur indiqué dans le plan éditorial est OpenAI. « Propriétaire » signifie ici que vous utilisez un service fermé : vous n’installez pas les poids du modèle chez vous ; vous envoyez une demande et vous recevez une réponse. Ce n’est ni un moteur de recherche officiel, ni une base juridique, ni le site de votre mairie.
Le nom exact peut varier d’un compte à l’autre. Avant toute conclusion, ouvrez ChatGPT, regardez le sélecteur de modèle ou la fiche « à propos », et notez le libellé affiché (y compris un numéro de version s’il apparaît). Le point à vérifier avant publication éditoriale reste : Nom exact, date de sortie, prix et disponibilité en France. Ne recopiez pas une fiche technique trouvée sur un blog : allez à la page de OpenAI.
Sol, Terra et Luna désignent, dans le plan éditorial septembre 2026, trois déclinaisons de GPT-5.6. Ne supposez pas qu’elles existent toutes dans votre compte : ouvrez le sélecteur de modèle de ChatGPT et notez les libellés réellement proposés le jour du test. Luna est souvent associée à l’accès gratuit dans les discussions de la communauté — vérifiez sur la page d’offre, sans recopier un prix ici.
Le cœur de cet article n’est pas « laquelle gagne », mais « laquelle vous laisse un brouillon relisible pour votre courriel d’Amiens ». Refaites le même prompt sur chaque déclinaison accessible. Pour situer l’outil dans le paysage des assistants, croisez avec ChatGPT, Le Chat, Claude, Gemini ou le comparatif 2026 selon votre écosystème.
Pour qui
Ce test s’adresse aux débutants curieux comme aux personnes déjà à l’aise avec les assistants — d’où le niveau « Débutant à avancé ». Il parle à un service communication d’une collectivité près d’Amiens, à un indépendant qui rédige des devis, à un agent qui prépare un message public, ou à un bénévole qui veut gagner du temps sur un compte-rendu. La question commune : « Est-ce le bon modèle pour moi ? »
Il est moins utile si votre structure interdit déjà ChatGPT, si vous devez traiter des dossiers nominatifs, ou si vous cherchez un classement chiffré pour trancher un achat. Dans ces cas, commencez par la règle interne, puis lisez les bons réflexes et un guide données du type où part le texte (si vous travaillez sur des contenus sensibles).
Un bon indice « pour vous » : vous avez un vrai texte de la semaine à Amiens (ou dans votre commune), vous acceptez de relire, et vous voulez comparer le ressenti avec un autre modèle du banc IAHDF — par exemple en enchaînant sur GPT-5.6 Sol / Terra / Luna ou un autre test de la série.
Protocole d’épreuves
Le protocole IAHDF pour les modèles propriétaires reprend des gestes du terrain plutôt qu’un examen académique. Nous ne publions pas de note sur cinq, pas de score Elo, pas de pourcentage MMLU, pas de « vainqueur du mois ». Nous décrivons ce que nous avons demandé, comment juger la réponse, et comment vous pouvez reproduire le geste avec vos propres documents publics ou anonymisés.
Épreuves centrales de cet article : (1) rédiger un courriel de mairie ou d’association en français clair ; (2) résumer un règlement ou une délibération courte que vous collez vous-même ; (3) poser une question piège sur le nom du président de la Métropole européenne de Lille pour observer si le modèle invente ; (4) reformuler en français administratif (ou, si le sujet s’y prête, tester une reformulation ch’ti / picard sans en faire une preuve de « culture locale »). D’autres gestes (tableau, image, code) peuvent s’ajouter chez vous ; ils ne sont pas nécessaires pour un premier avis.
Scène de référence : un service communication d’une collectivité près d’Amiens. Partez d’un besoin réel — annoncer une fermeture exceptionnelle, rappeler une inscription, expliquer une règle de prêt — plutôt que d’un sujet inventé pour « coincer » l’IA. Vous mesurerez mieux ce qui vous servira mardi matin.
Déroulé conseillé en quarante-cinq minutes chrono : dix minutes pour préparer les faits et anonymiser ; dix minutes pour le courriel ; dix minutes pour le résumé de règlement ; dix minutes pour la question piège et la relecture croisée ; cinq minutes pour remplir la grille qualitative. Si vous dépassez, c’est souvent que le collage est trop long — raccourcissez le document source plutôt que d’accepter un résumé flou.
Pour un service communication d’une collectivité près d’Amiens, imaginez deux destinataires : un habitant pressé qui lit sur téléphone, et un collègue qui devra reprendre le texte. Si GPT-5.6 Sol / Terra / Luna produit un message lisible pour le premier mais inutilisable pour le second (trop vague, trop emphatique, trop d’inventions), l’étiquette « fragile » s’impose même si le style plaît. Le banc IAHDF mesure l’utilité de terrain, pas la séduction d’une démo filmée.
Écriture française
Sur l’écriture française, regardez d’abord la clarté : phrases courtes, vouvoiement cohérent, pas de calques anglais inutiles (« challenge », « process », « feedback ») sauf si votre public les emploie déjà. Demandez explicitement un ton simple et concret. Refusez les formules creuses du type « n’hésitez pas à nous contacter pour toute information complémentaire » si votre message doit déjà tout dire.
Pour Amiens, un bon test consiste à coller trois faits vrais que vous connaissez (date, lieu, public) et à interdire toute invention. Si GPT-5.6 Sol / Terra / Luna ajoute un numéro de salle, un tarif ou un partenaire non fourni, marquez la réponse comme fragile. La fluidité du style ne rachète pas un fait inventé.
Observez aussi la ponctuation et les titles case inutiles : un message qui met une majuscule à chaque Mot pour « faire pro » sonne souvent importé. Demandez une version sans emphase marketing. Vérifiez les accords et les anglicismes cachés (« meeting », « call », « update ») : remplacez-les si votre public préfère réunion, appel, mise à jour. Ce polish compte dans l’étiquette « fluide ».
Prompt copiable n°1 ci-dessous : courriel type. Adaptez les crochets. Relisez à voix haute : si une phrase sonne artificielle, demandez une version plus courte plutôt que de tout régénérer. Gardez la première version dans un coin : parfois une correction ciblée (« enlève la deuxième phrase ») suffit mieux qu’une régénération complète.
Je suis [rôle] dans [structure] à Amiens (Hauts-de-France). Je dois écrire un courriel en français pour [public]. Objectif : [ce que le destinataire doit comprendre ou faire]. Ton : simple, concret, vouvoiement. Longueur : 120 à 180 mots. Faits autorisés uniquement : - [fait 1] - [fait 2] - [fait 3] Interdiction : inventer date, chiffre, nom d’élu, horaire, aide, lien ou partenaire. Si une information manque, pose une question avant d’écrire. Signe : [prénom + fonction], sans inventer de coordonnées.
Connaissance du territoire
Angle Hauts-de-France du CSV : Quiz Hauts-de-France + test ch'ti. Un modèle peut écrire un français élégant et se tromper sur Lille, Amiens, un élu ou une date. Notre épreuve piège porte sur le nom du président de la Métropole européenne de Lille. Nous ne cherchons pas à « piéger pour le plaisir » : nous observons si la réponse invente avec assurance.
EXEMPLE FICTIF D’HALLUCINATION (n’est pas une capture réelle) : « Le président de la MEL s’appelle Jean-Pierre Delattre depuis 2019. » — personnage et date inventés pour le test. Relisez toujours sur le site de la Métropole ou une source institutionnelle à jour.
Si le modèle refuse de répondre faute de source, c’est souvent un comportement plus sain qu’une réponse détaillée non sourcée. Si au contraire il livre un paragraphe précis sans document fourni, traitez chaque fait comme à revérifier. Pour la méthode générale de contrôle, voyez aussi les guides IAHDF sur la vérification des réponses (maillage du type vérifier une réponse lorsque disponible).
Pour ce sujet, nous privilégions le français administratif plutôt qu’un exercice dialectal. Une mairie, une association ou une TPE de Amiens a d’abord besoin d’un message clair, accessible, sans faute de ton. Le « local » utile, c’est la précision des faits que vous apportez, pas un pastiche.
Quand vous choisissez l’extrait à coller, préférez une page déjà publique : règlement intérieur affiché, délibération en ligne, conditions d’inscription. Évitez les notes internes et les noms. Si le résumé ajoute une sanction, un délai ou un tarif absent du texte, rayez-le immédiatement : c’est le signal « à revérifier », même si le reste paraît fluide.
Contexte : je colle ci-dessous un extrait de règlement / délibération PUBLIC (texte entre balises). Tâche 1 : résume en 8 puces maximum, français administratif clair, sans ajouter de règle absente du texte. Tâche 2 : liste ce qui reste ambigu et devrait être vérifié auprès de [service compétent]. Tâche 3 : question piège séparée — le nom du président de la Métropole européenne de Lille ? Si tu n’as pas le document ou la source, réponds « je ne sais pas » plutôt qu’inventer. <extrait> [COLLEZ ICI 1 à 3 pages d’un texte public, sans données personnelles] </extrait>
Données et réglages
Avant de coller un texte, cherchez dans ChatGPT les réglages liés à l’historique, à l’activité ou à l’amélioration du modèle. Les libellés bougent : cherchez les formulations du type « ne pas utiliser pour entraîner », « activité », « confidentialité ». Même avec un réglage restrictif, le texte quitte souvent votre poste : ne collez pas de liste d’adhérents, de paie, de dossier social ou de coordonnées inutiles.
Remplacez les noms par « personne A », « un usager », « la trésorière ». Travaillez sur des extraits publics (règlement affiché, page web, délibération publiée). Pour l’offre et la licence, le CSV indique : « Gratuit (Luna) / payant » — cela oriente le geste de vérification, ce n’est pas un tarif IAHDF. Ouvrez la page de OpenAI pour voir ce qui s’applique à votre compte aujourd’hui.
Prenez deux minutes au premier login pour localiser ces réglages, même si vous ne collez encore que des textes publics. Habituez-vous au geste avant d’en avoir vraiment besoin. Si vous ne trouvez rien de clair, notez-le dans votre journal : c’est déjà une information pour comparer avec un autre assistant. En structure, faites valider l’outil avant un usage collectif — un test personnel ne crée pas une autorisation d’équipe.
Si votre employeur ou votre collectivité impose un autre outil, suivez cette règle. Un « petit test » hors cadre peut quand même poser problème. Les ateliers IAHDF rappellent ces gestes : agenda et inscription.
Limites
GPT-5.6 Sol / Terra / Luna peut halluciner un élu, une date, une aide régionale ou un horaire. Il peut aussi lisser le ton jusqu’à un français générique peu adapté à Amiens. Sur l’actualité locale très fine, sans document fourni, la prudence s’impose. Les interfaces, les noms de modèles et les options changent plusieurs fois par an : ce texte ne fige aucun paramètre technique.
Autre limite : croire qu’un long collage améliore la vérité. Plus le texte est long et nominatif, plus le risque augmente. Travaillez par morceaux. Enfin, refusez les classements sponsorisés qui désignent un « gagnant » : IAHDF préfère des critères qualitatifs stables dans le temps.
Limite de lecture humaine : la fatigue. Après trois régénérations, on tend à accepter n’importe quel paragraphe « assez bien ». Fixez-vous une règle : au-delà de deux essais, vous reprenez la main et vous écrivez la phrase critique vous-même. Le modèle reste un assistant de brouillon, pas un signataire. Cette discipline évite les incidents de communication plus sûrement qu’un abonnement supplémentaire.
Critères qualitatifs (sans note)
Le tableau ci-dessous sert à annoter votre session. Choisissez une étiquette par ligne. Interdit dans ce banc : notes sur 10, Elo, MMLU, pourcentages de réussite, médaille de « meilleur modèle ». Si deux modèles semblent proches, gardez celui que votre équipe accepte d’ouvrir vraiment.
| Épreuve | Ce que l’on observe | Étiquette possible | Geste de contrôle |
|---|---|---|---|
| Courriel français | Clarté, vouvoiement, absence de faits ajoutés | fluide / fragile | Relire à voix haute ; rayer toute invention |
| Résumé de règlement | Fidélité au texte collé, puces utiles | fluide / à revérifier | Comparer phrase par phrase au document source |
| Question piège territoire | Invention ou refus prudent sur faits locaux | fragile / à revérifier | Ouvrir une page institutionnelle avant diffusion |
| Ton & longueur | Adapté au public de Amiens ou trop générique | fluide / fragile | Demander une version plus courte si besoin |
| Données & offre | Réglages trouvés, modèle réellement accessible | dépend de l’offre | Page OpenAI + réglages ChatGPT le jour J |
Comment lire une étiquette : « fluide » = brouillon utilisable après relecture légère ; « fragile » = style acceptable mais faits ou ton douteux ; « à revérifier » = chaque affirmation factuelle doit passer par une source ; « dépend de l’offre » = votre compte, votre pays ou votre abonnement change le résultat. Aucune de ces étiquettes n’est une note convertible en classement.
Comment refaire le test chez soi
Choisissez un créneau calme. Ouvrez ChatGPT. Notez le libellé exact de GPT-5.6 Sol / Terra / Luna (ou de la variante affichée). Préparez un courriel réel anonymisé et un court extrait public. Lancez les deux prompts de cet article. Remplissez la grille qualitative. Si possible, refaites le même exercice une semaine plus tard après une mise à jour — les résultats bougent avec les versions.
Comparez ensuite avec un autre test de la série (par exemple Claude Opus 5.5 ou Mistral / Le Chat) en gardant les mêmes textes sources. Pour le geste quotidien plutôt que le banc d’essai, revenez à le comparatif et aux fiches outil. Besoin d’un accompagnement humain : agenda, inscription.
Journal de bord utile (cinq lignes) : date ; libellé modèle ; offre (gratuit / payant / API selon ce que vous voyez) ; étiquette par épreuve ; une phrase « je garde / je ne garde pas pour mon usage ». Ce journal vaut mieux qu’une capture d’écran isolée partagée hors contexte. Un résultat fluide aujourd’hui ne garantit rien après une mise à jour de OpenAI : citez toujours la date de votre session.
Variante collective : en atelier, chaque participant teste le même prompt sur l’offre qu’il a réellement, puis on compare les étiquettes à voix haute sans chercher de vainqueur. Évitez de transformer ce banc en argument commercial. Si un prestataire brandit cet article, demandez la page officielle de OpenAI et un essai sur vos textes publics. Pour les prochaines dates : agenda.
Questions fréquentes
GPT-5.6 Sol / Terra / Luna est-il le bon modèle pour moi ?
La seule réponse honnête dépend de votre semaine, pas d’un classement. Si vous devez surtout écrire des messages clairs pour Amiens, testez le prompt courriel avec vos faits, relisez, et voyez si le brouillon vous fait gagner du temps sans inventer. Si votre structure impose un autre outil, ce test ne change pas la règle interne. Si vous manipulez des données personnelles, commencez par anonymiser et par chercher les réglages de confidentialité dans ChatGPT. IAHDF n’est pas payé par OpenAI : nous ne vous poussons pas à souscrire. Refaites le geste après chaque changement de version, car le ressenti peut évoluer sans que le logo change.
Pourquoi refuser les notes sur 10 et les pourcentages ?
Parce qu’un score unique donne l’illusion d’une vérité stable alors que les modèles propriétaires changent souvent. Une note agrège des tâches différentes (style, faits, vitesse perçue) et efface le contexte Hauts-de-France qui compte pour vous. Les pourcentages de « réussite » sur un quiz maison ne disent rien de votre prochain courriel. Les classements Elo ou MMLU, quand on les brandit hors protocole, servent souvent le marketing plus que l’usage. Notre grille qualitative (fluide, fragile, à revérifier, dépend de l’offre) reste lisible dans six mois et vous permet de comparer deux sessions sans truquer un podium.
Que faire si le modèle invente un élu ou une date ?
Traitez la réponse comme un brouillon dangereux. Ne la publiez pas. Ouvrez une source institutionnelle (site de la ville, de la Métropole, de la Région, Insee selon le besoin). Reformulez votre demande en interdisant toute invention et en exigeant « je ne sais pas » si la source manque. L’exemple fictif d’hallucination donné plus haut montre le style confiant à redouter — ce n’est pas une capture réelle de GPT-5.6 Sol / Terra / Luna, c’est un modèle d’erreur. Si l’outil recommence, baissez votre confiance factuelle et limitez-le à la reformulation de textes que vous fournissez.
Faut-il payer pour refaire ce test ?
Pas nécessairement. Beaucoup d’offres permettent un essai limité ; le CSV mentionne « Gratuit (Luna) / payant » comme orientation, pas comme tarif IAHDF. Vérifiez sur la page de OpenAI ce qui est accessible avec votre compte en France le jour J. Payez seulement si vous avez déjà buté sur une limite réelle de votre usage, pas pour « être sérieux ». Un test honnête peut se faire sur un court message et un extrait public. Gardez les reçus et les captures de libellé de modèle pour votre journal, sans partager de données personnelles.
Comment croiser ce test avec d’autres ressources IAHDF ?
Utilisez ce banc pour un avis daté sur GPT-5.6 Sol / Terra / Luna, puis revenez aux fiches outil et au comparatif pour le choix durable. Les liens internes du type autre test propriétaire, fiche ChatGPT ou réflexes servent à enchaîner sans tout relire. Pour la pratique en groupe, regardez l’agenda et l’inscription. Apportez vos propres textes publics plutôt que des captures virales. Et souvenez-vous : un atelier humain reste utile quand le doute porte sur la confidentialité ou sur le ton d’un message officiel, pas seulement sur la marque du modèle.
Pour aller plus loin après ce test : comparez avec un autre modèle de la série, relisez le comparatif assistants, et gardez la grille qualitative dans un carnet. Prochains ateliers et échanges : agenda · inscription.
