Dans un procès, chaque pièce produite par une partie passe sous les yeux de l’autre. En 2023, devant un tribunal fédéral de New York, les avocats de la compagnie Avianca ont cherché en vain plusieurs décisions citées par leurs adversaires : ChatGPT les avait inventées, puis en avait confirmé l’existence à l’avocat qui l’interrogeait. Le juge P. Kevin Castel a infligé aux auteurs du mémoire une amende de 5 000 dollars. L’erreur était banale ; la procédure avait tenu, parce qu’elle place face à chaque document un lecteur intéressé à le contester.
Une chaîne de commandement ne connaît pas de partie adverse : le document qui la remonte s’adresse à des échelons chargés d’agir, et son format vaut présomption de vérification. CNN a révélé le 18 septembre 2026 où peut mener ce ressort. Au printemps, en pleine guerre contre l’Iran, un rapport de renseignement rédigé avec un chatbot, qui avait halluciné la nature d’une cargaison, a conduit les forces américaines à préparer l’abordage d’un bâtiment chinois qui naviguait au Moyen-Orient.
Le fil de l’affaire, la conversion d’une réponse de modèle en document officiel, les normes et la doctrine qu’elle a traversées sans jamais s’y heurter, la politique de vitesse américaine qui l’encadre, le précédent du Yinhe en 1993, puis ce qu’elle met en jeu, de Minab à Pékin et Paris, ordonnent ce qui suit.
Une réponse de chatbot promue rapport de renseignement
Une requête sur une cargaison
Un analyste des opérations spéciales américaines interroge un chatbot sur un renseignement issu du commandement des opérations spéciales pour le Pacifique, le SOCPAC, établi à Hawaï, à propos du manifeste de cargaison d’un navire chinois. Croisant sources ouvertes et renseignement électromagnétique classifié, le système en déduit à tort que le bâtiment achemine vers l’Iran des composants d’un programme d’armement nucléaire. CNN ignore quel chatbot a servi, produit commercial ou outil conçu par l’État.
Le second passage par la machine
Le second recours à l’outil change la nature de l’erreur. L’analyste lui confie la rédaction de son rapport, qui adopte le format standard d’un produit de renseignement militaire et gravit la hiérarchie sous les dehors d’une analyse contrôlée. Selon les sources de CNN, le document était « entièrement faux » et a « failli déclencher une guerre » : devenue rapport, la réponse aberrante a nourri des préparatifs militaires.
L’armée prépare alors l’abordage. Une équipe en armes s’y apprête et des appareils sont en l’air quand, peu avant l’exécution, les responsables reprennent le rapport de près : un analyste des opérations spéciales découvre qu’il a été « généré avec de l’intelligence artificielle », et Washington annule. La cargaison réelle reste inconnue ; au 19 septembre, ni le Pentagone ni le SOCPAC n’ont répondu à CNN.
Un faux sans faussaire
Le code pénal français définit le faux comme une « altération frauduleuse de la vérité ». Rien, ici, ne suggère une volonté de tromper, et le produit fini porte pourtant tous les signes de l’authenticité. Le basculement ne tient pas seulement à l’hallucination, ce texte plausible et faux, mais à sa mise en forme : le décideur valide un document, jamais la source qu’il ne voit pas, et chaque échelon qui transmet sans objecter y ajoute son crédit.
En juillet 2023, dans une note du CETaS (Alan Turing Institute), le data scientist en chef du GCHQ britannique, qui signe Adam C, et Richard Carter jugeaient improbable qu’on confie de sitôt aux grands modèles la rédaction de rapports finis : mieux valait les traiter en analyste très junior, dont rien ne sort sans validation, et exiger des sources vérifiables. L’affaire du navire a pratiqué l’usage exact qu’ils écartaient.
L’épreuve des normes analytiques
Qualifier chaque source, séparer le fait du jugement
Le renseignement américain mesure ses produits à la directive ICD 203, créée en 2007 et réécrite le 2 janvier 2015 : cinq normes analytiques et neuf normes de savoir-faire. Les trois premières de celles-ci imposent de décrire la qualité et la crédibilité des sources, d’exprimer l’incertitude sur une échelle de probabilité codifiée et de séparer l’information des hypothèses et jugements de l’analyste. Un texte généré qui fusionne des sources sans en tracer l’origine échoue dès la première.
Une vérification sans règle commune
Restait à savoir qui appliquerait cette grille. Selon le site israélien Ynet, aucun ensemble de règles unique ne fixe la vérification d’une information produite par IA avant son emploi opérationnel. La directive offre bien aux analystes un recours, le médiateur analytique du directeur du renseignement national ; encore faut-il savoir d’où vient le texte transmis, ce que sa forme, ici, dissimulait.
Un humain dans la boucle, mais en aval du document
Une doctrine qui encadre l’arme, pas l’écrit
La directive 3000.09 du Pentagone, publiée en novembre 2012 et mise à jour le 25 janvier 2023, exige des « niveaux appropriés de jugement humain sur l’emploi de la force ». Elle ne vise que les systèmes d’armes autonomes et semi-autonomes, et exclut notamment les plateformes non armées, le cyber et les systèmes qui ne sont pas des armes. Un outil d’aide à l’analyse ou à la rédaction du renseignement lui échappe, alors que le document qu’il produit peut déclencher la décision.
Une source militaire l’admet auprès de CNN : l’IA « monte clairement en puissance dans le ciblage », sans véritable règle sur la façon dont l’humain dans la boucle doit prévenir pertes civiles et tirs fratricides. En novembre 2024, le CSET de Georgetown nommait ce qui vide cette présence de sa substance : le biais d’automatisation, tendance à se fier à l’excès à un système automatisé, même contredit par d’autres indices. Études de cas à l’appui, il concluait que l’humain dans la boucle ne peut empêcher tous les accidents.
Voir ce que le scénario annonce
Dans l’affaire du navire, le contrôle a joué tard, et sur la provenance plutôt que sur les faits : la découverte qu’une machine avait écrit le rapport, non une contre-expertise de la cargaison, a tout arrêté. Ce sursaut a manqué le 3 juillet 1988 au croiseur USS Vincennes, qui a abattu au-dessus du détroit d’Ormuz le vol Iran Air 655 et ses 290 occupants : son système Aegis montrait un avion en montée, l’équipage l’a cru en descente d’attaque. Washington y verra un « scenario fulfillment », lecture des données à travers un scénario attendu, qu’un document alarmant installe d’avance.
La vitesse érigée en doctrine
Une force de combat voulue AI first
Le poids démesuré de l’IA dans une décision militaire aussi grave ne doit rien au hasard. Dès janvier 2026, Pete Hegseth, secrétaire à la Défense, a doté le Pentagone d’une stratégie d’adoption accélérée : mettre des modèles entre les mains de près de trois millions de personnels, militaires et civils, pour hâter l’exploitation du renseignement et la planification des opérations. Signé le 9 janvier, le texte veut une force de combat « AI first » et prévoit une équipe habilitée à déroger aux exigences non législatives. Trois jours plus tard, à la Starbase de SpaceX, six organismes passent sous l’autorité du directeur technique Emil Michael, et le secrétaire lance : « Question every requirement, delete the dumb ones, and accelerate like hell ».
L’évaluation rangée parmi les obstacles
La stratégie veut une « IA responsable » exempte d’« ideological tuning » et des contrats autorisant « any lawful use » ; le 12 janvier, le secrétaire l’a définie comme « objectivement véridique ». La véracité devient une propriété que l’on achète, non une exigence vérifiée à l’usage : l’analyse du cabinet Covington n’y relève aucune disposition sur la vérification humaine des sorties. Le texte veut au contraire abréger homologation, évaluation et certification, et Hegseth a rangé à la Starbase les obstacles aux essais parmi les « risques opérationnels ».
Une source citée par CNN résume ce que la course à la rapidité vient de révéler : « l’IA permet d’arriver plus vite à une mauvaise idée ». Quand le succès d’une adoption se mesure au temps gagné, ce temps se prélève d’abord sur la vérification, seule étape qui ne produit rien de visible, jusque dans la préparation d’une opération armée.
Le Yinhe, même scénario trente-trois ans plus tôt
En juillet 1993, sans la moindre IA, Washington accuse, sur la foi d’un manifeste obtenu par la CIA, le porte-conteneurs chinois Yinhe d’acheminer vers l’Iran du thiodiglycol et du chlorure de thionyle, précurseurs d’armes chimiques. Bloqué vingt-quatre jours dans l’océan Indien, le navire est inspecté à Dammam, en Arabie saoudite : le 4 septembre, rien d’interdit n’est trouvé. Les États-Unis refusent de s’excuser, disant avoir agi de bonne foi sur la base du renseignement ; Pékin en fait une humiliation nationale.
Le scénario de 2026 est le même, manifeste, navire chinois, soupçon d’armes de destruction massive pour l’Iran ; mais l’erreur humaine de 1993 avait débouché sur une inspection négociée, quand celle de 2026 n’a été repérée qu’avec des avions en vol. En haute mer, visiter un navire étranger exige en principe l’accord de l’État du pavillon, sauf navire sans nationalité ou mandat du Conseil de sécurité ; l’Initiative de sécurité contre la prolifération, lancée par George W. Bush en mai 2003 et endossée par 107 États en 2019, repose sur ce consentement, sans la Chine.
Pour un navire sous pavillon chinois, l’abordage aurait été un acte de force sans base consensuelle. Nul ne peut dire s’il aurait ouvert une guerre, mais une action armée américaine contre un bâtiment chinois aurait sans nul doute exposé deux puissances nucléaires à un risque d’escalade : sur fond de rivalité exacerbée entre Washington et Pékin, une hallucination capable de mobiliser soldats et avions pouvait suffire à ouvrir une crise militaire aux répercussions mondiales.
De Minab à Paris, ce que l’affaire met en jeu
Un précédent meurtrier en Iran
En février 2026, l’école Shajareh Tayyebeh de Minab, en Iran, a été atteinte par une frappe américaine, et des experts missionnés par les Nations unies jugent disposer de « motifs raisonnables » pour imputer à Washington des crimes de guerre commis lors de ces attaques. Des enquêtes ont montré que Maven Smart System, outil de Palantir qui fusionne imagerie satellitaire, flux de drones et autres données militaires, intervenait dans le choix des cibles, sans que rien n’établisse qu’il ait seul décidé de viser l’école. Reste la question des erreurs de ces outils, intégrés au pas de charge par des armées nucléaires, et de leur coût humain.
Le rendez-vous du 24 septembre
L’affaire éclate moins d’une semaine avant la visite d’État de Xi Jinping, que Donald Trump doit recevoir à Washington le 24 septembre, l’IA à l’ordre du jour. En mai, à Pékin, les deux dirigeants étaient convenus de discussions de haut niveau sur l’IA, sans confirmation publique à la mi-septembre. Sur le terrain militaire, le seul engagement de fond date du 16 novembre 2024 : à Lima, Joe Biden et Xi Jinping avaient affirmé que la décision d’employer l’arme nucléaire devait rester sous contrôle humain, sans viser le renseignement ni les opérations conventionnelles. Reste à voir si Pékin se saisira de l’épisode : étendre l’engagement au renseignement ferait remonter le contrôle humain en amont, s’en abstenir le laisserait aux doctrines nationales.
La certification revendiquée à Paris
En France, le décret du 23 avril 2024 a créé l’Agence ministérielle pour l’intelligence artificielle de défense, dirigée par Bertrand Rondepierre et chargée notamment de certifier les projets d’IA des armées. Paris a signé la Déclaration politique sur l’usage militaire responsable de l’IA, lancée par Washington en février 2023 à La Haye : dix mesures, une cinquantaine d’États, pas la Chine. Aucun de ces textes ne vise en propre l’outil génératif qui rédige le renseignement.
Un analyste a posé une question, un modèle a répondu faux, un second passage par l’outil a donné à l’erreur la forme d’un produit fini, et une chaîne de commandement a fait ce pour quoi elle existe : exécuter. Le contrôle humain n’a pas disparu ; il s’est exercé sur un document dont il ignorait la genèse, et n’a joué qu’au dernier moment.
Le Yinhe avait coûté vingt-quatre jours d’immobilisation et une humiliation diplomatique ; l’erreur de 2026 a failli coûter davantage, et la chaîne qui l’a portée était conçue pour aller vite. Ranger les lenteurs de l’évaluation parmi les risques fait de chaque vérification un coût à réduire, au moment où la machine multiplie les documents à vérifier.
Toute organisation qui confie à un modèle la rédaction des pièces sur lesquelles elle décide, dossier médical, note de conformité ou mémoire judiciaire, hérite du même problème : la forme d’un écrit porte une présomption de travail humain que la génération automatique a rendue caduque. Le tribunal de New York disposait d’un contradicteur pour la lever ; une armée devra l’inscrire dans ses procédures.
Aller plus loin
La grille à laquelle un tel rapport aurait dû se mesurer tient dans les six pages de l’Intelligence Community Directive 203, Analytic Standards, qui détaille les neuf normes de savoir-faire, impose une échelle de sept degrés de probabilité chiffrés et organise le recours au médiateur analytique.
Un diagnostic précoce émane du renseignement lui-même : dans Large Language Models and Intelligence Analysis, le data scientist en chef du GCHQ et Richard Carter écartent dès 2023 les rapports finis rédigés par un modèle et exigent de lui des sources vérifiables.
Le périmètre du contrôle humain exigé par le Pentagone se vérifie dans la synthèse consacrée à la Department of Defense Directive 3000.09, qui souligne la souplesse assumée de l’adjectif « approprié », énumère les exclusions et décrit la revue de haut niveau que l’urgence militaire permet de lever.
Le mécanisme qui neutralise la présence humaine est disséqué dans AI Safety and Automation Bias, rapport du CSET sous-titré « The Downside of Human-in-the-Loop », qui confronte l’automobile, l’aviation civile et la défense aérienne avant de proposer des parades à trois étages, l’utilisateur, la conception et l’organisation.
Le comportement de modèles de langage placés en position de décider est mesuré dans Escalation Risks from Language Models in Military and Diplomatic Decision-Making, étude présentée à FAccT 2024 où cinq modèles du commerce, soumis à des simulations de guerre, montrent des dynamiques d’escalade difficiles à prévoir, jusqu’à recourir dans de rares cas à l’arme nucléaire au nom de la dissuasion.
La lettre de la stratégie de janvier est restituée par Pentagon Releases Artificial Intelligence Strategy, analyse du cabinet Covington qui détaille les sept Pace-Setting Projects, la définition de l’IA responsable, la clause « any lawful use » et la volonté d’abréger évaluation et certification.
L’état d’esprit qui porte ce texte transparaît dans ‘Accelerate like hell’: Hegseth moves to reshape DOD’s AI and tech hubs, récit par DefenseScoop de la journée de la Starbase, où les obstacles aux essais et à l’évaluation deviennent des risques opérationnels, non plus de simples désagréments.
Le précédent de 1993 est retracé dans la notice Yinhe incident, qui suit le navire de l’accusation fondée sur un manifeste obtenu par la CIA jusqu’à la certification conjointe du 4 septembre, et rappelle que l’épisode est présenté en Chine comme l’élément déclencheur de son système de navigation Beidou.
Le cadre juridique d’une interception en mer est exposé dans The Proliferation Security Initiative (PSI) At a Glance, fiche de l’Arms Control Association qui rappelle que l’initiative ne crée aucun droit nouveau, s’appuie sur le consentement de l’État du pavillon et se prolonge par des accords bilatéraux d’arraisonnement.
La réponse française se lit dans le décret n° 2024-376 du 23 avril 2024 relatif à l’agence ministérielle pour l’intelligence artificielle de défense, qui confie à l’agence l’accompagnement et la certification des projets des états-majors, directions et services, au titre d’autorité technique.
Rapprochées, ces lectures écartent l’idée d’une défaillance isolée. Les normes du renseignement exigent un auteur capable de dire d’où il tient ce qu’il affirme, la doctrine du contrôle humain s’arrête au seuil de l’arme, la stratégie en vigueur mesure la réussite à la vitesse, et le précédent de 1993 rappelle ce que coûte un manifeste mal lu. Entre ces pièces circule un texte sans auteur, dont la forme suffit à obtenir la confiance.
