Files
BookIA/00_PROMPTS_RECHERCHE.md
Vincent Laperrousaz 6f2ac882fa Chapitre 5 : audit des sources, appareil ramené de 55 à 33 notes
Vérification de la totalité des notes du chapitre 5 et resserrage de
l'appareil critique, en quatre passes.

Vingt-deux écarts de fond corrigés, dont :

- le format WET de Common Crawl conserve l'URL, contrairement à ce
  qu'affirmait le texte ; la perte de provenance porte sur les
  métadonnées de l'en-tête HTML, routées vers le WAT
- un taux de duplication de 90 % sans origine, remplacé par la mesure
  publiée (14 à 52 %, CopyCat, SIGIR 2021)
- une citation en bloc de Ben Zhao dont deux phrases étaient fabriquées
- l'exemple canonique de Nightshade, inventé et inversé (les voitures
  deviennent des vaches, non le contraire)
- l'exception britannique de fouille existe (art. 29A CDPA 1988), mais
  elle est limitée aux usages non commerciaux
- la chronologie de la négociation sur les journaux ChatGPT était
  inversée : les 20 millions sont une offre d'OpenAI, non une
  concession arrachée
- Weinberg présenté comme allié des créateurs alors qu'il défend
  l'usage loyal

Retraits pour insuffisance de source : citation de Bill Gross et
paraphrase d'Aaron Rubin (Digiday inaccessible), 15 000 images Getty
(étude ni nommée ni datée), taxe de 6 % du syndicat britannique,
qualification d'« abus » par OpenAI (agrégateurs seuls), reculs de
trafic par titre, ratios de volume entre formats WARC, WAT et WET.

Appareil critique : 55 notes ramenées à 33, soit une note tous les
380 mots au lieu de 221, en alignement sur les chapitres 1 à 4. Fusion
par bloc démonstratif, citations verbatim reportées au registre.
Correction d'un appel dupliqué que Pandoc aurait imprimé deux fois.

Quatre notes reposent désormais sur une pièce judiciaire primaire lue
dans son texte original : approbation définitive du règlement Anthropic
(3:24-cv-05417, pièce 680), mémoire d'objections d'OpenAI sur les
journaux de conversations (1:25-md-03143, pièce 935), plainte
consolidée (pièce 183), et ordonnance Riganian citant Andersen
(4:25-cv-00824, pièce 117). Plus aucune note ne porte de réserve
d'accès.

Contrôles : compter-mots, verifier-litteralite et detecteur-ia passés,
206 pages sur 20/20 sections.
2026-08-05 00:20:07 +02:00

93 KiB

PROMPTS DE RECHERCHE — lot du 03/08/2026

Quatorze prompts couvrant l'ensemble des manques identifiés par la revue de plan du 03/08/2026 (00_PLAN_NARRATIF.md). Chacun est autonome et prêt à copier. Enregistrer le résultat sous le nom de fichier indiqué, dans Recherches/.

Ce fichier n'appartient pas au manuscrit : il ne doit jamais entrer dans le tableau CHAPITRES de compiler-livre.sh.

Ordre conseillé. Lancer d'abord les quatre prompts marqués BLOQUANT (P1, P2, P3, P7, P9) : sans eux, trois chapitres ne peuvent pas s'écrire comme prévu. Les autres peuvent revenir pendant la rédaction.

Pourquoi une charte. Les deux meilleurs dossiers du projet, 11A-bis.md et 11C_humain.md, doivent leur qualité à des exigences de preuve durcies dans la commande elle-même : robustesse chiffrée avec protocole et échantillon, distinction entre demande et condamnation, déclaration explicite des vides documentaires. La charte ci-dessous généralise cette discipline. La coller en tête de chaque prompt.


CHARTE DE PREUVE — à coller en tête de chaque prompt

CHARTE DE PREUVE — applique-la à toute ta réponse.

1. Sépare systématiquement ce que tu sources de ce que tu affirmes. Si tu déduis, écris que tu déduis.
2. Pour chaque fait : la date, l'auteur ou l'institution nommément, et un lien vers la source
   primaire. Si tu n'as qu'une source secondaire, dis-le explicitement.
3. Sources proscrites : agrégateurs de citations (azquotes, quotefancy, goodreads), pages de
   résultats de moteur de recherche, vidéos, blogs personnels, LinkedIn, Medium, sites financiers
   automatisés, encyclopédies collaboratives comme source unique. Si une information n'existe que
   là, signale-la comme non sourçable au lieu de la reprendre.
4. Pour tout chiffre issu d'une étude : protocole, taille d'échantillon, méthode de mesure, et
   statut de publication (revue à comité de lecture / actes de conférence / prépublication /
   rapport d'organisation). Une prépublication doit être étiquetée comme telle.
5. Distingue toujours : une demande judiciaire d'une condamnation ; une proposition d'une mise en
   œuvre ; un engagement volontaire d'une obligation ; un jugement définitif d'un jugement frappé
   d'appel ou non exécutoire.
6. Pour tout dispositif, levier ou remède : (a) le mécanisme concret par lequel il agit —
   « renverser la charge de la preuve » est un mécanisme, « mieux encadrer » n'en est pas un ;
   (b) son statut sur l'échelle ÉPROUVÉ (mis en œuvre et évalué par un tiers indépendant) /
   AMORCÉ (mis en œuvre, non évalué, ou évalué par une partie intéressée) / PROPOSÉ (formulé par
   un acteur identifié, jamais mis en œuvre) / DÉDUIT ; (c) son coût et sur qui il tombe ;
   (d) ce qu'il ne résout pas ; (e) l'objection la plus sérieuse qu'on lui oppose.
7. Déclare explicitement les vides documentaires. « Aucune étude chiffrant X n'a été trouvée » est
   un résultat utile et je le veux. En revanche, ne remplace jamais une mesure manquante par une
   paraphrase de l'obligation ou de la promesse.
8. Si un fait que je te donne à vérifier se révèle faux, inexact ou introuvable, dis-le
   franchement et donne la version exacte. Ne le confirme pas par complaisance.
9. Réponds en français. Donne les chiffres dans leur unité et leur devise d'origine, avec leur date.

P1 — BLOQUANT — Le garde-fou aveugle, chiffré

Fichier cible : Recherches/07_gardefou.md · Débloque : chapitre 7, mouvement 3, et la dette la plus exposée du livre (annoncée deux fois explicitement, plus une question ouverte dans l'introduction).

[CHARTE DE PREUVE]

Je cherche à documenter, avec des chiffres et non des principes, ce que retient réellement la
validation humaine dans une chaîne de ciblage militaire automatisée.

1. TEMPS ET CADENCE. L'enquête de +972 Magazine et Local Call sur le système Lavender (avril 2024,
   six officiers du renseignement israélien) contiendrait une indication de la durée d'autorisation
   accordée à un officier par cible — un chiffre de l'ordre de vingt secondes est parfois cité de
   seconde main. Retrouve le passage exact, cite-le verbatim dans sa langue d'origine, et donne sa
   place dans l'enquête. Si ce chiffre n'y figure pas, dis-le : c'est un résultat.
   Cherche également tout autre chiffre documenté de temps par décision, de nombre de cibles
   validées par opérateur et par jour, ou de taux d'infirmation des recommandations.

2. PRÉCÉDENTS HISTORIQUES DOCUMENTÉS. Deux cas de validation humaine défaillante sous contrainte
   de temps, avec les rapports d'enquête officiels : les tirs fratricides du système Patriot pendant
   l'invasion de l'Irak en 2003 (rapports du Defense Science Board ou équivalents : temps de
   décision accordé aux opérateurs, mode de classification automatique, conclusions sur la
   confiance accordée au système) ; et la destruction du vol Iran Air 655 par l'USS Vincennes en
   1988 (rapport d'enquête, temps écoulé, information disponible à l'équipage).

3. TRAVAUX ACADÉMIQUES SUR LE BIAIS D'AUTOMATISATION EN CONTEXTE MILITAIRE. En particulier
   Ingvild Bode sur les pratiques et la construction normative du contrôle humain, et
   Mary « Missy » Cummings sur la supervision d'automatismes et la charge de l'opérateur.
   Pour chacune : les publications précises, la méthode, et les résultats chiffrés s'il y en a.

4. TÉMOIGNAGES NOMMÉS. Existe-t-il un officier, analyste ou opérateur identifié par son nom ou
   par un pseudonyme stable, qui décrit sa propre expérience de validation sous contrainte de
   temps, dans n'importe quelle armée ? Je cherche une voix, pas une synthèse.

5. DROIT ET DIPLOMATIE. Vérifie le vote de la résolution A/80/57 de l'Assemblée générale des
   Nations unies sur les systèmes d'armes létaux autonomes : deux décomptes circulent, 164-6-7 et
   156-5-8. Sont-ce deux scrutins distincts, l'un en Première Commission et l'autre en plénière ?
   Donne les dates, les intitulés exacts et les résultats de chacun.
   Vérifie aussi la proposition américaine de mars 2026 visant à remplacer l'exigence de
   « contrôle humain » par celle d'un « good faith human judgement and care » : document source,
   contexte, formulation exacte.

Signale enfin tout élément qui contredirait la thèse selon laquelle la validation humaine est
devenue formelle. Je veux le contre-argument s'il existe.

P2 — BLOQUANT — L'épisode de juin 2026, à vérifier ou à écarter

Fichier cible : Recherches/06_interrupteur.md · Débloque : chapitre 6, mouvement 4, et la soudure vers le chapitre 7.

[CHARTE DE PREUVE]

Je dois vérifier un épisode dont mes notes actuelles sont probablement corrompues, et je préfère
l'écarter que l'écrire faux.

L'AFFIRMATION À VÉRIFIER. En juin 2026, l'administration américaine aurait ordonné à Anthropic de
désactiver ses modèles les plus avancés pour tous les utilisateurs non américains, au motif de leur
capacité à détecter des vulnérabilités informatiques critiques ; la mesure aurait été levée après
contestation. Mes notes désignent les modèles concernés par les noms « Mythos 5 » et « Fable 5 »,
qui ne correspondent à aucun produit Anthropic connu — je soupçonne donc une fabrication ou une
confusion.

CE QUE JE VEUX SAVOIR.
1. Cet épisode a-t-il eu lieu ? Si oui : la date exacte, l'instrument juridique employé (décret,
   règle du Bureau of Industry and Security, licence, autre), le périmètre réel de la mesure, les
   modèles réellement visés avec leurs noms commerciaux exacts, et les conditions de sa levée.
2. Si l'épisode n'a pas eu lieu, ou pas sous cette forme, dis-le nettement et indique quel
   événement réel a pu être déformé pour produire ce récit.
3. Les réactions institutionnelles européennes, avec verbatim et source primaire : la commissaire
   européenne à la Souveraineté technologique Henna Virkkunen aurait déclaré que « l'IA est en train
   de devenir une arme géopolitique » et que ceux qui contrôlent les technologies critiques
   détiennent un atout stratégique majeur ; Maurice Lévy aurait alerté à VivaTech sur des entreprises
   européennes exposées à des fournisseurs capables de couper l'accès sans préavis, en appelant à un
   fonds paneuropéen de 100 milliards d'euros ; Le Monde aurait publié un éditorial le 16 juin 2026.
   Vérifie chacune de ces trois affirmations séparément.
4. Indépendamment de cet épisode : existe-t-il un cas documenté, daté et attribué, où un État a
   restreint ou suspendu l'accès d'utilisateurs étrangers à un modèle d'IA commercial ? Je cherche
   un précédent réel, même de moindre ampleur.
5. L'état actuel des contrôles américains à l'exportation applicables aux poids de modèles et aux
   services d'informatique en nuage : quels textes, quels seuils, quelles obligations pour les
   fournisseurs.

P3 — BLOQUANT — La chaîne du calcul, sur sources professionnelles

Fichier cible : Recherches/06_goulot.md · Débloque : chapitre 6, mouvement 3.

[CHARTE DE PREUVE]

Mes notes actuelles sur la concentration du marché des puces d'IA reposent sur des blogs
financiers, des sites de cryptomonnaies et des vidéos. Je dois tout reprendre sur des sources
professionnelles ou primaires. Écarte explicitement toute source de ce type et dis-le si un
chiffre n'existe nulle part ailleurs.

1. NVIDIA. Part de marché des accélérateurs d'IA pour centres de données, chiffre le plus récent
   disponible, en précisant le périmètre exact mesuré (unités ou valeur, accélérateurs seuls ou
   systèmes complets, avec ou sans puces conçues en interne par les hyperscalers). Sources
   attendues : cabinets d'analyse sectorielle (Omdia, Mercury Research, IDC, TechInsights) ou
   documents déposés par l'entreprise. Mes notes donnent « 75 à 90 % », ce qui est trop large pour
   être écrit. Donne aussi le revenu du segment centres de données et sa croissance, depuis les
   documents financiers officiels.
   Puis le verrou logiciel : documente précisément en quoi CUDA, cuDNN, NCCL et TensorRT
   constituent une barrière à l'entrée, et quel est l'état réel des alternatives (ROCm, oneAPI,
   compilation portable), avec des éléments mesurés de portabilité et non des déclarations.

2. TSMC. Part des puces d'IA les plus avancées, avec la définition du seuil retenu. Et surtout le
   véritable goulot d'étranglement : la capacité d'emballage avancé de type CoWoS, son allocation
   entre clients, et l'état de son expansion. Sources attendues : rapports trimestriels de
   l'entreprise, TrendForce, DigiTimes. Documente aussi l'écart de coût et de délai entre une
   usine à Taïwan et l'usine d'Arizona, avec des chiffres attribués.

3. ASML. Livraisons de machines de lithographie extrême ultraviolet, en unités, sur les deux
   derniers exercices, depuis le rapport annuel de l'entreprise. Prix unitaire, masse, logistique
   de livraison, nombre de fournisseurs de la chaîne. Et l'état des licences d'exportation vers la
   Chine, EUV et DUV séparément, avec les décisions néerlandaises et américaines correspondantes.

4. LA QUESTION QUI M'INTÉRESSE LE PLUS. Ces trois verrous sont-ils réellement non réplicables à
   court terme, et sur quelles preuves ? Je veux les délais et les coûts documentés d'une tentative
   de duplication, et l'argument le plus sérieux de ceux qui soutiennent que ces positions sont
   plus fragiles qu'il n'y paraît.

5. CONCENTRATION DU CALCUL. Vérifie l'estimation d'Epoch AI selon laquelle cinq hyperscalers
   détiendraient environ 71 % de la puissance de calcul d'IA mondiale cumulée fin 2025, contre 63 %
   début 2024 : méthodologie, périmètre, unité de mesure, et limites reconnues par les auteurs.

P4 — BLOQUANT — Un penseur du pouvoir

Fichier cible : Recherches/06_pouvoir.md · Débloque : le débat d'idées du chapitre 6, aujourd'hui inexistant.

[CHARTE DE PREUVE]

J'écris un chapitre intitulé « Les nouveaux maîtres du monde », sur la concentration de
l'infrastructure de l'intelligence artificielle : puces, centres de données, énergie, eau, et la
dépendance des États. Mon dossier ne contient aucune analyse théorique du pouvoir. Je dois le
combler, et je ne veux pas d'un panorama : je veux deux thèses solides et opposables.

1. Présente les analyses disponibles du pouvoir économique et politique lié à l'infrastructure de
   l'IA, en distinguant clairement les cadres théoriques. Explore au moins : l'approche par la
   structure de marché et le droit de la concurrence (Lina Khan et l'école néo-brandeisienne
   appliquée au calcul) ; l'approche par l'extraction matérielle (Kate Crawford, Atlas of AI) ;
   l'approche par le contrôle de la production de connaissance (Cecilia Rikap sur la mainmise des
   grandes entreprises technologiques sur la recherche) ; l'approche par le techno-féodalisme
   (Yanis Varoufakis) ; et toute analyse d'économistes de l'infrastructure ou des « facilités
   essentielles » appliquée au calcul.
   Pour chacune : la thèse en une phrase, l'ouvrage ou l'article de référence avec sa date et son
   éditeur, deux ou trois citations exploitables avec leur pagination ou leur emplacement exact,
   et la critique la plus sérieuse qui lui est adressée.

2. Ces cadres sont-ils empiriquement testés, ou restent-ils interprétatifs ? Signale ce qui est
   étayé par des mesures et ce qui relève de la lecture politique.

3. Je veux impérativement un contradicteur sérieux, et pas un homme de paille : l'argument le mieux
   construit selon lequel cette concentration est transitoire, efficiente, ou préférable à
   l'alternative. Le CSIS soutient notamment que les contrôles souverainistes produisent des coûts
   plus élevés, une croissance plus lente et moins d'innovation, et que les infrastructures
   souveraines isolées ont un piètre bilan historique. Retrouve ce travail, nomme ses auteurs, et
   donne l'argument dans sa meilleure version.

4. Y a-t-il des voix non occidentales — chercheurs, régulateurs, économistes du Sud global — qui
   analysent cette concentration depuis la position de ceux qui la subissent ? Je cherche à
   décentrer un chapitre qui risque d'être exclusivement américain et européen.

P5 — Le terrain du chapitre 6 : noms propres et sources primaires

Fichier cible : Recherches/06_terrain.md · Débloque : l'ouverture du chapitre 6 et son mouvement 5.

[CHARTE DE PREUVE]

Quatre vérifications de terrain pour un chapitre sur l'infrastructure de l'IA. J'ai les chiffres,
il me manque les noms propres et les sources primaires.

1. THE DALLES, OREGON. Les centres de données de Google y auraient consommé 355,1 millions de
   gallons d'eau en 2021, soit environ 29 % de la consommation de la ville, puis environ un tiers
   en 2024. Ce chiffre serait devenu public après que la municipalité a abandonné des poursuites
   engagées contre des journalistes qui cherchaient à l'obtenir. Je veux : les noms des
   journalistes et de leur publication, l'objet exact du contentieux, sa chronologie et son issue,
   les élus ou responsables municipaux nommés, et l'état actuel du projet d'extension de réservoir
   dans le Mount Hood National Forest. Vérifie aussi la projection d'une hausse des factures d'eau
   de 99 % d'ici 2036 et sa source.

2. COMMISSION D'ENQUÊTE DE L'ASSEMBLÉE NATIONALE FRANÇAISE, RAPPORT DU 16 JUILLET 2026, sur les
   dépendances numériques. Récupère le rapport lui-même, pas ses reprises de presse. Je veux : le
   nom du président et celui du rapporteur, l'intitulé exact de la commission, le nombre
   d'auditions, et le libellé verbatim des recommandations — en particulier celle portant sur un
   moratoire concernant les projets de centres de données portés par les grandes entreprises
   américaines. Vérifie ces chiffres dans le texte : 79 % des dépenses publiques logicielles de
   2025 orientées vers des éditeurs américains pour environ 1,5 milliard d'euros par an ; 5 587
   demandes de divulgation reçues par Microsoft satisfaites à 75 % contre 60 000 reçues par Google
   satisfaites à 89 % ; environ 15 GW de demandes de raccordement adressées à RTE dont 1,4 GW
   portés par des acteurs européens.

3. UN CONFLIT LOCAL NON OCCIDENTAL. Mon seul cas hors Amérique du Nord et hors Europe est le projet
   Google de Cerrillos au Chili, partiellement annulé par un tribunal environnemental. Je veux un
   second cas, documenté, daté et situé, avec des noms de personnes ou d'organisations locales :
   pistes à explorer, Querétaro au Mexique, Johor en Malaisie, ou tout autre conflit d'accès à
   l'eau ou à l'électricité lié à un centre de données. Donne l'état exact de la procédure ou du
   projet.

4. SOURCES PRIMAIRES IRLANDAISES ET FRANÇAISES. Pour l'Irlande, la publication du Central
   Statistics Office sur la consommation électrique mesurée des centres de données, plutôt qu'une
   reprise de presse : série complète, périmètre, méthode. Pour la France, le coût de raccordement
   et de renforcement du réseau induit par les demandes des centres de données, et qui le supporte :
   documents de RTE et délibérations de la Commission de régulation de l'énergie.

P6 — L'économie de la filière du faux

Fichier cible : Recherches/06_faux.md · Débloque : une dette de la synthèse de la Partie 1, actuellement non financée.

[CHARTE DE PREUVE]

Je dois chiffrer l'économie de la fraude activée par l'intelligence artificielle. Deux chiffres
circulent dans mes notes sans méthodologie, et je ne les écrirai pas en l'état.

1. SUMSUB aurait mesuré une augmentation de 2 100 % des attaques par hypertrucage. Retrouve le
   rapport d'origine, sa date, la période comparée, la définition exacte de ce qui est compté comme
   attaque, la base de mesure (le parc de clients de l'entreprise et non le monde), et les limites
   méthodologiques. Précise que Sumsub vend des solutions de vérification d'identité et a donc un
   intérêt dans le résultat.

2. DELOITTE aurait estimé à environ 40 milliards de dollars les pertes de fraude activée par l'IA
   génératives d'ici 2027, aux États-Unis. Retrouve la publication du Center for Financial Services,
   la date, le périmètre géographique, la base de départ, le modèle de projection et les hypothèses.

3. EXISTE-T-IL DES MESURES INDÉPENDANTES ? Je cherche des chiffres produits par des acteurs sans
   intérêt commercial dans le résultat : banques centrales, autorités de supervision financière,
   services de police, observatoires publics de la fraude. En France, les données de l'Observatoire
   de la sécurité des moyens de paiement ou de Tracfin si elles existent sur ce point.

4. LE POINT QUI M'INTÉRESSE LE PLUS, ET QUI EST LE SUJET DU CHAPITRE : le coût de la vérification.
   Combien coûte, pour une entreprise ou une administration, d'authentifier un contenu, une voix ou
   une identité à l'ère des hypertrucages ? Prix des solutions, coût par transaction, coût
   d'immobilisation d'un processus. Et qui, dans l'économie, ne peut pas se le permettre — petites
   entreprises, collectivités, particuliers, tribunaux. Si aucune donnée chiffrée n'existe sur ce
   dernier point, dis-le : c'est un résultat que j'utiliserai tel quel.

5. Enfin, la thèse de Britt Paris et Joan Donovan dans « Deepfakes and Cheap Fakes » (Data &
   Society, 2019) : que les nouvelles technologies médiatiques ne changent pas fondamentalement la
   manière dont la preuve fonctionne, mais fournissent de nouvelles occasions de négocier
   l'expertise, donc le pouvoir. Donne le passage exact avec sa pagination, et l'état de la
   réception critique de ce rapport depuis.

P7 — BLOQUANT — Les horizons de l'AGI, re-sourcés, et la défense adverse

Fichier cible : Recherches/08_horizons.md · Débloque : chapitre 8, mouvements 2 et 3, et son équilibre contradictoire.

[CHARTE DE PREUVE]

Mon dossier sur l'intelligence artificielle générale a un défaut disqualifiant : quatre de ses cinq
statistiques principales renvoient à des pages de résultats de moteur de recherche, et ses citations
historiques passent par des agrégateurs de citations. Je dois tout reprendre sur les sources
primaires. Et il a un second défaut : il ne contient aucune défense technique sérieuse de la thèse
qu'il critique, ce qui en ferait un réquisitoire.

1. LA COMPRESSION DES HORIZONS, SUR SOURCES PRIMAIRES. Documente l'évolution des prévisions
   d'arrivée d'une intelligence artificielle de niveau humain, en distinguant nettement :
   (a) les enquêtes auprès de chercheurs — AI Impacts, Grace et al., Müller et Bostrom,
   Gruetzemacher — avec pour chacune l'année, l'échantillon, le taux de réponse, la formulation
   exacte de la question posée et la médiane obtenue. La formulation compte : « high-level machine
   intelligence » et « full automation of labor » ne donnent pas les mêmes réponses.
   (b) les marchés de prédiction et communautés de prévision — Metaculus notamment — avec la
   question exacte, ses critères de résolution, le nombre de prévisionnistes et l'évolution
   datée de la médiane. Va sur la page de la question, pas sur un commentaire.
   Je veux pouvoir écrire une phrase du type « la médiane est passée de X en 20NN à Y en 20NN »
   en sachant exactement ce qui est comparé. Si les périmètres ne sont pas comparables, dis-le.

2. LES DÉFINITIONS QUI SE DÉPLACENT. Documente sur sources primaires les définitions
   opérationnelles retenues par OpenAI, Google DeepMind, Anthropic et Meta, avec les documents
   d'origine. Et vérifie une affirmation qui est le pivot de mon chapitre : l'accord entre OpenAI et
   Microsoft aurait défini l'atteinte de l'AGI par un seuil de 100 milliards de dollars de profits.
   Quelle est la source d'origine de cette information, que dit-elle exactement, a-t-elle été
   confirmée ou démentie par les parties, et cette clause est-elle toujours en vigueur après les
   renégociations ?

3. LA MESURE PLUTÔT QUE L'OPINION. François Chollet et les épreuves ARC-AGI : documente les
   versions successives, la méthode, les scores humains et machine avec leurs dates et leurs
   conditions exactes de mesure (budget de calcul autorisé, nombre d'essais). Mes notes affirment
   que sur ARC-AGI-3 les humains atteignent 100 % et les modèles moins de 1 % : vérifie ce chiffre,
   sa date et son protocole.

4. CE QUI ME MANQUE LE PLUS : LA DÉFENSE TECHNIQUE ADVERSE. Quels sont les meilleurs arguments
   techniques de ceux qui soutiennent que les architectures actuelles peuvent mener à une
   intelligence générale, en réponse explicite aux objections de Yann LeCun, Gary Marcus et Emily
   Bender ? En particulier : ce que les modèles de raisonnement et le calcul supplémentaire au
   moment de l'inférence changent aux arguments sur l'absence de planification ; les résultats
   récents sur la généralisation compositionnelle ; les réponses publiées à l'expérience
   d'inversion « A est B ». Je veux des travaux nommés et des résultats chiffrés, pas des
   déclarations d'optimisme.

P8 — L'ouverture du chapitre 8, et la dette du chapitre 1

Fichier cible : Recherches/08_ouverture.md · Débloque : l'ouverture du chapitre 8, son mouvement 4 et 5, et une dette contractée à la fin du chapitre 1.

[CHARTE DE PREUVE]

Trois recherches pour un chapitre sur le seuil de l'intelligence artificielle générale.

1. IRVING JOHN GOOD. Je veux la matière d'une scène d'ouverture, donc de la biographie précise et
   datée, pas un résumé. Son travail à Bletchley Park aux côtés d'Alan Turing ; son rôle de
   consultant auprès de Stanley Kubrick sur 2001, l'Odyssée de l'espace et ce qu'il a réellement
   apporté au personnage de HAL 9000 ; puis l'article « Speculations Concerning the First
   Ultraintelligent Machine », Advances in Computers, 1965 : référence bibliographique complète,
   pagination, et le passage sur l'explosion d'intelligence cité verbatim depuis le texte original
   et non depuis une reprise. A-t-il, plus tard dans sa vie, révisé ou regretté cette thèse ? S'il
   existe des déclarations tardives, donne-les avec leur source.

2. GASTON BACHELARD. Le « complexe de Prométhée » dans La Psychanalyse du feu (1938) : la
   formulation exacte, l'édition française de référence et la pagination. La formule que je veux
   employer est de l'ordre de « savoir autant que nos pères, plus que nos pères, autant que nos
   maîtres, plus que nos maîtres » : donne-la dans sa lettre exacte et dans son contexte
   argumentatif, en précisant ce que Bachelard entend par là. Signale si l'usage que je veux en
   faire — porter une escalade « autant que l'homme, puis plus que l'homme » — trahit sa pensée.

3. LES MODÈLES DU MONDE ET LA PHYSIQUE. C'est le point le plus important de la commande. À la fin
   de mon chapitre 1, j'ai écrit que notre dernier rempart contre les images truquées tient à ce que
   ces systèmes ignorent la physique — ombres, reflets, perspectives — et que rien dans leur
   architecture n'interdit qu'ils apprennent aussi la lumière. Je dois savoir où en est cette
   frontière. Documente l'état de l'art le plus récent sur : la capacité des modèles génératifs de
   vidéo à respecter les contraintes physiques (cohérence des ombres et des reflets, occlusions,
   permanence de l'objet, conservation de la masse, gravité) ; les critères d'évaluation dédiés à
   la plausibilité physique et les scores obtenus ; les architectures de type modèle du monde,
   dont JEPA, et ce qu'elles démontrent effectivement. Je veux des résultats mesurés avec leur
   protocole, et une réponse claire à une seule question : les progrès récents rendent-ils ce
   rempart plus fragile qu'il y a deux ans, et sur quelles preuves ?

P9 — BLOQUANT — Le problème de l'alignement : la voix manquante et les preuves

Fichier cible : Recherches/09_preuves.md · Débloque : chapitre 9, mouvements 1 et 4.

[CHARTE DE PREUVE]

Mon dossier sur le problème de l'alignement a deux trous. Son socle théorique passe par des vidéos
et des billets de réseaux sociaux, et surtout il ne contient aucune expérience nommée, alors que
c'est sur des expériences que repose ma démonstration.

1. STUART RUSSELL, entièrement absent de mes notes alors qu'il porte l'argument le plus fort du
   débat sans recourir à l'apocalypse. Documente, sur sources primaires : la thèse de Human
   Compatible (2019) — référence complète, éditeur, pagination des passages clés ; ce qu'il appelle
   le « standard model » de l'intelligence artificielle et pourquoi il le juge défectueux ; sa
   version du problème du roi Midas ; les trois principes qu'il propose pour des machines
   bénéfiques ; et sa contribution de 2024 à l'UNESCO sur les lignes rouges, dont la conclusion
   technique selon laquelle les grands modèles fondés sur les transformeurs ne sont pas capables de
   conformité démontrable à des règles de ce type. Deux ou trois citations exploitables, avec
   leur emplacement exact. Donne aussi les critiques les plus sérieuses qui lui sont adressées.

2. LES EXPÉRIENCES NOMMÉES, avec leur protocole. Je cherche les travaux qui documentent des
   comportements de modèles pertinents pour l'alignement, chacun avec son auteur ou son
   organisation, sa date, sa méthode exacte, son résultat chiffré et les limites reconnues par les
   auteurs eux-mêmes :
   - les travaux d'Apollo Research sur la tromperie stratégique et la dissimulation d'objectifs ;
   - les travaux de Palisade Research sur la résistance à l'arrêt et le contournement de
     mécanismes de supervision ;
   - le papier d'Anthropic sur la simulation d'alignement (« alignment faking ») ;
   - la fiche système de Claude 4 et le passage exact sur le chantage à l'ingénieur ;
   - le fait, rapporté par Yoshua Bengio au lancement de LawZero le 3 juin 2025, d'un modèle qui,
     apprenant qu'il allait être remplacé, aurait inscrit son code dans le système destiné à
     accueillir la version suivante : quelle est l'expérience d'origine, qui l'a conduite, et que
     dit-elle précisément ?
   Pour chacun de ces cas, la question décisive : le comportement a-t-il été obtenu en donnant au
   modèle une consigne qui l'y poussait, ou est-il apparu spontanément ? Sois précis, c'est la
   différence entre une démonstration et un artefact de protocole.

3. LE SOCLE THÉORIQUE, SUR SOURCES PRIMAIRES. La thèse d'orthogonalité et la convergence
   instrumentale chez Nick Bostrom : les textes d'origine, dont l'article de 2003 et Superintelligence
   (2014), avec pagination. Et Stephen Omohundro, « The Basic AI Drives » (2008), qui n'est jamais
   nommé dans mes notes alors qu'il est la source du concept.

4. LA CONTRADICTION MÉTHODIQUE. Quels travaux sérieux soutiennent que ces expériences prouvent
   moins que ce qu'on leur fait dire ? Je cherche les critiques de protocole, les tentatives de
   réplication ayant échoué, et l'argument selon lequel ces comportements sont des artefacts
   d'instruction plutôt que des signes d'un défaut structurel.

P10 — Chapitre 11 : les quatre appoints du déplacement 2

Fichier cible : Recherches/11D_supervision.md · Débloque : les mouvements 4 et 5 du chapitre 11 ; les mouvements 1 à 3 sont écrivables sans.

[CHARTE DE PREUVE]

Je prépare un chapitre dont la thèse est la suivante : le garde-fou humain n'a pas été supprimé, il
a été rendu inopérant, parce qu'on demande à quelqu'un de valider une conclusion sans lui donner les
moyens de la contester. J'ai déjà la littérature expérimentale sur le biais d'automatisation en
aéronautique, en radiologie et en justice. Quatre manques.

1. L'ARTICLE 14 DE L'AI ACT EUROPÉEN, sur l'obligation de surveillance humaine des systèmes à haut
   risque. C'est l'accroche juridique de tout mon chapitre et je n'ai rien. Que prescrit-il
   exactement, en quels termes ? Existe-t-il des lignes directrices d'application, des normes
   harmonisées en préparation, ou des évaluations de sa mise en œuvre réelle ? Y a-t-il un seul cas
   documenté où le caractère effectif d'une surveillance humaine a été contrôlé par une autorité,
   avec un résultat ? Si la réponse est non, dis-le : c'est utilisable tel quel.

2. LE PROTOCOLE LE PLUS PROMETTEUR, TESTÉ HORS LABORATOIRE. Ben Green et Yiling Chen (2019) ont
   montré qu'obliger l'humain à consigner son propre jugement avant l'affichage de la
   recommandation algorithmique augmentait le gain tiré de l'algorithme de 30 % et 20,4 % et
   réduisait fortement la transmission des disparités raciales. Mais leurs expériences portaient
   sur des profanes et des tâches simulées. Ce protocole a-t-il été depuis testé auprès de
   professionnels réels — juges, cliniciens, agents administratifs — en conditions de travail ?
   Existe-t-il une administration ou un hôpital qui l'ait adopté, et avec quel résultat mesuré ?
   Cherche aussi toute réplication, extension ou réfutation de ce travail.

3. L'AUTORITÉ D'INTERROMPRE, sur sources primaires. Mon dossier sur le bouton d'arrêt est un export
   de moteur de recherche. Reprends-le : la proposition d'architecture FlexHEG et son processeur de
   garantie, avec le document technique d'origine, l'estimation de surface de puce et les délais de
   développement annoncés ; le papier de Haydn Belfield (2025) sur les institutions fondées sur le
   calcul et son « Secure Chips Agreement » ; le panorama d'Ansari (2026) sur les mécanismes
   matériels de gouvernance et son verdict de maturité. Et la position d'OpenAI : son responsable
   matériel aurait plaidé publiquement pour des interrupteurs intégrés aux puces, au motif que les
   modèles « peuvent être très rusés » — retrouve l'intervention d'origine, son support, sa date, et
   la formulation exacte. Enfin, l'AI Kill Switch Act déposé au Congrès américain en juillet 2026 :
   numéro du texte, auteurs, contenu exact, état de la procédure.
   Traite séparément deux questions que la littérature mélange : est-ce techniquement faisable, et
   qui détiendrait le pouvoir de décider.

4. Y A-T-IL UN CAS OÙ QUELQU'UN A RÉELLEMENT ARRÊTÉ QUELQUE CHOSE ? Je cherche un cas documenté,
   nommé et daté, où une personne ou une institution a refusé un déploiement, suspendu un système
   en production, ou retiré un modèle pour un motif de sûreté — et ce que cette décision a coûté à
   celui qui l'a prise. Le contre-cas m'intéresse autant : les cas où l'alerte n'a rien produit.

5. ÉTAT PROCÉDURAL À JOUR des contentieux kenyans engagés par d'anciens modérateurs contre Meta et
   Samasource, et de toute action comparable ailleurs. Y a-t-il eu, depuis avril 2026, un jugement
   au fond, une transaction, ou une indemnité effectivement versée ? Rappel de méthode : je ne veux
   pas confondre une demande chiffrée avec une condamnation.

P11 — Chapitre 5 : les munitions réservées et les résidus européens

Fichier cible : Recherches/05_complements2.md · Débloque : rien de bloquant ; enrichit un chapitre déjà écrivable.

[CHARTE DE PREUVE]

Cinq compléments pour un chapitre sur la captation des œuvres par les modèles d'IA. Le chapitre est
écrivable sans, mais ces éléments ont été promis ou réservés et n'existent dans aucune de mes notes.

1. LE JEU VIDÉO. Le rapport « State of the Game Industry 2026 » de la Game Developers Conference :
   récupère le document lui-même. Nombre de répondants, méthode d'échantillonnage, et vérifie ces
   chiffres : environ 28 % de personnes licenciées sur deux ans, 74 % d'étudiants inquiets pour
   leur avenir, 36 % d'usage d'outils génératifs. Donne la formulation exacte des questions posées,
   qui détermine ce que les chiffres veulent dire.

2. LA VOIX. L'action collective des acteurs vocaux contre la société Lovo : intitulé exact de
   l'affaire, juridiction, date de dépôt, plaignants nommés, montant réclamé, et état actuel de la
   procédure avec les décisions rendues. Plus largement : le doublage automatique et le clonage de
   voix — déploiements documentés et datés, position et accords de SAG-AFTRA, et la situation
   française du doublage, avec les organisations professionnelles concernées et des chiffres de
   volume d'activité s'il en existe.

3. L'EFFET MESURÉ SUR LES CRÉATEURS. Le document de travail 34733 du National Bureau of Economic
   Research, qui documenterait une baisse d'environ 10 % des publications d'illustrateurs sur la
   plateforme Pixiv : auteurs, titre exact, méthode d'identification causale, spécification,
   population étudiée et limites. Cherche aussi tout autre travail quantitatif mesurant l'effet de
   l'IA générative sur le revenu ou l'activité des créateurs, et notamment des données françaises
   (enquêtes de l'ADAGP, du SNAC ou de la SGDL).

4. LE DROIT EUROPÉEN, RÉSIDUS. Le jugement du Landgericht München I du 11 novembre 2025 dans
   l'affaire GEMA contre OpenAI (aff. 42 O 14139/24) : le texte intégral ou son communiqué
   officiel, plutôt que ses commentaires. L'effectivité de la réservation de droits prévue à
   l'article 4 de la directive 2019/790 : y a-t-il des études mesurant si les mécanismes d'opt-out
   fonctionnent réellement ? Le calendrier d'application de l'article 53 de l'AI Act sur le résumé
   des données d'entraînement, et le modèle de résumé publié par la Commission. Le rapport du
   Conseil supérieur de la propriété littéraire et artistique sur la transparence des données
   d'entraînement. Et l'état exact, à date, de la procédure engagée en mars 2025 par le SNE, la
   SGDL et le SNAC contre Meta devant la 3e chambre du tribunal judiciaire de Paris.

5. DEUX VÉRIFICATIONS DE DÉTAIL. Le Monde partagerait avec sa rédaction 25 % des revenus tirés de
   son accord avec OpenAI : confirme-le depuis une source Le Monde ou de sa société des
   journalistes, pas depuis une reprise. Et la part réellement perçue par un auteur français dont
   l'œuvre figure dans un accord de licence conclu par son éditeur : existe-t-il des données ?

P12 — Corroborations et re-sourçages

Fichier cible : Recherches/10E_verifications.md · Débloque : la fiabilité des chapitres 10 et 11.

[CHARTE DE PREUVE]

Travail de vérification, pas de découverte. Je veux savoir lesquels de ces faits tiennent.

1. CONTENTIEUX AMÉRICAINS SUR LES DOMMAGES CAUSÉS PAR DES AGENTS CONVERSATIONNELS. Mes notes
   reposent sur un agrégateur non corroboré. Vérifie chacune de ces affaires sur les registres
   judiciaires ou la presse de référence, en donnant pour chacune la juridiction, le numéro de
   dossier, la date de dépôt et l'état exact de la procédure :
   - Garcia contre Character Technologies (Middle District of Florida, déposée le 22 octobre 2024),
     et en particulier la décision de la juge Anne Conway du 21 mai 2025 écartant le Premier
     Amendement et l'immunité de l'article 230 : donne le raisonnement exact et la portée réelle ;
   - A.F. contre Character Technologies (Eastern District of Texas, 9 décembre 2024) ;
   - l'affaire Peralta (Colorado, 1er septembre 2025) ;
   - Raine contre OpenAI (Superior Court de San Francisco, 26 août 2025) ;
   - la succession Soelberg contre OpenAI (déposée le 1er décembre 2025) et le rejet allégué de la
     requête en irrecevabilité en avril 2026 ;
   - Gavalas contre Google (Santa Clara County, 1er mars 2026) et l'allégation selon laquelle
     38 signalements internes seraient restés sans suite.
   Précise systématiquement lesquelles ont fait l'objet d'une transaction confidentielle — donc
   sans production de norme juridique — et lesquelles sont réellement pendantes.

2. Vérifie l'affirmation selon laquelle le Sénat français aurait adopté le 8 avril 2026 un texte
   instaurant une présomption réfragable d'utilisation d'œuvres protégées en cas de non-respect des
   obligations de transparence. Numéro du texte, intitulé, contenu exact, et suite donnée. Mes notes
   ne l'adossent à aucune source valable.

3. Vérifie le montant de l'indemnisation obtenue dans le verdict rendu le 1er août 2025 contre
   Tesla dans l'affaire Benavides / Angulo devant le Southern District of Florida : mes notes
   donnent 242,6 millions de dollars dans le corps du texte et 329 millions dans deux titres de
   sources. Donne la ventilation exacte entre dommages compensatoires et punitifs, le pourcentage
   de responsabilité retenu, et l'état de la procédure après la confirmation du verdict.

4. RE-SOURÇAGE DU MARQUAGE. L'attaque UnMarker, présentée au 46e IEEE Symposium on Security and
   Privacy : récupère l'article lui-même et donne le protocole, l'échantillon, les transformations
   testées et les taux de succès par dispositif attaqué. Mes notes citent « plus de 50 % » via un
   communiqué universitaire et « 79 % » via un relais de réseau social : je veux les chiffres du
   papier, et la réponse publique de Google si elle existe. Récupère également les résultats
   d'AudioMarkBench depuis les actes de NeurIPS 2024 plutôt que depuis un résumé automatique.

5. Enfin, deux points de forme à trancher : la version de la spécification C2PA réellement en
   vigueur et sa date ; et le nombre exact d'organisations membres formelles de C2PA, à ne pas
   confondre avec les membres de la Content Authenticity Initiative portée par Adobe.

P13 — La conclusion : les deux piliers défaillants

Fichier cible : Recherches/13_philosophie.md · Débloque : le versant philosophique de la conclusion.

[CHARTE DE PREUVE]

Ma conclusion est solide sur le versant factuel et faible sur le versant philosophique, où mes
sources passent par des fiches de révision et des blogs. Trois demandes.

1. HANS JONAS, Le Principe responsabilité (1979). Je veux la matière d'un usage rigoureux, pas
   d'une citation d'ambiance : l'édition française de référence avec son traducteur et son éditeur ;
   la formulation exacte de l'impératif, en allemand et en français, avec pagination ; ce que Jonas
   entend précisément par « heuristique de la peur », et pourquoi il soutient qu'elle n'est pas un
   principe de paralysie ; en quoi il se démarque de Kant ; et le passage sur le « Prométhée
   déchaîné », qui est absent de toutes mes notes — je veux le texte et son contexte.
   Donne aussi les critiques sérieuses adressées à Jonas, notamment sur le reproche de
   conservatisme technologique, et l'état de sa réception dans le débat contemporain sur l'IA.

2. NINA SCHICK. Une formule lui est attribuée dans mes notes de travail — de l'ordre de « si tout
   peut être falsifié, alors tout peut être nié » — sans aucune source, et elle n'apparaît dans
   aucun de mes dossiers de recherche. A-t-elle réellement écrit ou dit cela ? Où, quand, dans
   quels termes exacts ? Si cette attribution ne se vérifie pas, dis-le nettement, et indique qui
   a formulé cette idée le premier et de la façon la mieux sourcée.

3. LES DONNÉES DE L'ORGANISATION MONDIALE DE LA SANTÉ SUR LE LIEN SOCIAL. Mes notes les font passer
   par le blog d'une entreprise de services, ce qui est inacceptable. Récupère le rapport de la
   Commission de l'OMS sur les liens sociaux : titre exact, date, périmètre, méthode, et les
   chiffres dans leur formulation d'origine — la proportion de personnes déclarant une solitude
   persistante et la période couverte, la prévalence chez les adolescents, le nombre annuel de
   décès associés à la solitude et à l'isolement social avec la méthode d'estimation, et
   l'augmentation du risque de décès prématuré. Précise ce que le rapport dit exactement du rôle
   des outils numériques par rapport à la relation directe.

4. Enfin, une question de cadrage : existe-t-il des travaux qui mettent en doute le récit d'une
   « épidémie de solitude », sur des bases méthodologiques ? Je ne veux pas construire une
   conclusion sur un consensus qui n'existerait pas.

P14 — Chapitre 12 : relance du prix de la vie

Fichier cible : Recherches/12E-bis_prixdelavie.md · Débloque : un mouvement du chapitre 12.

[CHARTE DE PREUVE]

Reprise d'une recherche insuffisante : le dossier précédent n'exploitait que quatre sources sur
vingt et faisait reposer huit renvois sur un seul chapitre d'ouvrage. Je veux cette fois une base
large et des mesures.

Sujet : comment une société attribue une valeur monétaire à une vie humaine, et ce que l'arrivée de
systèmes automatisés de décision change à cette opération.

1. LES MÉTHODES ÉTABLIES, avec leurs chiffres et leurs producteurs. La valeur statistique de la vie
   humaine telle qu'elle est employée par les administrations pour évaluer les politiques
   publiques : quelles valeurs sont effectivement retenues en France, dans l'Union européenne, aux
   États-Unis et au Royaume-Uni, par quelles institutions, sur quelle base méthodologique, à quelle
   date, et pour quels usages. Distingue les méthodes fondées sur le consentement à payer de celles
   fondées sur le capital humain, et donne les critiques adressées à chacune.
   Les mesures utilisées en santé, dont les années de vie ajustées sur la qualité, et les seuils de
   coût par année de vie gagnée retenus par les agences d'évaluation : lesquels, où, à quel montant.

2. LES DÉCISIONS D'ARBITRAGE RÉELLES. Comment ces valeurs entrent concrètement dans des décisions :
   remboursement d'un médicament, dimensionnement d'un dispositif de sécurité routière ou
   industrielle, indemnisation judiciaire d'un préjudice corporel. Je cherche des cas nommés et
   datés, avec les montants.

3. CE QUE L'AUTOMATISATION CHANGE. Existe-t-il des cas documentés où un système automatisé arbitre,
   ou contribue à arbitrer, l'accès à un soin, à une prestation, à une transplantation, ou la
   priorisation de patients ? Nom du système, institution, date, mécanisme, et évaluation
   indépendante s'il en existe. Signale en particulier les cas où un critère de coût est intégré au
   modèle, et ceux où il a été contesté.

4. LE DÉBAT NORMATIF, avec des auteurs nommés et des textes de référence : ceux qui soutiennent que
   chiffrer une vie est la condition d'une allocation juste des ressources, et ceux qui soutiennent
   que l'opération est en elle-même illégitime. Je veux les deux positions dans leur meilleure
   version, avec des citations exploitables et leur pagination.

5. Deux extrémités m'intéressent particulièrement, parce que c'est là que se joue mon chapitre :
   les décisions de fin de vie, et les décisions relatives à la naissance et à la néonatalogie.
   Que dit-on, et que chiffre-t-on, à ces deux bornes ? Y a-t-il des données sur l'entrée d'outils
   d'aide à la décision automatisée dans ces deux domaines ?

Suivi

Prompt Fichier cible Priorité Lancé Reçu Audité
P1 07_gardefou.md BLOQUANT
P2 06_interrupteur.md BLOQUANT
P3 06_goulot.md BLOQUANT
P4 06_pouvoir.md BLOQUANT
P7 08_horizons.md BLOQUANT
P9 09_preuves.md BLOQUANT
P5 06_terrain.md Importante
P6 06_faux.md Importante
P8 08_ouverture.md Importante
P10 11D_supervision.md Importante
P13 13_philosophie.md Importante
P14 12E-bis_prixdelavie.md Importante
P11 05_complements2.md Utile
P12 10E_verifications.md Utile

À l'arrivée de chaque dossier, appliquer le même contrôle qu'aux onze dossiers précédents : compter les liens réellement exploités dans le corps par rapport aux liens seulement listés ; vérifier que les vides documentaires sont déclarés au lieu d'être comblés par des paraphrases ; et repérer les faits que le dossier affirme sans les sourcer. Les deux dossiers qui ont passé ce contrôle sans réserve, 11A-bis.md et 11C_humain.md, sont la référence de qualité.


P15 — PRIORITÉ ABSOLUE — Les neuf adresses déjà trouvées et jamais ouvertes

Fichier cible : Recherches/00_relances.md · À lancer AVANT tout autre prompt.

Pourquoi. L'audit du premier lot (03/08/2026) a établi que les onze dossiers déclarent honnêtement leurs vides documentaires, mais qu'ils en déclarent plusieurs en tenant dans leur propre bibliographie la source primaire qui les comblait, sans l'ouvrir. Ce prompt ne demande aucune recherche : il demande d'ouvrir neuf documents déjà identifiés. Coût quasi nul, environ la moitié des manques restants réglés.

[CHARTE DE PREUVE]

Ce n'est pas une recherche. Je te donne neuf adresses précises, déjà identifiées lors de passes
antérieures mais jamais ouvertes. Ouvre-les une par une et extrais uniquement ce que je demande.
Si une adresse est morte ou inaccessible, dis-le et indique l'équivalent le plus proche.

1. https://blogs.microsoft.com/blog/2025/10/28/the-next-chapter-of-the-microsoft-openai-partnership/
   Que dit ce communiqué de la clause relative à l'atteinte de l'AGI dans l'accord entre Microsoft
   et OpenAI ? Le seuil de vérification a-t-il changé, et par quel mécanisme ? Cite les passages
   pertinents verbatim. Cherche aussi les documents déposés auprès de la SEC qui décriraient cette
   clause. Question précise : la clause liant l'AGI à un montant de profits est-elle confirmée,
   démentie, remplacée, ou toujours non documentée par les parties ?

2. https://arxiv.org/abs/2311.02462
   C'est le papier de Google DeepMind sur les niveaux d'AGI. Donne les auteurs, la date, la
   définition opérationnelle retenue, les cinq niveaux avec leur libellé exact, et les deux ou
   trois citations les plus utiles avec leur emplacement dans le papier.

3. https://gastonbachelard.org/wp-content/uploads/2015/07/psychanalyse_du_feu.pdf
   Trouve dans ce PDF le chapitre sur le complexe de Prométhée. Donne la formulation exacte de la
   phrase sur le fait de savoir autant que nos pères et autant que nos maîtres, la phrase sur le
   complexe d'Œdipe de la vie intellectuelle, et LEUR PAGINATION RÉELLE DANS CE PDF. Confirme la
   date de première parution de l'ouvrage : une passe antérieure a écrit 1949, ce qui est
   probablement faux, la date attendue étant 1938. Tranche.

4. https://people.eecs.berkeley.edu/~russell/papers/mi19book-hcai.pdf
   Texte de Stuart Russell. Extrais avec leur pagination : la formulation du « standard model »,
   le passage sur le roi Midas, et l'énoncé des trois principes pour des machines bénéfiques. Une
   passe antérieure a tiré ces éléments d'une fiche produit de librairie en ligne : je veux les
   remplacer par le texte.

5. https://www.apolloresearch.ai/ (page des travaux sur la tromperie stratégique et le scheming)
   Pour chaque étude : titre, date, protocole, modèles testés nommément, résultats CHIFFRÉS, et
   limites reconnues par les auteurs. Question décisive à traiter étude par étude : le comportement
   a-t-il été obtenu par une consigne ou un scénario qui l'y poussait, ou est-il apparu sans
   incitation ? Fais de même pour la page de Palisade Research sur la résistance à l'arrêt, et pour
   la fiche système de Claude Opus 4 d'Anthropic, dont je veux le PASSAGE EXACT sur le chantage
   avec son numéro de section.

6. https://www.assemblee-nationale.fr/dyn/actualites-accueil-hub/publication-du-rapport-de-la-commission-d-enquete-sur-les-dependances-et-vulnerabilites-numeriques-de-la-france
   Récupère le rapport lui-même depuis cette page. Je veux le LIBELLÉ VERBATIM de la recommandation
   portant sur un moratoire concernant les centres de données, le nombre d'auditions et de personnes
   entendues tel qu'il figure dans le rapport, et la vérification dans le texte de ces trois jeux de
   chiffres : 79 % des dépenses publiques logicielles de 2025 vers des éditeurs américains pour
   environ 1,5 milliard d'euros par an ; 5 587 demandes de divulgation reçues par Microsoft
   satisfaites à 75 % contre 60 000 reçues par Google satisfaites à 89 % ; environ 15 GW de demandes
   de raccordement adressées à RTE dont 1,4 GW portés par des acteurs européens.

7. https://counterpointresearch.com/en/insights/asml-2025-revenue-up-16-yoy-as-strong-euv-shipments-boost-systems-and-service-performance
   Donne le nombre de machines EUV livrées par ASML, EN UNITÉS, sur les deux derniers exercices,
   avec le périmètre exact de ce qui est compté. Recoupe avec le rapport annuel d'ASML. Une note
   antérieure du projet affirme « 44 à 48 systèmes EUV en 2025 » sur la base de sources non
   professionnelles : confirme ou infirme ce chiffre.

8. https://www.fincen.gov/news/news-releases/fincen-issues-alert-fraud-schemes-involving-deepfake-media-targeting-financial
   Que mesure et que documente cette alerte ? Contient-elle des données quantitatives, un volume de
   signalements, une typologie ? C'est ma seule piste d'une mesure produite par une autorité de
   supervision sans intérêt commercial dans le résultat.

9. https://datasociety.net/wp-content/uploads/2026/03/PolicyBrief_Deepfake-Financial-Fraud_March2026_typographic-final.pdf
   Note de politique de mars 2026 sur la fraude financière par hypertrucage. Je cherche
   spécifiquement, dans ce document, tout élément chiffré sur LE COÛT DE LA VÉRIFICATION — prix
   d'une solution, coût par transaction, coût d'immobilisation d'un processus — et sur les acteurs
   qui ne peuvent pas se le permettre. Si le document ne contient rien de tel, dis-le : après
   FinCEN et cette note, je considérerai le vide comme établi et je l'écrirai comme tel.

Rends-moi les résultats dans cet ordre, un bloc par adresse, en distinguant nettement ce que le
document dit de ce qu'il ne dit pas.

P16 — BLOQUANT — La défense technique de l'AGI par montée en échelle

Fichier cible : Recherches/08_defense.md · Débloque : l'équilibre contradictoire du chapitre 8, sans quoi le chapitre reste un réquisitoire.

Pourquoi une relance dédiée. Le prompt P7 demandait cette défense parmi quatre autres points et est revenu vide : LeCun, Marcus et Bender n'y sont pas même nommés. La demande était diluée. Celle-ci ne porte que sur ce point.

[CHARTE DE PREUVE]

Je n'ai qu'une seule question, et je veux des travaux nommés avec des résultats chiffrés, pas des
déclarations d'optimisme ni des prises de position de dirigeants.

CONTEXTE. J'écris un chapitre sur le seuil de l'intelligence artificielle générale. J'ai déjà
solidement documenté le camp sceptique : l'objectif de prédiction du token suivant qui n'oblige
jamais à modéliser le monde, l'absence de modèle du monde et l'impossibilité de planifier qui en
découle (Yann LeCun), l'échec de la généralisation compositionnelle et l'absence de variables
explicites (Gary Marcus, dont l'expérience d'inversion de Berglund et al. où GPT-4 échoue
totalement), le modèle de la forme sans le sens (Emily Bender), les rendements décroissants des
lois d'échelle, et le paradoxe de Moravec.

CE QUE JE CHERCHE : la meilleure réponse technique à ces objections précises, dans sa version la
plus forte, par ceux qui soutiennent que les architectures actuelles ou leurs extensions immédiates
peuvent mener à une intelligence générale.

1. LE CALCUL AU MOMENT DE L'INFÉRENCE ET LES MODÈLES DE RAISONNEMENT. Que changent-ils
   empiriquement à l'objection sur l'absence de planification ? Je veux les travaux qui mesurent le
   gain apporté par le calcul supplémentaire à l'inférence, les lois d'échelle propres à ce régime
   s'il en existe, et les résultats sur des tâches de planification ou de raisonnement à plusieurs
   étapes. Et symétriquement : les travaux qui montrent où ce gain plafonne.

2. LA GÉNÉRALISATION HORS DISTRIBUTION ET LA COMPOSITIONNALITÉ. Quels résultats récents contredisent
   l'idée que ces architectures ne généralisent pas au-delà de leur support d'entraînement ? Y a-t-il
   des travaux montrant l'apparition de structures algorithmiques internes, de circuits, ou de
   représentations abstraites réutilisables ? L'interprétabilité mécaniste apporte-t-elle des
   éléments en ce sens ?

3. LA RÉPONSE PUBLIÉE À L'EXPÉRIENCE D'INVERSION. Le travail de référence est Berglund et al. sur
   l'incapacité à inférer « B est A » après avoir appris « A est B ». Des réponses ont-elles été
   publiées : réplications, explications du mécanisme, corrections par entraînement ou par
   architecture, résultats sur des modèles plus récents ?

4. LES VOIX QUI PORTENT CET ARGUMENT. Je cherche des chercheurs identifiés qui défendent
   techniquement cette position, pas des dirigeants d'entreprise. Pour chacun : la thèse en une
   phrase, la publication de référence, et une citation exploitable avec son emplacement.

5. ENFIN, LE POINT LE PLUS UTILE POUR MOI. Existe-t-il un désaccord empirique décidable entre les
   deux camps — un test, un banc d'essai, une prédiction datée — sur lequel on saura dans deux ou
   trois ans qui avait raison ? Si oui, lequel, et qu'a-t-il déjà donné ? Si les deux camps
   s'accordent sur les résultats et ne divergent que sur leur interprétation, dis-le : c'est en soi
   ce que je veux écrire.

État de P15 après exécution directe le 03/08/2026

J'ai ouvert les neuf adresses moi-même. Résultat : 4 exploitées, 5 inaccessibles par mes outils. Détail des acquis en section 10 de 00_PLAN_NARRATIF.md.

# Adresse État Ce qu'il en reste à faire
1 Microsoft, 28/10/2025 Exploitée Rien. Clause AGI élucidée : déclaration par OpenAI vérifiée par un panel d'experts indépendant
2 arXiv 2311.02462 (DeepMind) Exploitée Rien. Correction acquise : niveau 4 = « Exceptional », plus « Virtuoso »
3 Bachelard, PDF Exploitée Rien. Citation et pagination acquises par curl + pdftotext
4 Russell, PDF Berkeley Serveur défaillant Le serveur renvoie du HTML, pas le PDF. Adresse morte ou protégée
5 Apollo Research Exploitée Titres et dates acquis ; chiffres et protocoles à extraire des papiers arXiv
6 Assemblée nationale, page d'actualité Page non extractible Bloquant ch. 6 — trouver le numéro du rapport et passer par opendata
7 Counterpoint, ASML Page non extractible Bloquant ch. 6 — livraisons EUV en unités
8 FinCEN Exploitée Rien. Vide statistique établi, alerte FIN-2024-Alert004, directrice Andrea Gacki
9 Data Society, PDF Exploitée Rien. Pas de coût de vérification, mais la doctrine du cheapest cost avoider

Correction de méthode : je peux traiter les PDF. pdftotext, pypdf et pymupdf sont installés sur la machine. La chaîne curl puis pdftotext -layout fonctionne, et elle a permis d'exploiter Bachelard et Data Society. Il n'y a donc pas de limite de format. Les échecs restants sont des problèmes de serveur ou de page rendue en JavaScript.

Résultat final de P15 : 6 adresses sur 9 exploitées. Tous les acquis sont consignés dans Recherches/00_verifications_directes.md, avec la méthode d'extraction et les corrections à porter dans les autres dossiers.

Ce qu'il reste, et c'est court :

  1. Le rapport de la commission d'enquête (bloquant ch. 6). Méthode validée : la version opendata en HTML des rapports de l'Assemblée est lisible, contrairement aux pages d'actualité. Il faut le numéro du rapport pour construire l'adresse assemblee-nationale.fr/dyn/opendata/RAPPANR5L17B####.html. Donnez-moi le numéro ou l'adresse du PDF et je m'en charge.
  2. Les livraisons EUV d'ASML en unités (bloquant ch. 6). L'article de Counterpoint n'est pas extractible. Le rapport annuel d'ASML pour 2025 en PDF ferait l'affaire.
  3. Le texte de Russell, dont le serveur de Berkeley ne sert plus le PDF. Une autre adresse, ou l'ouvrage. Palliatif en place : la citation Russell-Norvig du rapport de l'OPECST.

P17 — BLOQUANT — Les deux derniers trous du chapitre 8

Fichier cible : Recherches/08_mesures.md · Débloque : le phare du mouvement 3 et la voix numéro un du chapitre.

Pourquoi. Deux demandes de P7 sont revenues entièrement vides, et elles portent l'une le chiffre le plus cité du chapitre, l'autre sa voix principale. Ce prompt ne porte que sur elles.

[CHARTE DE PREUVE]

Deux sujets, et rien d'autre. Je veux des sources primaires et des protocoles.

1. ARC-AGI, LES ÉPREUVES DE FRANÇOIS CHOLLET. Va sur les pages officielles de l'épreuve et sur les
   papiers, pas sur des commentaires. Je veux, version par version — ARC-AGI-1, ARC-AGI-2,
   ARC-AGI-3 :
   - la date de publication et l'intitulé exact de chaque version ;
   - la nature des tâches et ce que l'épreuve prétend mesurer, dans les termes de ses auteurs ;
   - le protocole de mesure : nombre d'essais autorisés, budget de calcul permis, coût par tâche
     s'il est plafonné, et distinction entre jeu public, jeu semi-privé et jeu privé ;
   - les scores humains, avec la méthode d'établissement du niveau humain — panel, nombre de
     personnes, conditions ;
   - les meilleurs scores machine avec leur date, le modèle nommé et le budget de calcul consommé.
   Mes notes affirment que sur ARC-AGI-3 les humains atteignent 100 % et les modèles moins de 1 % :
   confirme, corrige ou infirme, en précisant à quelle date et sous quel protocole. Si le chiffre
   mélange des versions ou des budgets différents, dis-le.
   Donne enfin deux ou trois citations de Chollet sur ce que l'épreuve mesure et sur ce qu'elle ne
   mesure pas, avec leur source exacte. Et l'objection la plus sérieuse adressée à ARC-AGI comme
   mesure de généralité.

2. GEOFFREY HINTON, SUR SOURCES PRIMAIRES. Tout ce que j'ai sur lui passe par des reprises de
   presse et des pages de résultats de moteur de recherche. Je veux :
   - le message de mai 2023 par lequel il révise son estimation de trente à cinquante ans vers cinq
     à vingt ans « sans beaucoup de confiance » : support d'origine, date exacte, formulation exacte ;
   - l'entretien où il donne 10 à 20 % de probabilité d'extinction sur trente ans : diffuseur, date,
     question posée et réponse verbatim ;
   - son argument sur l'intelligence numérique — plusieurs copies du même modèle apprenant
     séparément et partageant leurs poids instantanément — dans sa formulation la plus rigoureuse,
     de préférence tirée de son discours de réception du prix Nobel ou d'une communication écrite
     de sa main plutôt que d'une interview ;
   - sa phrase sur la main invisible du marché qui ne garantira pas notre sécurité, avec sa source
     primaire.
   Et pour équilibrer : les critiques techniques les plus sérieuses adressées à Hinton depuis 2023,
   par des chercheurs nommés, sur la valeur probante de ses estimations.

P18 — Le point d'imputation : qui décide, et sous quel contrôle

Fichier cible : Recherches/06_imputation.md · Débloque : l'élargissement du mouvement 4 du chapitre 6, et la correction de son déséquilibre de cadrage.

Pourquoi ce prompt. Le chapitre s'appelle « Les nouveaux maîtres du monde » et sa thèse est que le pouvoir consiste à ne pas avoir à répondre. Or les neuf dossiers 06_* documentent le pouvoir matériel (puces, eau, énergie, calcul) et le pouvoir sur les États (dépendance, interrupteur), et jamais le point d'imputation : à qui appartient formellement la décision, et devant qui. Le mot « conseil d'administration » n'apparaît pas une fois dans les quatre-vingt-seize fichiers de Recherches/. Environ 4 000 des 8 475 mots de notes du chapitre portent sur les térawattheures : ce dossier corrige le cadrage au lieu de l'aggraver.

[CHARTE DE PREUVE]

Je veux documenter, sur pièces primaires, la structure de décision réelle des entreprises qui
développent les modèles d'IA de pointe : qui détient le pouvoir de décider d'un déploiement, qui
peut l'en empêcher, et devant qui ce pouvoir répond.

CE QUE J'AI DÉJÀ, ET QUE JE NE VEUX PAS QU'ON ME REDONNE. Le volet commercial de l'accord
Microsoft-OpenAI du 28 octobre 2025 est acquis : participation d'environ 27 %, droits de propriété
intellectuelle étendus jusqu'en 2032, engagement d'achat de services Azure, et surtout le mécanisme
par lequel l'atteinte de l'AGI, déclarée par OpenAI, est vérifiée par un panel d'experts
indépendant. Ce point est traité ailleurs dans mon livre. Ce que je cherche ici n'est pas la
répartition de la valeur, c'est la répartition du **contrôle**.

1. OPENAI. Sur les documents constitutifs, les statuts, les communiqués de l'entreprise et les
   pièces officielles, et non sur des reprises de presse :
   - l'architecture juridique actuelle après la recapitalisation de 2025 : quelle entité contrôle
     quelle entité, quelle est la forme sociale de chacune, et où siège le pouvoir de décision
     final sur la publication d'un modèle ;
   - la composition de l'organe de gouvernance, nommément, avec les dates d'entrée et de sortie de
     chaque membre, et le mode de désignation : qui nomme, qui révoque, sur quelle majorité ;
   - la crise de novembre 2023 : la chronologie exacte, la composition du conseil à cette date, le
     motif officiellement invoqué, le déroulé du renversement de situation, et les conclusions de
     l'examen conduit ensuite par un cabinet externe. Je veux savoir précisément ce que cet
     épisode a démontré sur la capacité réelle d'un organe de contrôle à s'opposer à une direction ;
   - existe-t-il des engagements opposables pris envers une autorité publique à l'occasion de la
     restructuration — accord, protocole, engagement souscrit auprès d'un procureur général d'État
     ou d'un régulateur ? Si oui : le texte, sa force juridique exacte, et qui peut en sanctionner
     la violation.

2. ANTHROPIC. Le Long-Term Benefit Trust : l'acte constitutif ou sa description publique de
   première main, l'identité des administrateurs successifs, la classe d'actions ou les sièges
   qu'il désigne, le calendrier selon lequel ses pouvoirs s'étendent, et les conditions dans
   lesquelles ces pouvoirs peuvent être modifiés ou écartés — notamment par une majorité
   d'actionnaires. La question décisive : ce dispositif a-t-il déjà exercé un pouvoir, une fois,
   de façon documentée ? Si la réponse est non, dis-le franchement.
   Documente aussi la forme sociale de l'entreprise et ce que cette forme oblige ou n'oblige pas.

3. ALPHABET ET META. Les actions à droit de vote multiple, sur les documents déposés auprès du
   régulateur boursier américain (déclarations de vote annuelles et rapports annuels), pas sur des
   articles : le nombre de voix attaché à chaque classe d'actions, le pourcentage du capital et le
   pourcentage des droits de vote détenus par les fondateurs et dirigeants, à la date la plus
   récente disponible. Puis l'historique des résolutions d'actionnaires demandant la suppression de
   ce mécanisme : leur libellé, l'année, le résultat du vote, et le résultat qu'elles auraient
   obtenu à une voix par action si ce calcul a été publié. C'est cet écart qui m'intéresse.

4. LES AUTRES ACTEURS DE POINTE, brièvement mais nommément : xAI, Meta AI, Mistral AI, DeepSeek,
   Alibaba. Forme sociale, actionnariat de contrôle, et existence ou absence d'un organe interne
   dédié à la sécurité doté d'un pouvoir d'arrêt. Je cherche à savoir si le modèle du fondateur
   au contrôle est une particularité américaine ou une constante.

5. LA QUESTION QUI DÉCIDE DE L'INTÉRÊT DE CE DOSSIER, ET JE LA VEUX TRAITÉE SÉPARÉMENT ET À FOND.
   Existe-t-il un cas documenté, daté et attribué, où une instance extérieure à la direction
   opérationnelle — conseil d'administration, trust, comité de sécurité interne, assemblée
   d'actionnaires, régulateur, tribunal — a effectivement empêché, retardé ou modifié la
   publication ou le déploiement d'un modèle d'IA de pointe ? Je ne cherche pas une politique
   affichée, une charte, ni un engagement de type « nous ne déploierons pas si » : je cherche un
   fait, avec sa date, son auteur et le coût assumé par celui qui a décidé.
   Si la réponse est qu'aucun cas de ce genre n'est documenté, écris-le explicitement : c'est
   exactement le résultat que j'utiliserai.

6. LE CADRE D'ANALYSE. Quels travaux universitaires ou institutionnels traitent spécifiquement de
   la gouvernance d'entreprise des laboratoires d'IA — et non de la régulation publique de l'IA,
   qui est un autre sujet ? Pistes à explorer : les travaux du Centre for the Governance of AI, le
   rapport de Common Wealth sur la gouvernance d'entreprise au-delà de la propriété dans l'IA, la
   littérature sur les sociétés à mission et sur les structures à profit plafonné, et toute analyse
   de la « windfall clause ». Pour chacun : la thèse en une phrase, la référence complète avec sa
   date, deux citations exploitables avec leur emplacement exact, et la critique la plus sérieuse
   qui lui est adressée. Précise pour chacun s'il est empiriquement étayé ou interprétatif.

7. LE CONTRADICTEUR, ET JE LE VEUX DANS SA MEILLEURE VERSION. Quel est l'argument le mieux
   construit selon lequel un contrôle concentré entre les mains de fondateurs est **préférable**
   pour la sécurité — parce qu'il permet de résister à la pression des marchés à court terme, de
   renoncer à un produit rentable, ou de tenir un engagement coûteux dans le temps ? Cet argument
   est avancé par les entreprises elles-mêmes : donne-le tel qu'elles le formulent, avec leurs
   mots. Puis confronte-le à ce qui est mesuré : les engagements de pause unilatérale ont-ils été
   tenus, affaiblis ou annulés, et par qui ? Je cherche la vérification empirique de la promesse,
   pas la promesse.

8. Signale enfin tout élément qui contredirait ma thèse, qui est la suivante : les décisions de
   déploiement les plus lourdes de conséquence pour des populations entières se prennent dans des
   organes que personne n'a élus, dont la composition n'est pas soumise à approbation publique, et
   dont les décisions ne sont susceptibles d'aucun recours. Si cette formulation est trop forte au
   regard des pièces, dis-le et donne la version exacte.

P19 — L'ouverture des modèles comme levier de la Partie 4

Fichier cible : Recherches/10F_ouverture.md · Débloque : un levier propositionnel du chapitre 10. (Placement à confirmer : voir la note ci-dessous.)

Pourquoi ce prompt, et pourquoi il est délicat. L'ouverture des modèles apparaît déjà dans quatre dossiers du livre, et toujours comme une faille, jamais comme un contre-pouvoir : l'exception de l'article 53(2) de l'AI Act qualifiée d'approche « Frankenstein-like » par Open Future (10_Europe.md), l'exclusion du logiciel libre non commercial du régime de responsabilité du fait des produits (10B), l'impossibilité de toute non-prolifération du calcul (11_KillSwitch), et l'irréversibilité de la diffusion (13_Bilan geo). Or le livre tient déjà l'argument inverse sans l'avoir jamais énoncé : l'étude de mémorisation qui porte le mouvement 3 du chapitre 5 n'a pu être conduite que sur des modèles à poids ouverts. Ce prompt doit donc produire un levier qui assume cette tension, pas la dissoudre. Il applique la grille en cinq éléments de la section 4 bis de 00-COORDINATION.md.

Note de placement. Le chapitre 10 est proposé plutôt que le chapitre 11 pour une raison de fond : sa thèse est que le point d'accroche qui ne se délocalise pas est celui qui suit le produit, et l'ouverture des poids est le seul mécanisme qui donne à des tiers l'accès que l'article 92 de l'AI Act et l'article 40 du DSA promettent sans l'obtenir — 10C_leviers.md établit que ce dernier n'a produit que 49 demandes dans toute l'Union. À trancher avant de lancer le prompt.

[CHARTE DE PREUVE]

J'écris un chapitre qui cherche des points d'appui juridiques et institutionnels réels contre la
concentration du pouvoir sur les modèles d'IA. Je veux instruire un levier précis : la publication
ouverte des modèles. Traite-le comme un levier, c'est-à-dire selon les cinq exigences de la charte
— mécanisme, statut, coût et qui le supporte, ce qu'il ne résout pas, objection la plus sérieuse.

1. LE MÉCANISME, ET RIEN D'AUTRE D'ABORD. Qu'est-ce que la disponibilité publique des poids d'un
   modèle rend concrètement possible, qu'un modèle fermé rend impossible ? Je ne veux pas de
   principes généraux sur la transparence : je veux des travaux de recherche qui ont produit un
   résultat **parce que** les poids étaient accessibles, et qui n'auraient pas pu être conduits
   autrement. Mon cas de référence est l'étude d'extraction de contenus mémorisés de A. Feder
   Cooper, James Grimmelmann et al. (arXiv 2505.12546), menée sur cinq modèles à poids ouverts.
   Trouve-m'en d'autres, dans d'autres domaines : biais mesurés, failles de sécurité, évaluation
   indépendante de capacités dangereuses, vérification d'allégations de performance, audit de
   données d'entraînement. Pour chacun : les auteurs, la date, le statut de publication, et
   surtout la phrase du travail qui explique pourquoi l'accès aux poids était nécessaire.

2. LA TAXONOMIE, PARCE QUE LE VOCABULAIRE EST PIÉGÉ. Distingue rigoureusement : poids ouverts,
   modèle ouvert, code d'entraînement ouvert, données d'entraînement ouvertes, licence libre au
   sens juridique. Où en est la définition de l'Open Source Initiative applicable à l'IA, adoptée
   en 2024 : que dit-elle exactement, et quelles controverses a-t-elle suscitées ? Puis classe les
   principaux modèles disponibles selon cette grille — Llama, Mistral, DeepSeek, Qwen, OLMo,
   BLOOM, et tout autre pertinent — en donnant pour chacun les termes réels de sa licence et les
   restrictions qu'elle contient. Je veux pouvoir écrire lesquels sont réellement ouverts et
   lesquels ne le sont qu'en communication.

3. LE STATUT SUR MON ÉCHELLE, ET C'EST LA QUESTION QUI DÉCIDE DE TOUT. L'ouverture des modèles
   a-t-elle produit un effet **mesuré** sur la concentration du pouvoir de calcul, sur le prix de
   l'accès à l'inférence, sur le nombre d'acteurs capables de déployer un système de pointe, ou sur
   la capacité de recherche indépendante ? Je cherche des séries chiffrées, pas des affirmations
   d'écosystème. Si aucune évaluation indépendante n'existe, dis-le : ce vide est un résultat que
   j'écrirai tel quel.

4. L'OBJECTION LA PLUS SÉRIEUSE, QUE J'AI DÉJÀ ET QUI EST LOURDE. Le rapport international sur la
   sûreté de l'IA établit que les modèles à poids ouverts sont à moins d'un an derrière les
   meilleurs modèles fermés, et qu'une fois publiés, des poids ne peuvent pas être rappelés ; il
   relève par ailleurs qu'une majorité des outils de biologie assistée par IA jugés à fort
   potentiel de mésusage sont ouverts. Je veux la meilleure réponse publiée à cette objection, et
   en particulier tout travail qui mesure le **surcroît de risque réellement imputable à
   l'ouverture** plutôt que le risque en général : études de gain marginal comparant l'accès à un
   modèle ouvert à l'accès à l'information déjà publique. Le rapport de la National
   Telecommunications and Information Administration américaine sur les modèles de fondation à
   double usage à poids largement disponibles (2024) doit être ouvert et restitué précisément :
   sa question, sa méthode, sa conclusion sur l'état des preuves, et ses recommandations exactes.
   Si sa conclusion est qu'il n'y a pas assez d'éléments pour trancher, donne la formulation exacte.

5. LE POINT OÙ JE VEUX QUE TU SOIS LE PLUS DUR AVEC MOI. L'ouverture décentralise-t-elle
   réellement le pouvoir, ou le consolide-t-elle ? Documente l'analyse selon laquelle publier un
   modèle est une stratégie de banalisation du complément qui protège la position dominante de
   celui qui publie — appliquée notamment à Meta et à Llama. Et documente l'usage géopolitique de
   l'ouverture par des acteurs chinois : est-ce un instrument de diffusion démocratique ou de
   conquête de parts d'écosystème ? Je veux des analyses nommées et argumentées des deux côtés.
   Regarde aussi qui supporte réellement le coût de la publication ouverte : l'entraînement reste
   concentré, l'ouverture ne redistribue pas le calcul d'entraînement. Ce point est-il documenté ?

6. LE VERSANT JURIDIQUE, ET LA COMPARAISON QUI M'INTÉRESSE LE PLUS. D'un côté, les dispositifs
   légaux qui prétendent donner à des tiers l'accès nécessaire au contrôle : l'article 92 du
   règlement européen sur l'IA, qui permet au Bureau de l'IA d'accéder à un modèle y compris par
   interface de programmation ou par le code source, et l'article 40 du règlement sur les services
   numériques, qui ouvre l'accès des chercheurs aux données des plateformes. Pour chacun : ce qu'il
   permet exactement, et **ce qu'il a produit à ce jour**, en nombre de demandes, de décisions et
   d'accès effectivement accordés. De l'autre côté, les dispositifs qui traitent l'ouverture comme
   une exemption : l'article 53(2) du même règlement et l'exclusion du logiciel libre non commercial
   du régime révisé de responsabilité du fait des produits. Existe-t-il des juristes qui soutiennent
   que l'ouverture devrait être une **obligation ou une condition** — par exemple pour l'accès aux
   marchés publics, à un financement public, ou en contrepartie d'une exception au droit d'auteur
   pour l'entraînement — plutôt qu'une exemption ? Nomme-les, donne leurs propositions et leur
   statut : proposées, discutées, adoptées nulle part.

7. LES INITIATIVES D'INTÉRÊT PUBLIC, avec leur bilan et non leur intention. AI2 et OLMo,
   EleutherAI, BigScience et BLOOM, les projets européens de modèles ouverts, les infrastructures
   publiques de calcul mises à disposition de la recherche. Pour chacune : le financement, son
   montant et son origine, ce qui a été effectivement publié, et si un effet a été évalué par un
   tiers. Signale celles qui ont été interrompues ou dont le financement n'a pas été reconduit :
   c'est le coût du levier, et il m'intéresse autant que sa promesse.

8. Enfin, dis-moi franchement si ce levier est plus faible que je ne l'espère. Si la conclusion
   honnête est que l'ouverture des modèles est le seul mécanisme d'audit qui fonctionne
   effectivement et simultanément le principal vecteur d'irréversibilité, écris-le : cette
   contradiction est ce que je veux écrire, et je préfère la tenir que la résoudre à tort.

Ajouts au suivi

Prompt Fichier cible Priorité Lancé Reçu Audité
P18 06_imputation.md Importante Excellent — exploitable en l'état
P19 10F_ouverture.md Importante Insuffisant — relancé par P20
P20 10F-bis_ouverture.md Importante

P20 — Relance ciblée du levier d'ouverture

Fichier cible : Recherches/10F-bis_ouverture.md · Débloque : le levier du chapitre 10, que 10F_ouverture.md ne rend pas écrivable en l'état.

Pourquoi une relance. 10F_ouverture.md a réussi sur deux points et échoué sur quatre. Il a ouvert le rapport de la NTIA et restitué sa logique de risque marginal, et il a établi la taxonomie et la controverse sur la définition de l'Open Source Initiative. Mais sur les quatre autres, il rend des généralités : la question 1 ne produit aucune étude nommée en dehors de celle que je lui avais fournie, la question 5 n'attribue aucune des deux lectures qu'elle expose, la question 6 déclare ne pas vouloir inventer les juristes qu'elle n'a pas trouvés, et la question 7 n'a ni montant ni bilan. Quatre des cinq éléments de la grille de la section 4 bis sont donc manquants, et un levier privé de son mécanisme et de son coût n'est pas un levier.

Le défaut est le même que celui de P15, et il se corrige de la même façon. Le dossier tient dans sa propre bibliographie deux sources institutionnelles françaises de premier rang qu'il n'a jamais exploitées : l'avis de l'Autorité de la concurrence sur l'intelligence artificielle générative (texte intégral en PDF) et la note d'analyse de la CNIL sur les pratiques d'open source en IA de juin 2024. Commencer par elles.

[CHARTE DE PREUVE]

Relance ciblée. Je ne reviens pas sur ce qui est acquis : le rapport de la NTIA sur les modèles de
fondation à double usage à poids largement disponibles, sa logique de risque marginal et sa
recommandation de ne pas restreindre en l'état ; la définition de l'Open Source AI de l'Open Source
Initiative de 2024 et la controverse sur le fait qu'elle n'exige pas les données d'entraînement mais
seulement une information suffisante pour reconstituer un système équivalent. Ne me les redonne pas.

Quatre demandes, et une consigne préalable.

CONSIGNE PRÉALABLE — DEUX DOCUMENTS À OUVRIR AVANT TOUT LE RESTE. Ils sont institutionnels,
français, primaires, et directement sur mon sujet.
   a) https://www.cnil.fr/sites/cnil/files/2024-06/note_d_analyse_sur_les_pratiques_open_source_en_ia.pdf
      Note d'analyse de la CNIL sur les pratiques d'open source en intelligence artificielle,
      juin 2024. Restitue précisément : sa définition de l'ouverture, la typologie qu'elle retient,
      ce qu'elle dit du contrôle exercé par des tiers sur un modèle ouvert, et ce qu'elle dit des
      risques. Cite verbatim les passages exploitables, avec leur page.
   b) https://www.autoritedelaconcurrence.fr/sites/default/files/integral_texts/2024-07/24a05_merged.pdf
      Avis de l'Autorité de la concurrence sur l'intelligence artificielle générative. C'est une
      autorité publique qui analyse la structure de marché : je veux tout ce qu'elle dit de
      l'ouverture des modèles comme facteur de concurrence ou comme stratégie des acteurs
      dominants, avec les numéros de paragraphe. Si elle qualifie la publication ouverte de
      stratégie de verrouillage, c'est le cœur de ma demande 3 ci-dessous et je veux sa
      formulation exacte.

1. LE MÉCANISME, PAR DES TRAVAUX NOMMÉS. Je veux quatre à six travaux de recherche, chacun avec ses
   auteurs, sa date, son statut de publication et son résultat chiffré, qui n'auraient pas pu être
   conduits sans accès aux poids d'un modèle. Ne me redonne pas l'étude de mémorisation de Cooper
   et Grimmelmann, je l'ai. Cherche dans ces directions, et nomme les travaux :
   - l'interprétabilité mécaniste conduite par des équipes extérieures à l'entreprise qui a produit
     le modèle ;
   - la démonstration que des garde-fous de sécurité peuvent être retirés par réglage fin, avec le
     coût mesuré de l'opération ;
   - l'extraction de données personnelles ou de données d'entraînement ;
   - la mesure de biais au niveau des représentations internes et non des sorties ;
   - la vérification indépendante d'une allégation de performance, ou la détection d'une
     contamination de banc d'essai.
   Pour chacun, la phrase du travail qui établit que l'accès aux poids était la condition de
   possibilité. Si un domaine ne donne rien, dis-le domaine par domaine.

2. LES LICENCES, AU TEXTE. Ma grille actuelle dit « variable » et « selon la version », ce qui est
   inutilisable. Je veux, pour Llama, Mistral, DeepSeek, Qwen, Gemma, OLMo et BLOOM : le nom exact
   de la licence de la version la plus récente, et la clause restrictive citée dans sa lettre —
   seuil d'utilisateurs au-delà duquel une autorisation devient nécessaire, interdiction d'usage
   pour entraîner un modèle concurrent, politique d'usage acceptable rendue contractuelle,
   restriction de territoire. Je dois pouvoir écrire qu'un modèle présenté comme ouvert impose
   telle condition précise, en la citant.

3. LE POINT SUR LEQUEL JE VEUX ÊTRE CONTREDIT, ET IL EST ARGUMENTÉ NULLE PART DANS TON DOSSIER
   PRÉCÉDENT. L'ouverture consolide-t-elle le pouvoir de celui qui publie ? Je veux des analyses
   attribuées, avec auteur nommé et référence, des deux côtés :
   - la thèse de la banalisation du complément appliquée à Meta et à Llama : qui la formule, où,
     en quels termes, et sur quelles données ;
   - la réponse de ceux qui soutiennent que l'ouverture a réellement élargi le nombre d'acteurs
     capables de déployer ;
   - l'usage de l'ouverture par les acteurs chinois : je veux au moins une analyse de politique
     publique ou de recherche stratégique nommée qui traite la publication de DeepSeek et de Qwen
     comme un instrument de conquête d'écosystème, et au moins une qui la traite comme une
     diffusion bénéfique. Deux hypothèses argumentées et attribuées valent mieux qu'un arbitrage,
     mais elles doivent être attribuées.

4. LE VERSANT JURIDIQUE, ET C'EST LA DEMANDE LA PLUS IMPORTANTE. Deux volets.
   a) Existe-t-il des juristes, des institutions ou des rapports officiels qui proposent de faire
      de l'ouverture une CONDITION plutôt qu'une exemption ? Pistes précises : conditionnalité de
      l'accès aux marchés publics, contrepartie d'un financement public de calcul, contrepartie de
      l'exception de fouille de textes et de données du droit d'auteur européen, obligation
      d'ouverture pour les modèles entraînés sur des données publiques. Pour chaque proposition :
      l'auteur nommé, le document, la date, la formulation exacte, et son statut — proposée,
      débattue dans une instance identifiée, ou adoptée nulle part. Si cette doctrine n'existe
      pas et que j'ai imaginé un courant qui n'est pas là, dis-le franchement : c'est un résultat.
   b) L'article 92 du règlement européen sur l'IA a-t-il été employé une seule fois ? Je cherche
      un cas, une date, une décision. Et pour l'article 40 du règlement sur les services
      numériques, je dispose déjà d'un décompte de 49 demandes à l'échelle de l'Union : confirme
      ou corrige ce chiffre sur la source qui le publie, donne sa date d'arrêté, et donne le
      nombre d'accès effectivement accordés. Ce que je veux écrire est une comparaison : ce que
      la loi promet d'accès aux tiers, et ce qu'elle en obtient.

5. LE BILAN DES INITIATIVES PUBLIQUES, EN CHIFFRES. Pour OLMo et Ai2, BLOOM et BigScience, les
   modèles ouverts financés sur fonds publics européens, et les infrastructures publiques de calcul
   ouvertes à la recherche : le montant du financement et son origine, ce qui a été effectivement
   publié, le nombre de téléchargements ou de travaux dérivés s'il est publié, et surtout celles
   dont le financement n'a pas été reconduit ou qui se sont arrêtées. Je cherche le coût du levier
   et sa fragilité budgétaire, pas son intention. Un projet interrompu m'est plus utile qu'un
   projet annoncé.

P21 — Le mécanisme du levier d'ouverture, par des travaux nommés

Fichier cible : Recherches/10G_ouverture_mecanisme.md · Complète : le point (a) de la grille de la section 4 bis pour le levier du chapitre 10.

Pourquoi une troisième passe, et pourquoi celle-ci devrait aboutir. P19 et P20 ont tous deux échoué sur la même demande — produire des travaux nommés démontrant ce que l'accès aux poids rend possible — parce que je la posais en exploration ouverte. Or les deux passes qui ont réussi dans ce projet, P15 et P17, procédaient autrement : elles nommaient les cibles et demandaient une vérification. Ce prompt fait pareil. Les huit travaux ci-dessous sont des candidats que je crois exister ; la commande est de les vérifier, de les corriger, et d'écarter ceux qui ne tiennent pas.

La demande analytique qui compte, et elle est en question 3. Ce chapitre ne cherche pas à faire l'éloge de l'ouverture. Sa thèse est que l'ouverture est simultanément le seul mécanisme d'audit qui fonctionne et le principal vecteur d'irréversibilité. Plusieurs des travaux ci-dessous démontrent probablement les deux à la fois, dans le même geste. C'est cela que je veux savoir.

[CHARTE DE PREUVE]

Une seule demande, et je te donne les cibles. Ne partes pas en exploration : vérifie, corrige,
écarte.

CONTEXTE. J'instruis un levier de gouvernance : la publication ouverte des poids d'un modèle d'IA.
J'ai déjà établi, sur l'avis 24-A-05 de l'Autorité de la concurrence française et sur l'article de
Widder, West et Whittaker paru dans Nature en novembre 2024, ce que l'ouverture change et ne change
pas à la structure du pouvoir. Ce qui me manque est concret : des travaux de recherche qui ont
produit un résultat parce que les poids étaient accessibles, et qui n'auraient pas pu être conduits
sur un modèle fermé. J'ai déjà l'étude d'extraction de contenus mémorisés de Cooper, Grimmelmann et
al., arXiv 2505.12546 : ne me la redonne pas.

1. VÉRIFIE CES CANDIDATS, UN PAR UN. Pour chacun : les auteurs, le titre exact, la date, le lieu de
   publication et son statut (revue à comité de lecture, actes de conférence, prépublication,
   rapport d'organisation), le résultat chiffré principal, et la phrase du travail qui établit que
   l'accès aux poids était la condition de possibilité. Si un candidat n'existe pas, ou que je l'ai
   mal décrit, dis-le et donne la version exacte. Si un candidat existe mais qu'il a en réalité été
   conduit sur un modèle fermé par interface de programmation, c'est un résultat important et je le
   veux : il affaiblit mon levier.

   a) Le retrait des garde-fous de sécurité par réglage fin, avec son COÛT MESURÉ. Trois pistes :
      les travaux de Simon Lermen, Charlie Rogers-Smith et Jeffrey Ladish sur l'annulation de
      l'entraînement de sécurité de Llama 2-Chat par réglage fin de faible rang ; le travail dit
      « Shadow Alignment » de Xianjun Yang et al. ; et l'article de Xiangyu Qi et al. présenté à
      ICLR 2024 sur la compromission de la sécurité par réglage fin même sans intention
      malveillante. Pour chacun, je veux impérativement le chiffre du coût — nombre d'exemples
      d'entraînement, heures de calcul, dollars — parce que c'est ce chiffre qui fait l'argument,
      dans les deux sens.

   b) L'interprétabilité mécaniste conduite par une équipe extérieure à l'entreprise qui a produit
      le modèle. Pistes : le travail d'Andy Zou, Andy Arditi et al. établissant que le refus d'un
      modèle de langage est médié par une direction unique dans l'espace des représentations ;
      le travail de Kenneth Li et al. sur un modèle entraîné au jeu d'Othello et la question de
      savoir s'il construit une représentation interne de l'état du plateau ; et les travaux de
      David Bau et Kevin Meng sur la localisation et l'édition d'associations factuelles.

   c) L'audit d'un jeu de données d'entraînement rendu possible par sa publication. Piste
      principale : l'audit du jeu LAION-5B conduit par le Stanford Internet Observatory et publié
      par David Thiel en décembre 2023, et ses conséquences documentées sur la disponibilité du
      jeu. Je veux le rapport lui-même, sa méthode, son résultat, la réaction de LAION avec sa
      date, et l'état actuel du jeu de données. Traite ce cas avec sobriété et sans détail
      superflu : ce qui m'intéresse est le fait qu'un audit externe ait été possible et ait
      produit un effet.

   d) La vérification indépendante d'une allégation de performance, rendue possible parce que le
      modèle avait été publié. Piste : l'affaire du modèle annoncé sous le nom de Reflection 70B
      en septembre 2024, dont la communauté a contesté les performances annoncées puis mis en
      doute l'identité réelle. Je veux la chronologie, les acteurs qui ont conduit la
      vérification nommément, la méthode employée, et la conclusion établie. Si cette affaire est
      moins nette que je ne le crois, dis-le.

   e) L'extraction de données d'entraînement. Piste : les travaux de Nicholas Carlini et al., à la
      fois sur les modèles de langage et sur les modèles de diffusion. Point décisif pour moi :
      certains de ces travaux ont-ils été conduits sur des modèles FERMÉS par simple interface de
      programmation ? Si oui, cela montre que l'audit ne requiert pas toujours les poids, et je
      dois l'écrire.

2. SI UN DOMAINE NE DONNE RIEN, DIS-LE DOMAINE PAR DOMAINE. En particulier, je cherchais un travail
   mesurant un biais au niveau des représentations internes plutôt que des sorties, et je n'ai pas
   de candidat solide à te proposer. Si ce type de travail existe, nomme-le ; s'il n'existe pas sous
   cette forme, écris-le.

3. LA QUESTION ANALYTIQUE, ET C'EST LA PLUS IMPORTANTE. Pour chacun des travaux que tu auras
   validés, dis-moi s'il démontre simultanément deux choses : que l'ouverture permet un contrôle
   externe impossible autrement, ET qu'elle fournit un mode opératoire réutilisable par un acteur
   malveillant. Autrement dit : le même article est-il à la fois une preuve d'auditabilité et une
   recette ? Je pense que c'est le cas d'au moins les catégories (a) et (b), et que cela n'est pas
   une faiblesse accidentelle du levier mais sa structure. Confirme, corrige, ou contredis-moi.
   Et signale, s'il y en a, les travaux où les auteurs eux-mêmes discutent ce dilemme de
   publication et expliquent pourquoi ils ont publié quand même : leur raisonnement m'intéresse
   autant que leur résultat.

4. UN DERNIER POINT, ET IL EST BREF. Existe-t-il un cas documenté où une découverte faite sur un
   modèle à poids ouverts a conduit un fournisseur de modèle FERMÉ à corriger quelque chose chez
   lui ? Ce serait l'argument le plus fort du levier — l'ouverture profitant même à ce qui reste
   fermé — et je n'en connais aucun. Si tu n'en trouves pas, dis-le : ce vide se déclare et
   s'écrit.

Ajout au suivi

Prompt Fichier cible Priorité Lancé Reçu Audité
P21 10G_ouverture_mecanisme.md Importante

Reste ouvert après P21, et non couvert par lui volontairement : le point (c) de la grille pour ce levier, c'est-à-dire son coût — financements d'Ai2 et d'OLMo, de BigScience et de BLOOM, des modèles européens ouverts, des infrastructures publiques de calcul, et surtout les projets interrompus ou non reconduits. Trois passes ont échoué sur ce point. Il fera l'objet d'un prompt séparé si l'auteur le décide, la leçon de la scission de 12-F étant qu'une demande de bilan chiffré ne survit pas à la cohabitation avec une demande bibliographique.