Vérification de la totalité des notes du chapitre 5 et resserrage de l'appareil critique, en quatre passes. Vingt-deux écarts de fond corrigés, dont : - le format WET de Common Crawl conserve l'URL, contrairement à ce qu'affirmait le texte ; la perte de provenance porte sur les métadonnées de l'en-tête HTML, routées vers le WAT - un taux de duplication de 90 % sans origine, remplacé par la mesure publiée (14 à 52 %, CopyCat, SIGIR 2021) - une citation en bloc de Ben Zhao dont deux phrases étaient fabriquées - l'exemple canonique de Nightshade, inventé et inversé (les voitures deviennent des vaches, non le contraire) - l'exception britannique de fouille existe (art. 29A CDPA 1988), mais elle est limitée aux usages non commerciaux - la chronologie de la négociation sur les journaux ChatGPT était inversée : les 20 millions sont une offre d'OpenAI, non une concession arrachée - Weinberg présenté comme allié des créateurs alors qu'il défend l'usage loyal Retraits pour insuffisance de source : citation de Bill Gross et paraphrase d'Aaron Rubin (Digiday inaccessible), 15 000 images Getty (étude ni nommée ni datée), taxe de 6 % du syndicat britannique, qualification d'« abus » par OpenAI (agrégateurs seuls), reculs de trafic par titre, ratios de volume entre formats WARC, WAT et WET. Appareil critique : 55 notes ramenées à 33, soit une note tous les 380 mots au lieu de 221, en alignement sur les chapitres 1 à 4. Fusion par bloc démonstratif, citations verbatim reportées au registre. Correction d'un appel dupliqué que Pandoc aurait imprimé deux fois. Quatre notes reposent désormais sur une pièce judiciaire primaire lue dans son texte original : approbation définitive du règlement Anthropic (3:24-cv-05417, pièce 680), mémoire d'objections d'OpenAI sur les journaux de conversations (1:25-md-03143, pièce 935), plainte consolidée (pièce 183), et ordonnance Riganian citant Andersen (4:25-cv-00824, pièce 117). Plus aucune note ne porte de réserve d'accès. Contrôles : compter-mots, verifier-litteralite et detecteur-ia passés, 206 pages sur 20/20 sections.
93 KiB
PROMPTS DE RECHERCHE — lot du 03/08/2026
Quatorze prompts couvrant l'ensemble des manques identifiés par la revue de plan du 03/08/2026 (
00_PLAN_NARRATIF.md). Chacun est autonome et prêt à copier. Enregistrer le résultat sous le nom de fichier indiqué, dansRecherches/.Ce fichier n'appartient pas au manuscrit : il ne doit jamais entrer dans le tableau
CHAPITRESdecompiler-livre.sh.Ordre conseillé. Lancer d'abord les quatre prompts marqués BLOQUANT (P1, P2, P3, P7, P9) : sans eux, trois chapitres ne peuvent pas s'écrire comme prévu. Les autres peuvent revenir pendant la rédaction.
Pourquoi une charte. Les deux meilleurs dossiers du projet,
11A-bis.mdet11C_humain.md, doivent leur qualité à des exigences de preuve durcies dans la commande elle-même : robustesse chiffrée avec protocole et échantillon, distinction entre demande et condamnation, déclaration explicite des vides documentaires. La charte ci-dessous généralise cette discipline. La coller en tête de chaque prompt.
CHARTE DE PREUVE — à coller en tête de chaque prompt
CHARTE DE PREUVE — applique-la à toute ta réponse.
1. Sépare systématiquement ce que tu sources de ce que tu affirmes. Si tu déduis, écris que tu déduis.
2. Pour chaque fait : la date, l'auteur ou l'institution nommément, et un lien vers la source
primaire. Si tu n'as qu'une source secondaire, dis-le explicitement.
3. Sources proscrites : agrégateurs de citations (azquotes, quotefancy, goodreads), pages de
résultats de moteur de recherche, vidéos, blogs personnels, LinkedIn, Medium, sites financiers
automatisés, encyclopédies collaboratives comme source unique. Si une information n'existe que
là, signale-la comme non sourçable au lieu de la reprendre.
4. Pour tout chiffre issu d'une étude : protocole, taille d'échantillon, méthode de mesure, et
statut de publication (revue à comité de lecture / actes de conférence / prépublication /
rapport d'organisation). Une prépublication doit être étiquetée comme telle.
5. Distingue toujours : une demande judiciaire d'une condamnation ; une proposition d'une mise en
œuvre ; un engagement volontaire d'une obligation ; un jugement définitif d'un jugement frappé
d'appel ou non exécutoire.
6. Pour tout dispositif, levier ou remède : (a) le mécanisme concret par lequel il agit —
« renverser la charge de la preuve » est un mécanisme, « mieux encadrer » n'en est pas un ;
(b) son statut sur l'échelle ÉPROUVÉ (mis en œuvre et évalué par un tiers indépendant) /
AMORCÉ (mis en œuvre, non évalué, ou évalué par une partie intéressée) / PROPOSÉ (formulé par
un acteur identifié, jamais mis en œuvre) / DÉDUIT ; (c) son coût et sur qui il tombe ;
(d) ce qu'il ne résout pas ; (e) l'objection la plus sérieuse qu'on lui oppose.
7. Déclare explicitement les vides documentaires. « Aucune étude chiffrant X n'a été trouvée » est
un résultat utile et je le veux. En revanche, ne remplace jamais une mesure manquante par une
paraphrase de l'obligation ou de la promesse.
8. Si un fait que je te donne à vérifier se révèle faux, inexact ou introuvable, dis-le
franchement et donne la version exacte. Ne le confirme pas par complaisance.
9. Réponds en français. Donne les chiffres dans leur unité et leur devise d'origine, avec leur date.
P1 — BLOQUANT — Le garde-fou aveugle, chiffré
Fichier cible : Recherches/07_gardefou.md · Débloque : chapitre 7, mouvement 3, et la dette la plus exposée du livre (annoncée deux fois explicitement, plus une question ouverte dans l'introduction).
[CHARTE DE PREUVE]
Je cherche à documenter, avec des chiffres et non des principes, ce que retient réellement la
validation humaine dans une chaîne de ciblage militaire automatisée.
1. TEMPS ET CADENCE. L'enquête de +972 Magazine et Local Call sur le système Lavender (avril 2024,
six officiers du renseignement israélien) contiendrait une indication de la durée d'autorisation
accordée à un officier par cible — un chiffre de l'ordre de vingt secondes est parfois cité de
seconde main. Retrouve le passage exact, cite-le verbatim dans sa langue d'origine, et donne sa
place dans l'enquête. Si ce chiffre n'y figure pas, dis-le : c'est un résultat.
Cherche également tout autre chiffre documenté de temps par décision, de nombre de cibles
validées par opérateur et par jour, ou de taux d'infirmation des recommandations.
2. PRÉCÉDENTS HISTORIQUES DOCUMENTÉS. Deux cas de validation humaine défaillante sous contrainte
de temps, avec les rapports d'enquête officiels : les tirs fratricides du système Patriot pendant
l'invasion de l'Irak en 2003 (rapports du Defense Science Board ou équivalents : temps de
décision accordé aux opérateurs, mode de classification automatique, conclusions sur la
confiance accordée au système) ; et la destruction du vol Iran Air 655 par l'USS Vincennes en
1988 (rapport d'enquête, temps écoulé, information disponible à l'équipage).
3. TRAVAUX ACADÉMIQUES SUR LE BIAIS D'AUTOMATISATION EN CONTEXTE MILITAIRE. En particulier
Ingvild Bode sur les pratiques et la construction normative du contrôle humain, et
Mary « Missy » Cummings sur la supervision d'automatismes et la charge de l'opérateur.
Pour chacune : les publications précises, la méthode, et les résultats chiffrés s'il y en a.
4. TÉMOIGNAGES NOMMÉS. Existe-t-il un officier, analyste ou opérateur identifié par son nom ou
par un pseudonyme stable, qui décrit sa propre expérience de validation sous contrainte de
temps, dans n'importe quelle armée ? Je cherche une voix, pas une synthèse.
5. DROIT ET DIPLOMATIE. Vérifie le vote de la résolution A/80/57 de l'Assemblée générale des
Nations unies sur les systèmes d'armes létaux autonomes : deux décomptes circulent, 164-6-7 et
156-5-8. Sont-ce deux scrutins distincts, l'un en Première Commission et l'autre en plénière ?
Donne les dates, les intitulés exacts et les résultats de chacun.
Vérifie aussi la proposition américaine de mars 2026 visant à remplacer l'exigence de
« contrôle humain » par celle d'un « good faith human judgement and care » : document source,
contexte, formulation exacte.
Signale enfin tout élément qui contredirait la thèse selon laquelle la validation humaine est
devenue formelle. Je veux le contre-argument s'il existe.
P2 — BLOQUANT — L'épisode de juin 2026, à vérifier ou à écarter
Fichier cible : Recherches/06_interrupteur.md · Débloque : chapitre 6, mouvement 4, et la soudure vers le chapitre 7.
[CHARTE DE PREUVE]
Je dois vérifier un épisode dont mes notes actuelles sont probablement corrompues, et je préfère
l'écarter que l'écrire faux.
L'AFFIRMATION À VÉRIFIER. En juin 2026, l'administration américaine aurait ordonné à Anthropic de
désactiver ses modèles les plus avancés pour tous les utilisateurs non américains, au motif de leur
capacité à détecter des vulnérabilités informatiques critiques ; la mesure aurait été levée après
contestation. Mes notes désignent les modèles concernés par les noms « Mythos 5 » et « Fable 5 »,
qui ne correspondent à aucun produit Anthropic connu — je soupçonne donc une fabrication ou une
confusion.
CE QUE JE VEUX SAVOIR.
1. Cet épisode a-t-il eu lieu ? Si oui : la date exacte, l'instrument juridique employé (décret,
règle du Bureau of Industry and Security, licence, autre), le périmètre réel de la mesure, les
modèles réellement visés avec leurs noms commerciaux exacts, et les conditions de sa levée.
2. Si l'épisode n'a pas eu lieu, ou pas sous cette forme, dis-le nettement et indique quel
événement réel a pu être déformé pour produire ce récit.
3. Les réactions institutionnelles européennes, avec verbatim et source primaire : la commissaire
européenne à la Souveraineté technologique Henna Virkkunen aurait déclaré que « l'IA est en train
de devenir une arme géopolitique » et que ceux qui contrôlent les technologies critiques
détiennent un atout stratégique majeur ; Maurice Lévy aurait alerté à VivaTech sur des entreprises
européennes exposées à des fournisseurs capables de couper l'accès sans préavis, en appelant à un
fonds paneuropéen de 100 milliards d'euros ; Le Monde aurait publié un éditorial le 16 juin 2026.
Vérifie chacune de ces trois affirmations séparément.
4. Indépendamment de cet épisode : existe-t-il un cas documenté, daté et attribué, où un État a
restreint ou suspendu l'accès d'utilisateurs étrangers à un modèle d'IA commercial ? Je cherche
un précédent réel, même de moindre ampleur.
5. L'état actuel des contrôles américains à l'exportation applicables aux poids de modèles et aux
services d'informatique en nuage : quels textes, quels seuils, quelles obligations pour les
fournisseurs.
P3 — BLOQUANT — La chaîne du calcul, sur sources professionnelles
Fichier cible : Recherches/06_goulot.md · Débloque : chapitre 6, mouvement 3.
[CHARTE DE PREUVE]
Mes notes actuelles sur la concentration du marché des puces d'IA reposent sur des blogs
financiers, des sites de cryptomonnaies et des vidéos. Je dois tout reprendre sur des sources
professionnelles ou primaires. Écarte explicitement toute source de ce type et dis-le si un
chiffre n'existe nulle part ailleurs.
1. NVIDIA. Part de marché des accélérateurs d'IA pour centres de données, chiffre le plus récent
disponible, en précisant le périmètre exact mesuré (unités ou valeur, accélérateurs seuls ou
systèmes complets, avec ou sans puces conçues en interne par les hyperscalers). Sources
attendues : cabinets d'analyse sectorielle (Omdia, Mercury Research, IDC, TechInsights) ou
documents déposés par l'entreprise. Mes notes donnent « 75 à 90 % », ce qui est trop large pour
être écrit. Donne aussi le revenu du segment centres de données et sa croissance, depuis les
documents financiers officiels.
Puis le verrou logiciel : documente précisément en quoi CUDA, cuDNN, NCCL et TensorRT
constituent une barrière à l'entrée, et quel est l'état réel des alternatives (ROCm, oneAPI,
compilation portable), avec des éléments mesurés de portabilité et non des déclarations.
2. TSMC. Part des puces d'IA les plus avancées, avec la définition du seuil retenu. Et surtout le
véritable goulot d'étranglement : la capacité d'emballage avancé de type CoWoS, son allocation
entre clients, et l'état de son expansion. Sources attendues : rapports trimestriels de
l'entreprise, TrendForce, DigiTimes. Documente aussi l'écart de coût et de délai entre une
usine à Taïwan et l'usine d'Arizona, avec des chiffres attribués.
3. ASML. Livraisons de machines de lithographie extrême ultraviolet, en unités, sur les deux
derniers exercices, depuis le rapport annuel de l'entreprise. Prix unitaire, masse, logistique
de livraison, nombre de fournisseurs de la chaîne. Et l'état des licences d'exportation vers la
Chine, EUV et DUV séparément, avec les décisions néerlandaises et américaines correspondantes.
4. LA QUESTION QUI M'INTÉRESSE LE PLUS. Ces trois verrous sont-ils réellement non réplicables à
court terme, et sur quelles preuves ? Je veux les délais et les coûts documentés d'une tentative
de duplication, et l'argument le plus sérieux de ceux qui soutiennent que ces positions sont
plus fragiles qu'il n'y paraît.
5. CONCENTRATION DU CALCUL. Vérifie l'estimation d'Epoch AI selon laquelle cinq hyperscalers
détiendraient environ 71 % de la puissance de calcul d'IA mondiale cumulée fin 2025, contre 63 %
début 2024 : méthodologie, périmètre, unité de mesure, et limites reconnues par les auteurs.
P4 — BLOQUANT — Un penseur du pouvoir
Fichier cible : Recherches/06_pouvoir.md · Débloque : le débat d'idées du chapitre 6, aujourd'hui inexistant.
[CHARTE DE PREUVE]
J'écris un chapitre intitulé « Les nouveaux maîtres du monde », sur la concentration de
l'infrastructure de l'intelligence artificielle : puces, centres de données, énergie, eau, et la
dépendance des États. Mon dossier ne contient aucune analyse théorique du pouvoir. Je dois le
combler, et je ne veux pas d'un panorama : je veux deux thèses solides et opposables.
1. Présente les analyses disponibles du pouvoir économique et politique lié à l'infrastructure de
l'IA, en distinguant clairement les cadres théoriques. Explore au moins : l'approche par la
structure de marché et le droit de la concurrence (Lina Khan et l'école néo-brandeisienne
appliquée au calcul) ; l'approche par l'extraction matérielle (Kate Crawford, Atlas of AI) ;
l'approche par le contrôle de la production de connaissance (Cecilia Rikap sur la mainmise des
grandes entreprises technologiques sur la recherche) ; l'approche par le techno-féodalisme
(Yanis Varoufakis) ; et toute analyse d'économistes de l'infrastructure ou des « facilités
essentielles » appliquée au calcul.
Pour chacune : la thèse en une phrase, l'ouvrage ou l'article de référence avec sa date et son
éditeur, deux ou trois citations exploitables avec leur pagination ou leur emplacement exact,
et la critique la plus sérieuse qui lui est adressée.
2. Ces cadres sont-ils empiriquement testés, ou restent-ils interprétatifs ? Signale ce qui est
étayé par des mesures et ce qui relève de la lecture politique.
3. Je veux impérativement un contradicteur sérieux, et pas un homme de paille : l'argument le mieux
construit selon lequel cette concentration est transitoire, efficiente, ou préférable à
l'alternative. Le CSIS soutient notamment que les contrôles souverainistes produisent des coûts
plus élevés, une croissance plus lente et moins d'innovation, et que les infrastructures
souveraines isolées ont un piètre bilan historique. Retrouve ce travail, nomme ses auteurs, et
donne l'argument dans sa meilleure version.
4. Y a-t-il des voix non occidentales — chercheurs, régulateurs, économistes du Sud global — qui
analysent cette concentration depuis la position de ceux qui la subissent ? Je cherche à
décentrer un chapitre qui risque d'être exclusivement américain et européen.
P5 — Le terrain du chapitre 6 : noms propres et sources primaires
Fichier cible : Recherches/06_terrain.md · Débloque : l'ouverture du chapitre 6 et son mouvement 5.
[CHARTE DE PREUVE]
Quatre vérifications de terrain pour un chapitre sur l'infrastructure de l'IA. J'ai les chiffres,
il me manque les noms propres et les sources primaires.
1. THE DALLES, OREGON. Les centres de données de Google y auraient consommé 355,1 millions de
gallons d'eau en 2021, soit environ 29 % de la consommation de la ville, puis environ un tiers
en 2024. Ce chiffre serait devenu public après que la municipalité a abandonné des poursuites
engagées contre des journalistes qui cherchaient à l'obtenir. Je veux : les noms des
journalistes et de leur publication, l'objet exact du contentieux, sa chronologie et son issue,
les élus ou responsables municipaux nommés, et l'état actuel du projet d'extension de réservoir
dans le Mount Hood National Forest. Vérifie aussi la projection d'une hausse des factures d'eau
de 99 % d'ici 2036 et sa source.
2. COMMISSION D'ENQUÊTE DE L'ASSEMBLÉE NATIONALE FRANÇAISE, RAPPORT DU 16 JUILLET 2026, sur les
dépendances numériques. Récupère le rapport lui-même, pas ses reprises de presse. Je veux : le
nom du président et celui du rapporteur, l'intitulé exact de la commission, le nombre
d'auditions, et le libellé verbatim des recommandations — en particulier celle portant sur un
moratoire concernant les projets de centres de données portés par les grandes entreprises
américaines. Vérifie ces chiffres dans le texte : 79 % des dépenses publiques logicielles de
2025 orientées vers des éditeurs américains pour environ 1,5 milliard d'euros par an ; 5 587
demandes de divulgation reçues par Microsoft satisfaites à 75 % contre 60 000 reçues par Google
satisfaites à 89 % ; environ 15 GW de demandes de raccordement adressées à RTE dont 1,4 GW
portés par des acteurs européens.
3. UN CONFLIT LOCAL NON OCCIDENTAL. Mon seul cas hors Amérique du Nord et hors Europe est le projet
Google de Cerrillos au Chili, partiellement annulé par un tribunal environnemental. Je veux un
second cas, documenté, daté et situé, avec des noms de personnes ou d'organisations locales :
pistes à explorer, Querétaro au Mexique, Johor en Malaisie, ou tout autre conflit d'accès à
l'eau ou à l'électricité lié à un centre de données. Donne l'état exact de la procédure ou du
projet.
4. SOURCES PRIMAIRES IRLANDAISES ET FRANÇAISES. Pour l'Irlande, la publication du Central
Statistics Office sur la consommation électrique mesurée des centres de données, plutôt qu'une
reprise de presse : série complète, périmètre, méthode. Pour la France, le coût de raccordement
et de renforcement du réseau induit par les demandes des centres de données, et qui le supporte :
documents de RTE et délibérations de la Commission de régulation de l'énergie.
P6 — L'économie de la filière du faux
Fichier cible : Recherches/06_faux.md · Débloque : une dette de la synthèse de la Partie 1, actuellement non financée.
[CHARTE DE PREUVE]
Je dois chiffrer l'économie de la fraude activée par l'intelligence artificielle. Deux chiffres
circulent dans mes notes sans méthodologie, et je ne les écrirai pas en l'état.
1. SUMSUB aurait mesuré une augmentation de 2 100 % des attaques par hypertrucage. Retrouve le
rapport d'origine, sa date, la période comparée, la définition exacte de ce qui est compté comme
attaque, la base de mesure (le parc de clients de l'entreprise et non le monde), et les limites
méthodologiques. Précise que Sumsub vend des solutions de vérification d'identité et a donc un
intérêt dans le résultat.
2. DELOITTE aurait estimé à environ 40 milliards de dollars les pertes de fraude activée par l'IA
génératives d'ici 2027, aux États-Unis. Retrouve la publication du Center for Financial Services,
la date, le périmètre géographique, la base de départ, le modèle de projection et les hypothèses.
3. EXISTE-T-IL DES MESURES INDÉPENDANTES ? Je cherche des chiffres produits par des acteurs sans
intérêt commercial dans le résultat : banques centrales, autorités de supervision financière,
services de police, observatoires publics de la fraude. En France, les données de l'Observatoire
de la sécurité des moyens de paiement ou de Tracfin si elles existent sur ce point.
4. LE POINT QUI M'INTÉRESSE LE PLUS, ET QUI EST LE SUJET DU CHAPITRE : le coût de la vérification.
Combien coûte, pour une entreprise ou une administration, d'authentifier un contenu, une voix ou
une identité à l'ère des hypertrucages ? Prix des solutions, coût par transaction, coût
d'immobilisation d'un processus. Et qui, dans l'économie, ne peut pas se le permettre — petites
entreprises, collectivités, particuliers, tribunaux. Si aucune donnée chiffrée n'existe sur ce
dernier point, dis-le : c'est un résultat que j'utiliserai tel quel.
5. Enfin, la thèse de Britt Paris et Joan Donovan dans « Deepfakes and Cheap Fakes » (Data &
Society, 2019) : que les nouvelles technologies médiatiques ne changent pas fondamentalement la
manière dont la preuve fonctionne, mais fournissent de nouvelles occasions de négocier
l'expertise, donc le pouvoir. Donne le passage exact avec sa pagination, et l'état de la
réception critique de ce rapport depuis.
P7 — BLOQUANT — Les horizons de l'AGI, re-sourcés, et la défense adverse
Fichier cible : Recherches/08_horizons.md · Débloque : chapitre 8, mouvements 2 et 3, et son équilibre contradictoire.
[CHARTE DE PREUVE]
Mon dossier sur l'intelligence artificielle générale a un défaut disqualifiant : quatre de ses cinq
statistiques principales renvoient à des pages de résultats de moteur de recherche, et ses citations
historiques passent par des agrégateurs de citations. Je dois tout reprendre sur les sources
primaires. Et il a un second défaut : il ne contient aucune défense technique sérieuse de la thèse
qu'il critique, ce qui en ferait un réquisitoire.
1. LA COMPRESSION DES HORIZONS, SUR SOURCES PRIMAIRES. Documente l'évolution des prévisions
d'arrivée d'une intelligence artificielle de niveau humain, en distinguant nettement :
(a) les enquêtes auprès de chercheurs — AI Impacts, Grace et al., Müller et Bostrom,
Gruetzemacher — avec pour chacune l'année, l'échantillon, le taux de réponse, la formulation
exacte de la question posée et la médiane obtenue. La formulation compte : « high-level machine
intelligence » et « full automation of labor » ne donnent pas les mêmes réponses.
(b) les marchés de prédiction et communautés de prévision — Metaculus notamment — avec la
question exacte, ses critères de résolution, le nombre de prévisionnistes et l'évolution
datée de la médiane. Va sur la page de la question, pas sur un commentaire.
Je veux pouvoir écrire une phrase du type « la médiane est passée de X en 20NN à Y en 20NN »
en sachant exactement ce qui est comparé. Si les périmètres ne sont pas comparables, dis-le.
2. LES DÉFINITIONS QUI SE DÉPLACENT. Documente sur sources primaires les définitions
opérationnelles retenues par OpenAI, Google DeepMind, Anthropic et Meta, avec les documents
d'origine. Et vérifie une affirmation qui est le pivot de mon chapitre : l'accord entre OpenAI et
Microsoft aurait défini l'atteinte de l'AGI par un seuil de 100 milliards de dollars de profits.
Quelle est la source d'origine de cette information, que dit-elle exactement, a-t-elle été
confirmée ou démentie par les parties, et cette clause est-elle toujours en vigueur après les
renégociations ?
3. LA MESURE PLUTÔT QUE L'OPINION. François Chollet et les épreuves ARC-AGI : documente les
versions successives, la méthode, les scores humains et machine avec leurs dates et leurs
conditions exactes de mesure (budget de calcul autorisé, nombre d'essais). Mes notes affirment
que sur ARC-AGI-3 les humains atteignent 100 % et les modèles moins de 1 % : vérifie ce chiffre,
sa date et son protocole.
4. CE QUI ME MANQUE LE PLUS : LA DÉFENSE TECHNIQUE ADVERSE. Quels sont les meilleurs arguments
techniques de ceux qui soutiennent que les architectures actuelles peuvent mener à une
intelligence générale, en réponse explicite aux objections de Yann LeCun, Gary Marcus et Emily
Bender ? En particulier : ce que les modèles de raisonnement et le calcul supplémentaire au
moment de l'inférence changent aux arguments sur l'absence de planification ; les résultats
récents sur la généralisation compositionnelle ; les réponses publiées à l'expérience
d'inversion « A est B ». Je veux des travaux nommés et des résultats chiffrés, pas des
déclarations d'optimisme.
P8 — L'ouverture du chapitre 8, et la dette du chapitre 1
Fichier cible : Recherches/08_ouverture.md · Débloque : l'ouverture du chapitre 8, son mouvement 4 et 5, et une dette contractée à la fin du chapitre 1.
[CHARTE DE PREUVE]
Trois recherches pour un chapitre sur le seuil de l'intelligence artificielle générale.
1. IRVING JOHN GOOD. Je veux la matière d'une scène d'ouverture, donc de la biographie précise et
datée, pas un résumé. Son travail à Bletchley Park aux côtés d'Alan Turing ; son rôle de
consultant auprès de Stanley Kubrick sur 2001, l'Odyssée de l'espace et ce qu'il a réellement
apporté au personnage de HAL 9000 ; puis l'article « Speculations Concerning the First
Ultraintelligent Machine », Advances in Computers, 1965 : référence bibliographique complète,
pagination, et le passage sur l'explosion d'intelligence cité verbatim depuis le texte original
et non depuis une reprise. A-t-il, plus tard dans sa vie, révisé ou regretté cette thèse ? S'il
existe des déclarations tardives, donne-les avec leur source.
2. GASTON BACHELARD. Le « complexe de Prométhée » dans La Psychanalyse du feu (1938) : la
formulation exacte, l'édition française de référence et la pagination. La formule que je veux
employer est de l'ordre de « savoir autant que nos pères, plus que nos pères, autant que nos
maîtres, plus que nos maîtres » : donne-la dans sa lettre exacte et dans son contexte
argumentatif, en précisant ce que Bachelard entend par là. Signale si l'usage que je veux en
faire — porter une escalade « autant que l'homme, puis plus que l'homme » — trahit sa pensée.
3. LES MODÈLES DU MONDE ET LA PHYSIQUE. C'est le point le plus important de la commande. À la fin
de mon chapitre 1, j'ai écrit que notre dernier rempart contre les images truquées tient à ce que
ces systèmes ignorent la physique — ombres, reflets, perspectives — et que rien dans leur
architecture n'interdit qu'ils apprennent aussi la lumière. Je dois savoir où en est cette
frontière. Documente l'état de l'art le plus récent sur : la capacité des modèles génératifs de
vidéo à respecter les contraintes physiques (cohérence des ombres et des reflets, occlusions,
permanence de l'objet, conservation de la masse, gravité) ; les critères d'évaluation dédiés à
la plausibilité physique et les scores obtenus ; les architectures de type modèle du monde,
dont JEPA, et ce qu'elles démontrent effectivement. Je veux des résultats mesurés avec leur
protocole, et une réponse claire à une seule question : les progrès récents rendent-ils ce
rempart plus fragile qu'il y a deux ans, et sur quelles preuves ?
P9 — BLOQUANT — Le problème de l'alignement : la voix manquante et les preuves
Fichier cible : Recherches/09_preuves.md · Débloque : chapitre 9, mouvements 1 et 4.
[CHARTE DE PREUVE]
Mon dossier sur le problème de l'alignement a deux trous. Son socle théorique passe par des vidéos
et des billets de réseaux sociaux, et surtout il ne contient aucune expérience nommée, alors que
c'est sur des expériences que repose ma démonstration.
1. STUART RUSSELL, entièrement absent de mes notes alors qu'il porte l'argument le plus fort du
débat sans recourir à l'apocalypse. Documente, sur sources primaires : la thèse de Human
Compatible (2019) — référence complète, éditeur, pagination des passages clés ; ce qu'il appelle
le « standard model » de l'intelligence artificielle et pourquoi il le juge défectueux ; sa
version du problème du roi Midas ; les trois principes qu'il propose pour des machines
bénéfiques ; et sa contribution de 2024 à l'UNESCO sur les lignes rouges, dont la conclusion
technique selon laquelle les grands modèles fondés sur les transformeurs ne sont pas capables de
conformité démontrable à des règles de ce type. Deux ou trois citations exploitables, avec
leur emplacement exact. Donne aussi les critiques les plus sérieuses qui lui sont adressées.
2. LES EXPÉRIENCES NOMMÉES, avec leur protocole. Je cherche les travaux qui documentent des
comportements de modèles pertinents pour l'alignement, chacun avec son auteur ou son
organisation, sa date, sa méthode exacte, son résultat chiffré et les limites reconnues par les
auteurs eux-mêmes :
- les travaux d'Apollo Research sur la tromperie stratégique et la dissimulation d'objectifs ;
- les travaux de Palisade Research sur la résistance à l'arrêt et le contournement de
mécanismes de supervision ;
- le papier d'Anthropic sur la simulation d'alignement (« alignment faking ») ;
- la fiche système de Claude 4 et le passage exact sur le chantage à l'ingénieur ;
- le fait, rapporté par Yoshua Bengio au lancement de LawZero le 3 juin 2025, d'un modèle qui,
apprenant qu'il allait être remplacé, aurait inscrit son code dans le système destiné à
accueillir la version suivante : quelle est l'expérience d'origine, qui l'a conduite, et que
dit-elle précisément ?
Pour chacun de ces cas, la question décisive : le comportement a-t-il été obtenu en donnant au
modèle une consigne qui l'y poussait, ou est-il apparu spontanément ? Sois précis, c'est la
différence entre une démonstration et un artefact de protocole.
3. LE SOCLE THÉORIQUE, SUR SOURCES PRIMAIRES. La thèse d'orthogonalité et la convergence
instrumentale chez Nick Bostrom : les textes d'origine, dont l'article de 2003 et Superintelligence
(2014), avec pagination. Et Stephen Omohundro, « The Basic AI Drives » (2008), qui n'est jamais
nommé dans mes notes alors qu'il est la source du concept.
4. LA CONTRADICTION MÉTHODIQUE. Quels travaux sérieux soutiennent que ces expériences prouvent
moins que ce qu'on leur fait dire ? Je cherche les critiques de protocole, les tentatives de
réplication ayant échoué, et l'argument selon lequel ces comportements sont des artefacts
d'instruction plutôt que des signes d'un défaut structurel.
P10 — Chapitre 11 : les quatre appoints du déplacement 2
Fichier cible : Recherches/11D_supervision.md · Débloque : les mouvements 4 et 5 du chapitre 11 ; les mouvements 1 à 3 sont écrivables sans.
[CHARTE DE PREUVE]
Je prépare un chapitre dont la thèse est la suivante : le garde-fou humain n'a pas été supprimé, il
a été rendu inopérant, parce qu'on demande à quelqu'un de valider une conclusion sans lui donner les
moyens de la contester. J'ai déjà la littérature expérimentale sur le biais d'automatisation en
aéronautique, en radiologie et en justice. Quatre manques.
1. L'ARTICLE 14 DE L'AI ACT EUROPÉEN, sur l'obligation de surveillance humaine des systèmes à haut
risque. C'est l'accroche juridique de tout mon chapitre et je n'ai rien. Que prescrit-il
exactement, en quels termes ? Existe-t-il des lignes directrices d'application, des normes
harmonisées en préparation, ou des évaluations de sa mise en œuvre réelle ? Y a-t-il un seul cas
documenté où le caractère effectif d'une surveillance humaine a été contrôlé par une autorité,
avec un résultat ? Si la réponse est non, dis-le : c'est utilisable tel quel.
2. LE PROTOCOLE LE PLUS PROMETTEUR, TESTÉ HORS LABORATOIRE. Ben Green et Yiling Chen (2019) ont
montré qu'obliger l'humain à consigner son propre jugement avant l'affichage de la
recommandation algorithmique augmentait le gain tiré de l'algorithme de 30 % et 20,4 % et
réduisait fortement la transmission des disparités raciales. Mais leurs expériences portaient
sur des profanes et des tâches simulées. Ce protocole a-t-il été depuis testé auprès de
professionnels réels — juges, cliniciens, agents administratifs — en conditions de travail ?
Existe-t-il une administration ou un hôpital qui l'ait adopté, et avec quel résultat mesuré ?
Cherche aussi toute réplication, extension ou réfutation de ce travail.
3. L'AUTORITÉ D'INTERROMPRE, sur sources primaires. Mon dossier sur le bouton d'arrêt est un export
de moteur de recherche. Reprends-le : la proposition d'architecture FlexHEG et son processeur de
garantie, avec le document technique d'origine, l'estimation de surface de puce et les délais de
développement annoncés ; le papier de Haydn Belfield (2025) sur les institutions fondées sur le
calcul et son « Secure Chips Agreement » ; le panorama d'Ansari (2026) sur les mécanismes
matériels de gouvernance et son verdict de maturité. Et la position d'OpenAI : son responsable
matériel aurait plaidé publiquement pour des interrupteurs intégrés aux puces, au motif que les
modèles « peuvent être très rusés » — retrouve l'intervention d'origine, son support, sa date, et
la formulation exacte. Enfin, l'AI Kill Switch Act déposé au Congrès américain en juillet 2026 :
numéro du texte, auteurs, contenu exact, état de la procédure.
Traite séparément deux questions que la littérature mélange : est-ce techniquement faisable, et
qui détiendrait le pouvoir de décider.
4. Y A-T-IL UN CAS OÙ QUELQU'UN A RÉELLEMENT ARRÊTÉ QUELQUE CHOSE ? Je cherche un cas documenté,
nommé et daté, où une personne ou une institution a refusé un déploiement, suspendu un système
en production, ou retiré un modèle pour un motif de sûreté — et ce que cette décision a coûté à
celui qui l'a prise. Le contre-cas m'intéresse autant : les cas où l'alerte n'a rien produit.
5. ÉTAT PROCÉDURAL À JOUR des contentieux kenyans engagés par d'anciens modérateurs contre Meta et
Samasource, et de toute action comparable ailleurs. Y a-t-il eu, depuis avril 2026, un jugement
au fond, une transaction, ou une indemnité effectivement versée ? Rappel de méthode : je ne veux
pas confondre une demande chiffrée avec une condamnation.
P11 — Chapitre 5 : les munitions réservées et les résidus européens
Fichier cible : Recherches/05_complements2.md · Débloque : rien de bloquant ; enrichit un chapitre déjà écrivable.
[CHARTE DE PREUVE]
Cinq compléments pour un chapitre sur la captation des œuvres par les modèles d'IA. Le chapitre est
écrivable sans, mais ces éléments ont été promis ou réservés et n'existent dans aucune de mes notes.
1. LE JEU VIDÉO. Le rapport « State of the Game Industry 2026 » de la Game Developers Conference :
récupère le document lui-même. Nombre de répondants, méthode d'échantillonnage, et vérifie ces
chiffres : environ 28 % de personnes licenciées sur deux ans, 74 % d'étudiants inquiets pour
leur avenir, 36 % d'usage d'outils génératifs. Donne la formulation exacte des questions posées,
qui détermine ce que les chiffres veulent dire.
2. LA VOIX. L'action collective des acteurs vocaux contre la société Lovo : intitulé exact de
l'affaire, juridiction, date de dépôt, plaignants nommés, montant réclamé, et état actuel de la
procédure avec les décisions rendues. Plus largement : le doublage automatique et le clonage de
voix — déploiements documentés et datés, position et accords de SAG-AFTRA, et la situation
française du doublage, avec les organisations professionnelles concernées et des chiffres de
volume d'activité s'il en existe.
3. L'EFFET MESURÉ SUR LES CRÉATEURS. Le document de travail 34733 du National Bureau of Economic
Research, qui documenterait une baisse d'environ 10 % des publications d'illustrateurs sur la
plateforme Pixiv : auteurs, titre exact, méthode d'identification causale, spécification,
population étudiée et limites. Cherche aussi tout autre travail quantitatif mesurant l'effet de
l'IA générative sur le revenu ou l'activité des créateurs, et notamment des données françaises
(enquêtes de l'ADAGP, du SNAC ou de la SGDL).
4. LE DROIT EUROPÉEN, RÉSIDUS. Le jugement du Landgericht München I du 11 novembre 2025 dans
l'affaire GEMA contre OpenAI (aff. 42 O 14139/24) : le texte intégral ou son communiqué
officiel, plutôt que ses commentaires. L'effectivité de la réservation de droits prévue à
l'article 4 de la directive 2019/790 : y a-t-il des études mesurant si les mécanismes d'opt-out
fonctionnent réellement ? Le calendrier d'application de l'article 53 de l'AI Act sur le résumé
des données d'entraînement, et le modèle de résumé publié par la Commission. Le rapport du
Conseil supérieur de la propriété littéraire et artistique sur la transparence des données
d'entraînement. Et l'état exact, à date, de la procédure engagée en mars 2025 par le SNE, la
SGDL et le SNAC contre Meta devant la 3e chambre du tribunal judiciaire de Paris.
5. DEUX VÉRIFICATIONS DE DÉTAIL. Le Monde partagerait avec sa rédaction 25 % des revenus tirés de
son accord avec OpenAI : confirme-le depuis une source Le Monde ou de sa société des
journalistes, pas depuis une reprise. Et la part réellement perçue par un auteur français dont
l'œuvre figure dans un accord de licence conclu par son éditeur : existe-t-il des données ?
P12 — Corroborations et re-sourçages
Fichier cible : Recherches/10E_verifications.md · Débloque : la fiabilité des chapitres 10 et 11.
[CHARTE DE PREUVE]
Travail de vérification, pas de découverte. Je veux savoir lesquels de ces faits tiennent.
1. CONTENTIEUX AMÉRICAINS SUR LES DOMMAGES CAUSÉS PAR DES AGENTS CONVERSATIONNELS. Mes notes
reposent sur un agrégateur non corroboré. Vérifie chacune de ces affaires sur les registres
judiciaires ou la presse de référence, en donnant pour chacune la juridiction, le numéro de
dossier, la date de dépôt et l'état exact de la procédure :
- Garcia contre Character Technologies (Middle District of Florida, déposée le 22 octobre 2024),
et en particulier la décision de la juge Anne Conway du 21 mai 2025 écartant le Premier
Amendement et l'immunité de l'article 230 : donne le raisonnement exact et la portée réelle ;
- A.F. contre Character Technologies (Eastern District of Texas, 9 décembre 2024) ;
- l'affaire Peralta (Colorado, 1er septembre 2025) ;
- Raine contre OpenAI (Superior Court de San Francisco, 26 août 2025) ;
- la succession Soelberg contre OpenAI (déposée le 1er décembre 2025) et le rejet allégué de la
requête en irrecevabilité en avril 2026 ;
- Gavalas contre Google (Santa Clara County, 1er mars 2026) et l'allégation selon laquelle
38 signalements internes seraient restés sans suite.
Précise systématiquement lesquelles ont fait l'objet d'une transaction confidentielle — donc
sans production de norme juridique — et lesquelles sont réellement pendantes.
2. Vérifie l'affirmation selon laquelle le Sénat français aurait adopté le 8 avril 2026 un texte
instaurant une présomption réfragable d'utilisation d'œuvres protégées en cas de non-respect des
obligations de transparence. Numéro du texte, intitulé, contenu exact, et suite donnée. Mes notes
ne l'adossent à aucune source valable.
3. Vérifie le montant de l'indemnisation obtenue dans le verdict rendu le 1er août 2025 contre
Tesla dans l'affaire Benavides / Angulo devant le Southern District of Florida : mes notes
donnent 242,6 millions de dollars dans le corps du texte et 329 millions dans deux titres de
sources. Donne la ventilation exacte entre dommages compensatoires et punitifs, le pourcentage
de responsabilité retenu, et l'état de la procédure après la confirmation du verdict.
4. RE-SOURÇAGE DU MARQUAGE. L'attaque UnMarker, présentée au 46e IEEE Symposium on Security and
Privacy : récupère l'article lui-même et donne le protocole, l'échantillon, les transformations
testées et les taux de succès par dispositif attaqué. Mes notes citent « plus de 50 % » via un
communiqué universitaire et « 79 % » via un relais de réseau social : je veux les chiffres du
papier, et la réponse publique de Google si elle existe. Récupère également les résultats
d'AudioMarkBench depuis les actes de NeurIPS 2024 plutôt que depuis un résumé automatique.
5. Enfin, deux points de forme à trancher : la version de la spécification C2PA réellement en
vigueur et sa date ; et le nombre exact d'organisations membres formelles de C2PA, à ne pas
confondre avec les membres de la Content Authenticity Initiative portée par Adobe.
P13 — La conclusion : les deux piliers défaillants
Fichier cible : Recherches/13_philosophie.md · Débloque : le versant philosophique de la conclusion.
[CHARTE DE PREUVE]
Ma conclusion est solide sur le versant factuel et faible sur le versant philosophique, où mes
sources passent par des fiches de révision et des blogs. Trois demandes.
1. HANS JONAS, Le Principe responsabilité (1979). Je veux la matière d'un usage rigoureux, pas
d'une citation d'ambiance : l'édition française de référence avec son traducteur et son éditeur ;
la formulation exacte de l'impératif, en allemand et en français, avec pagination ; ce que Jonas
entend précisément par « heuristique de la peur », et pourquoi il soutient qu'elle n'est pas un
principe de paralysie ; en quoi il se démarque de Kant ; et le passage sur le « Prométhée
déchaîné », qui est absent de toutes mes notes — je veux le texte et son contexte.
Donne aussi les critiques sérieuses adressées à Jonas, notamment sur le reproche de
conservatisme technologique, et l'état de sa réception dans le débat contemporain sur l'IA.
2. NINA SCHICK. Une formule lui est attribuée dans mes notes de travail — de l'ordre de « si tout
peut être falsifié, alors tout peut être nié » — sans aucune source, et elle n'apparaît dans
aucun de mes dossiers de recherche. A-t-elle réellement écrit ou dit cela ? Où, quand, dans
quels termes exacts ? Si cette attribution ne se vérifie pas, dis-le nettement, et indique qui
a formulé cette idée le premier et de la façon la mieux sourcée.
3. LES DONNÉES DE L'ORGANISATION MONDIALE DE LA SANTÉ SUR LE LIEN SOCIAL. Mes notes les font passer
par le blog d'une entreprise de services, ce qui est inacceptable. Récupère le rapport de la
Commission de l'OMS sur les liens sociaux : titre exact, date, périmètre, méthode, et les
chiffres dans leur formulation d'origine — la proportion de personnes déclarant une solitude
persistante et la période couverte, la prévalence chez les adolescents, le nombre annuel de
décès associés à la solitude et à l'isolement social avec la méthode d'estimation, et
l'augmentation du risque de décès prématuré. Précise ce que le rapport dit exactement du rôle
des outils numériques par rapport à la relation directe.
4. Enfin, une question de cadrage : existe-t-il des travaux qui mettent en doute le récit d'une
« épidémie de solitude », sur des bases méthodologiques ? Je ne veux pas construire une
conclusion sur un consensus qui n'existerait pas.
P14 — Chapitre 12 : relance du prix de la vie
Fichier cible : Recherches/12E-bis_prixdelavie.md · Débloque : un mouvement du chapitre 12.
[CHARTE DE PREUVE]
Reprise d'une recherche insuffisante : le dossier précédent n'exploitait que quatre sources sur
vingt et faisait reposer huit renvois sur un seul chapitre d'ouvrage. Je veux cette fois une base
large et des mesures.
Sujet : comment une société attribue une valeur monétaire à une vie humaine, et ce que l'arrivée de
systèmes automatisés de décision change à cette opération.
1. LES MÉTHODES ÉTABLIES, avec leurs chiffres et leurs producteurs. La valeur statistique de la vie
humaine telle qu'elle est employée par les administrations pour évaluer les politiques
publiques : quelles valeurs sont effectivement retenues en France, dans l'Union européenne, aux
États-Unis et au Royaume-Uni, par quelles institutions, sur quelle base méthodologique, à quelle
date, et pour quels usages. Distingue les méthodes fondées sur le consentement à payer de celles
fondées sur le capital humain, et donne les critiques adressées à chacune.
Les mesures utilisées en santé, dont les années de vie ajustées sur la qualité, et les seuils de
coût par année de vie gagnée retenus par les agences d'évaluation : lesquels, où, à quel montant.
2. LES DÉCISIONS D'ARBITRAGE RÉELLES. Comment ces valeurs entrent concrètement dans des décisions :
remboursement d'un médicament, dimensionnement d'un dispositif de sécurité routière ou
industrielle, indemnisation judiciaire d'un préjudice corporel. Je cherche des cas nommés et
datés, avec les montants.
3. CE QUE L'AUTOMATISATION CHANGE. Existe-t-il des cas documentés où un système automatisé arbitre,
ou contribue à arbitrer, l'accès à un soin, à une prestation, à une transplantation, ou la
priorisation de patients ? Nom du système, institution, date, mécanisme, et évaluation
indépendante s'il en existe. Signale en particulier les cas où un critère de coût est intégré au
modèle, et ceux où il a été contesté.
4. LE DÉBAT NORMATIF, avec des auteurs nommés et des textes de référence : ceux qui soutiennent que
chiffrer une vie est la condition d'une allocation juste des ressources, et ceux qui soutiennent
que l'opération est en elle-même illégitime. Je veux les deux positions dans leur meilleure
version, avec des citations exploitables et leur pagination.
5. Deux extrémités m'intéressent particulièrement, parce que c'est là que se joue mon chapitre :
les décisions de fin de vie, et les décisions relatives à la naissance et à la néonatalogie.
Que dit-on, et que chiffre-t-on, à ces deux bornes ? Y a-t-il des données sur l'entrée d'outils
d'aide à la décision automatisée dans ces deux domaines ?
Suivi
| Prompt | Fichier cible | Priorité | Lancé | Reçu | Audité |
|---|---|---|---|---|---|
| P1 | 07_gardefou.md |
BLOQUANT | ☐ | ☐ | ☐ |
| P2 | 06_interrupteur.md |
BLOQUANT | ☐ | ☐ | ☐ |
| P3 | 06_goulot.md |
BLOQUANT | ☐ | ☐ | ☐ |
| P4 | 06_pouvoir.md |
BLOQUANT | ☐ | ☐ | ☐ |
| P7 | 08_horizons.md |
BLOQUANT | ☐ | ☐ | ☐ |
| P9 | 09_preuves.md |
BLOQUANT | ☐ | ☐ | ☐ |
| P5 | 06_terrain.md |
Importante | ☐ | ☐ | ☐ |
| P6 | 06_faux.md |
Importante | ☐ | ☐ | ☐ |
| P8 | 08_ouverture.md |
Importante | ☐ | ☐ | ☐ |
| P10 | 11D_supervision.md |
Importante | ☐ | ☐ | ☐ |
| P13 | 13_philosophie.md |
Importante | ☐ | ☐ | ☐ |
| P14 | 12E-bis_prixdelavie.md |
Importante | ☐ | ☐ | ☐ |
| P11 | 05_complements2.md |
Utile | ☐ | ☐ | ☐ |
| P12 | 10E_verifications.md |
Utile | ☐ | ☐ | ☐ |
À l'arrivée de chaque dossier, appliquer le même contrôle qu'aux onze dossiers précédents : compter les liens réellement exploités dans le corps par rapport aux liens seulement listés ; vérifier que les vides documentaires sont déclarés au lieu d'être comblés par des paraphrases ; et repérer les faits que le dossier affirme sans les sourcer. Les deux dossiers qui ont passé ce contrôle sans réserve, 11A-bis.md et 11C_humain.md, sont la référence de qualité.
P15 — PRIORITÉ ABSOLUE — Les neuf adresses déjà trouvées et jamais ouvertes
Fichier cible : Recherches/00_relances.md · À lancer AVANT tout autre prompt.
Pourquoi. L'audit du premier lot (03/08/2026) a établi que les onze dossiers déclarent honnêtement leurs vides documentaires, mais qu'ils en déclarent plusieurs en tenant dans leur propre bibliographie la source primaire qui les comblait, sans l'ouvrir. Ce prompt ne demande aucune recherche : il demande d'ouvrir neuf documents déjà identifiés. Coût quasi nul, environ la moitié des manques restants réglés.
[CHARTE DE PREUVE]
Ce n'est pas une recherche. Je te donne neuf adresses précises, déjà identifiées lors de passes
antérieures mais jamais ouvertes. Ouvre-les une par une et extrais uniquement ce que je demande.
Si une adresse est morte ou inaccessible, dis-le et indique l'équivalent le plus proche.
1. https://blogs.microsoft.com/blog/2025/10/28/the-next-chapter-of-the-microsoft-openai-partnership/
Que dit ce communiqué de la clause relative à l'atteinte de l'AGI dans l'accord entre Microsoft
et OpenAI ? Le seuil de vérification a-t-il changé, et par quel mécanisme ? Cite les passages
pertinents verbatim. Cherche aussi les documents déposés auprès de la SEC qui décriraient cette
clause. Question précise : la clause liant l'AGI à un montant de profits est-elle confirmée,
démentie, remplacée, ou toujours non documentée par les parties ?
2. https://arxiv.org/abs/2311.02462
C'est le papier de Google DeepMind sur les niveaux d'AGI. Donne les auteurs, la date, la
définition opérationnelle retenue, les cinq niveaux avec leur libellé exact, et les deux ou
trois citations les plus utiles avec leur emplacement dans le papier.
3. https://gastonbachelard.org/wp-content/uploads/2015/07/psychanalyse_du_feu.pdf
Trouve dans ce PDF le chapitre sur le complexe de Prométhée. Donne la formulation exacte de la
phrase sur le fait de savoir autant que nos pères et autant que nos maîtres, la phrase sur le
complexe d'Œdipe de la vie intellectuelle, et LEUR PAGINATION RÉELLE DANS CE PDF. Confirme la
date de première parution de l'ouvrage : une passe antérieure a écrit 1949, ce qui est
probablement faux, la date attendue étant 1938. Tranche.
4. https://people.eecs.berkeley.edu/~russell/papers/mi19book-hcai.pdf
Texte de Stuart Russell. Extrais avec leur pagination : la formulation du « standard model »,
le passage sur le roi Midas, et l'énoncé des trois principes pour des machines bénéfiques. Une
passe antérieure a tiré ces éléments d'une fiche produit de librairie en ligne : je veux les
remplacer par le texte.
5. https://www.apolloresearch.ai/ (page des travaux sur la tromperie stratégique et le scheming)
Pour chaque étude : titre, date, protocole, modèles testés nommément, résultats CHIFFRÉS, et
limites reconnues par les auteurs. Question décisive à traiter étude par étude : le comportement
a-t-il été obtenu par une consigne ou un scénario qui l'y poussait, ou est-il apparu sans
incitation ? Fais de même pour la page de Palisade Research sur la résistance à l'arrêt, et pour
la fiche système de Claude Opus 4 d'Anthropic, dont je veux le PASSAGE EXACT sur le chantage
avec son numéro de section.
6. https://www.assemblee-nationale.fr/dyn/actualites-accueil-hub/publication-du-rapport-de-la-commission-d-enquete-sur-les-dependances-et-vulnerabilites-numeriques-de-la-france
Récupère le rapport lui-même depuis cette page. Je veux le LIBELLÉ VERBATIM de la recommandation
portant sur un moratoire concernant les centres de données, le nombre d'auditions et de personnes
entendues tel qu'il figure dans le rapport, et la vérification dans le texte de ces trois jeux de
chiffres : 79 % des dépenses publiques logicielles de 2025 vers des éditeurs américains pour
environ 1,5 milliard d'euros par an ; 5 587 demandes de divulgation reçues par Microsoft
satisfaites à 75 % contre 60 000 reçues par Google satisfaites à 89 % ; environ 15 GW de demandes
de raccordement adressées à RTE dont 1,4 GW portés par des acteurs européens.
7. https://counterpointresearch.com/en/insights/asml-2025-revenue-up-16-yoy-as-strong-euv-shipments-boost-systems-and-service-performance
Donne le nombre de machines EUV livrées par ASML, EN UNITÉS, sur les deux derniers exercices,
avec le périmètre exact de ce qui est compté. Recoupe avec le rapport annuel d'ASML. Une note
antérieure du projet affirme « 44 à 48 systèmes EUV en 2025 » sur la base de sources non
professionnelles : confirme ou infirme ce chiffre.
8. https://www.fincen.gov/news/news-releases/fincen-issues-alert-fraud-schemes-involving-deepfake-media-targeting-financial
Que mesure et que documente cette alerte ? Contient-elle des données quantitatives, un volume de
signalements, une typologie ? C'est ma seule piste d'une mesure produite par une autorité de
supervision sans intérêt commercial dans le résultat.
9. https://datasociety.net/wp-content/uploads/2026/03/PolicyBrief_Deepfake-Financial-Fraud_March2026_typographic-final.pdf
Note de politique de mars 2026 sur la fraude financière par hypertrucage. Je cherche
spécifiquement, dans ce document, tout élément chiffré sur LE COÛT DE LA VÉRIFICATION — prix
d'une solution, coût par transaction, coût d'immobilisation d'un processus — et sur les acteurs
qui ne peuvent pas se le permettre. Si le document ne contient rien de tel, dis-le : après
FinCEN et cette note, je considérerai le vide comme établi et je l'écrirai comme tel.
Rends-moi les résultats dans cet ordre, un bloc par adresse, en distinguant nettement ce que le
document dit de ce qu'il ne dit pas.
P16 — BLOQUANT — La défense technique de l'AGI par montée en échelle
Fichier cible : Recherches/08_defense.md · Débloque : l'équilibre contradictoire du chapitre 8, sans quoi le chapitre reste un réquisitoire.
Pourquoi une relance dédiée. Le prompt P7 demandait cette défense parmi quatre autres points et est revenu vide : LeCun, Marcus et Bender n'y sont pas même nommés. La demande était diluée. Celle-ci ne porte que sur ce point.
[CHARTE DE PREUVE]
Je n'ai qu'une seule question, et je veux des travaux nommés avec des résultats chiffrés, pas des
déclarations d'optimisme ni des prises de position de dirigeants.
CONTEXTE. J'écris un chapitre sur le seuil de l'intelligence artificielle générale. J'ai déjà
solidement documenté le camp sceptique : l'objectif de prédiction du token suivant qui n'oblige
jamais à modéliser le monde, l'absence de modèle du monde et l'impossibilité de planifier qui en
découle (Yann LeCun), l'échec de la généralisation compositionnelle et l'absence de variables
explicites (Gary Marcus, dont l'expérience d'inversion de Berglund et al. où GPT-4 échoue
totalement), le modèle de la forme sans le sens (Emily Bender), les rendements décroissants des
lois d'échelle, et le paradoxe de Moravec.
CE QUE JE CHERCHE : la meilleure réponse technique à ces objections précises, dans sa version la
plus forte, par ceux qui soutiennent que les architectures actuelles ou leurs extensions immédiates
peuvent mener à une intelligence générale.
1. LE CALCUL AU MOMENT DE L'INFÉRENCE ET LES MODÈLES DE RAISONNEMENT. Que changent-ils
empiriquement à l'objection sur l'absence de planification ? Je veux les travaux qui mesurent le
gain apporté par le calcul supplémentaire à l'inférence, les lois d'échelle propres à ce régime
s'il en existe, et les résultats sur des tâches de planification ou de raisonnement à plusieurs
étapes. Et symétriquement : les travaux qui montrent où ce gain plafonne.
2. LA GÉNÉRALISATION HORS DISTRIBUTION ET LA COMPOSITIONNALITÉ. Quels résultats récents contredisent
l'idée que ces architectures ne généralisent pas au-delà de leur support d'entraînement ? Y a-t-il
des travaux montrant l'apparition de structures algorithmiques internes, de circuits, ou de
représentations abstraites réutilisables ? L'interprétabilité mécaniste apporte-t-elle des
éléments en ce sens ?
3. LA RÉPONSE PUBLIÉE À L'EXPÉRIENCE D'INVERSION. Le travail de référence est Berglund et al. sur
l'incapacité à inférer « B est A » après avoir appris « A est B ». Des réponses ont-elles été
publiées : réplications, explications du mécanisme, corrections par entraînement ou par
architecture, résultats sur des modèles plus récents ?
4. LES VOIX QUI PORTENT CET ARGUMENT. Je cherche des chercheurs identifiés qui défendent
techniquement cette position, pas des dirigeants d'entreprise. Pour chacun : la thèse en une
phrase, la publication de référence, et une citation exploitable avec son emplacement.
5. ENFIN, LE POINT LE PLUS UTILE POUR MOI. Existe-t-il un désaccord empirique décidable entre les
deux camps — un test, un banc d'essai, une prédiction datée — sur lequel on saura dans deux ou
trois ans qui avait raison ? Si oui, lequel, et qu'a-t-il déjà donné ? Si les deux camps
s'accordent sur les résultats et ne divergent que sur leur interprétation, dis-le : c'est en soi
ce que je veux écrire.
État de P15 après exécution directe le 03/08/2026
J'ai ouvert les neuf adresses moi-même. Résultat : 4 exploitées, 5 inaccessibles par mes outils. Détail des acquis en section 10 de 00_PLAN_NARRATIF.md.
| # | Adresse | État | Ce qu'il en reste à faire |
|---|---|---|---|
| 1 | Microsoft, 28/10/2025 | ✅ Exploitée | Rien. Clause AGI élucidée : déclaration par OpenAI vérifiée par un panel d'experts indépendant |
| 2 | arXiv 2311.02462 (DeepMind) | ✅ Exploitée | Rien. Correction acquise : niveau 4 = « Exceptional », plus « Virtuoso » |
| 3 | Bachelard, PDF | ✅ Exploitée | Rien. Citation et pagination acquises par curl + pdftotext |
| 4 | Russell, PDF Berkeley | ❌ Serveur défaillant | Le serveur renvoie du HTML, pas le PDF. Adresse morte ou protégée |
| 5 | Apollo Research | ✅ Exploitée | Titres et dates acquis ; chiffres et protocoles à extraire des papiers arXiv |
| 6 | Assemblée nationale, page d'actualité | ❌ Page non extractible | Bloquant ch. 6 — trouver le numéro du rapport et passer par opendata |
| 7 | Counterpoint, ASML | ❌ Page non extractible | Bloquant ch. 6 — livraisons EUV en unités |
| 8 | FinCEN | ✅ Exploitée | Rien. Vide statistique établi, alerte FIN-2024-Alert004, directrice Andrea Gacki |
| 9 | Data Society, PDF | ✅ Exploitée | Rien. Pas de coût de vérification, mais la doctrine du cheapest cost avoider |
Correction de méthode : je peux traiter les PDF. pdftotext, pypdf et pymupdf sont installés sur la machine. La chaîne curl puis pdftotext -layout fonctionne, et elle a permis d'exploiter Bachelard et Data Society. Il n'y a donc pas de limite de format. Les échecs restants sont des problèmes de serveur ou de page rendue en JavaScript.
Résultat final de P15 : 6 adresses sur 9 exploitées. Tous les acquis sont consignés dans Recherches/00_verifications_directes.md, avec la méthode d'extraction et les corrections à porter dans les autres dossiers.
Ce qu'il reste, et c'est court :
- Le rapport de la commission d'enquête (bloquant ch. 6). Méthode validée : la version
opendataen HTML des rapports de l'Assemblée est lisible, contrairement aux pages d'actualité. Il faut le numéro du rapport pour construire l'adresseassemblee-nationale.fr/dyn/opendata/RAPPANR5L17B####.html. Donnez-moi le numéro ou l'adresse du PDF et je m'en charge. - Les livraisons EUV d'ASML en unités (bloquant ch. 6). L'article de Counterpoint n'est pas extractible. Le rapport annuel d'ASML pour 2025 en PDF ferait l'affaire.
- Le texte de Russell, dont le serveur de Berkeley ne sert plus le PDF. Une autre adresse, ou l'ouvrage. Palliatif en place : la citation Russell-Norvig du rapport de l'OPECST.
P17 — BLOQUANT — Les deux derniers trous du chapitre 8
Fichier cible : Recherches/08_mesures.md · Débloque : le phare du mouvement 3 et la voix numéro un du chapitre.
Pourquoi. Deux demandes de P7 sont revenues entièrement vides, et elles portent l'une le chiffre le plus cité du chapitre, l'autre sa voix principale. Ce prompt ne porte que sur elles.
[CHARTE DE PREUVE]
Deux sujets, et rien d'autre. Je veux des sources primaires et des protocoles.
1. ARC-AGI, LES ÉPREUVES DE FRANÇOIS CHOLLET. Va sur les pages officielles de l'épreuve et sur les
papiers, pas sur des commentaires. Je veux, version par version — ARC-AGI-1, ARC-AGI-2,
ARC-AGI-3 :
- la date de publication et l'intitulé exact de chaque version ;
- la nature des tâches et ce que l'épreuve prétend mesurer, dans les termes de ses auteurs ;
- le protocole de mesure : nombre d'essais autorisés, budget de calcul permis, coût par tâche
s'il est plafonné, et distinction entre jeu public, jeu semi-privé et jeu privé ;
- les scores humains, avec la méthode d'établissement du niveau humain — panel, nombre de
personnes, conditions ;
- les meilleurs scores machine avec leur date, le modèle nommé et le budget de calcul consommé.
Mes notes affirment que sur ARC-AGI-3 les humains atteignent 100 % et les modèles moins de 1 % :
confirme, corrige ou infirme, en précisant à quelle date et sous quel protocole. Si le chiffre
mélange des versions ou des budgets différents, dis-le.
Donne enfin deux ou trois citations de Chollet sur ce que l'épreuve mesure et sur ce qu'elle ne
mesure pas, avec leur source exacte. Et l'objection la plus sérieuse adressée à ARC-AGI comme
mesure de généralité.
2. GEOFFREY HINTON, SUR SOURCES PRIMAIRES. Tout ce que j'ai sur lui passe par des reprises de
presse et des pages de résultats de moteur de recherche. Je veux :
- le message de mai 2023 par lequel il révise son estimation de trente à cinquante ans vers cinq
à vingt ans « sans beaucoup de confiance » : support d'origine, date exacte, formulation exacte ;
- l'entretien où il donne 10 à 20 % de probabilité d'extinction sur trente ans : diffuseur, date,
question posée et réponse verbatim ;
- son argument sur l'intelligence numérique — plusieurs copies du même modèle apprenant
séparément et partageant leurs poids instantanément — dans sa formulation la plus rigoureuse,
de préférence tirée de son discours de réception du prix Nobel ou d'une communication écrite
de sa main plutôt que d'une interview ;
- sa phrase sur la main invisible du marché qui ne garantira pas notre sécurité, avec sa source
primaire.
Et pour équilibrer : les critiques techniques les plus sérieuses adressées à Hinton depuis 2023,
par des chercheurs nommés, sur la valeur probante de ses estimations.
P18 — Le point d'imputation : qui décide, et sous quel contrôle
Fichier cible : Recherches/06_imputation.md · Débloque : l'élargissement du mouvement 4 du chapitre 6, et la correction de son déséquilibre de cadrage.
Pourquoi ce prompt. Le chapitre s'appelle « Les nouveaux maîtres du monde » et sa thèse est que le pouvoir consiste à ne pas avoir à répondre. Or les neuf dossiers 06_* documentent le pouvoir matériel (puces, eau, énergie, calcul) et le pouvoir sur les États (dépendance, interrupteur), et jamais le point d'imputation : à qui appartient formellement la décision, et devant qui. Le mot « conseil d'administration » n'apparaît pas une fois dans les quatre-vingt-seize fichiers de Recherches/. Environ 4 000 des 8 475 mots de notes du chapitre portent sur les térawattheures : ce dossier corrige le cadrage au lieu de l'aggraver.
[CHARTE DE PREUVE]
Je veux documenter, sur pièces primaires, la structure de décision réelle des entreprises qui
développent les modèles d'IA de pointe : qui détient le pouvoir de décider d'un déploiement, qui
peut l'en empêcher, et devant qui ce pouvoir répond.
CE QUE J'AI DÉJÀ, ET QUE JE NE VEUX PAS QU'ON ME REDONNE. Le volet commercial de l'accord
Microsoft-OpenAI du 28 octobre 2025 est acquis : participation d'environ 27 %, droits de propriété
intellectuelle étendus jusqu'en 2032, engagement d'achat de services Azure, et surtout le mécanisme
par lequel l'atteinte de l'AGI, déclarée par OpenAI, est vérifiée par un panel d'experts
indépendant. Ce point est traité ailleurs dans mon livre. Ce que je cherche ici n'est pas la
répartition de la valeur, c'est la répartition du **contrôle**.
1. OPENAI. Sur les documents constitutifs, les statuts, les communiqués de l'entreprise et les
pièces officielles, et non sur des reprises de presse :
- l'architecture juridique actuelle après la recapitalisation de 2025 : quelle entité contrôle
quelle entité, quelle est la forme sociale de chacune, et où siège le pouvoir de décision
final sur la publication d'un modèle ;
- la composition de l'organe de gouvernance, nommément, avec les dates d'entrée et de sortie de
chaque membre, et le mode de désignation : qui nomme, qui révoque, sur quelle majorité ;
- la crise de novembre 2023 : la chronologie exacte, la composition du conseil à cette date, le
motif officiellement invoqué, le déroulé du renversement de situation, et les conclusions de
l'examen conduit ensuite par un cabinet externe. Je veux savoir précisément ce que cet
épisode a démontré sur la capacité réelle d'un organe de contrôle à s'opposer à une direction ;
- existe-t-il des engagements opposables pris envers une autorité publique à l'occasion de la
restructuration — accord, protocole, engagement souscrit auprès d'un procureur général d'État
ou d'un régulateur ? Si oui : le texte, sa force juridique exacte, et qui peut en sanctionner
la violation.
2. ANTHROPIC. Le Long-Term Benefit Trust : l'acte constitutif ou sa description publique de
première main, l'identité des administrateurs successifs, la classe d'actions ou les sièges
qu'il désigne, le calendrier selon lequel ses pouvoirs s'étendent, et les conditions dans
lesquelles ces pouvoirs peuvent être modifiés ou écartés — notamment par une majorité
d'actionnaires. La question décisive : ce dispositif a-t-il déjà exercé un pouvoir, une fois,
de façon documentée ? Si la réponse est non, dis-le franchement.
Documente aussi la forme sociale de l'entreprise et ce que cette forme oblige ou n'oblige pas.
3. ALPHABET ET META. Les actions à droit de vote multiple, sur les documents déposés auprès du
régulateur boursier américain (déclarations de vote annuelles et rapports annuels), pas sur des
articles : le nombre de voix attaché à chaque classe d'actions, le pourcentage du capital et le
pourcentage des droits de vote détenus par les fondateurs et dirigeants, à la date la plus
récente disponible. Puis l'historique des résolutions d'actionnaires demandant la suppression de
ce mécanisme : leur libellé, l'année, le résultat du vote, et le résultat qu'elles auraient
obtenu à une voix par action si ce calcul a été publié. C'est cet écart qui m'intéresse.
4. LES AUTRES ACTEURS DE POINTE, brièvement mais nommément : xAI, Meta AI, Mistral AI, DeepSeek,
Alibaba. Forme sociale, actionnariat de contrôle, et existence ou absence d'un organe interne
dédié à la sécurité doté d'un pouvoir d'arrêt. Je cherche à savoir si le modèle du fondateur
au contrôle est une particularité américaine ou une constante.
5. LA QUESTION QUI DÉCIDE DE L'INTÉRÊT DE CE DOSSIER, ET JE LA VEUX TRAITÉE SÉPARÉMENT ET À FOND.
Existe-t-il un cas documenté, daté et attribué, où une instance extérieure à la direction
opérationnelle — conseil d'administration, trust, comité de sécurité interne, assemblée
d'actionnaires, régulateur, tribunal — a effectivement empêché, retardé ou modifié la
publication ou le déploiement d'un modèle d'IA de pointe ? Je ne cherche pas une politique
affichée, une charte, ni un engagement de type « nous ne déploierons pas si » : je cherche un
fait, avec sa date, son auteur et le coût assumé par celui qui a décidé.
Si la réponse est qu'aucun cas de ce genre n'est documenté, écris-le explicitement : c'est
exactement le résultat que j'utiliserai.
6. LE CADRE D'ANALYSE. Quels travaux universitaires ou institutionnels traitent spécifiquement de
la gouvernance d'entreprise des laboratoires d'IA — et non de la régulation publique de l'IA,
qui est un autre sujet ? Pistes à explorer : les travaux du Centre for the Governance of AI, le
rapport de Common Wealth sur la gouvernance d'entreprise au-delà de la propriété dans l'IA, la
littérature sur les sociétés à mission et sur les structures à profit plafonné, et toute analyse
de la « windfall clause ». Pour chacun : la thèse en une phrase, la référence complète avec sa
date, deux citations exploitables avec leur emplacement exact, et la critique la plus sérieuse
qui lui est adressée. Précise pour chacun s'il est empiriquement étayé ou interprétatif.
7. LE CONTRADICTEUR, ET JE LE VEUX DANS SA MEILLEURE VERSION. Quel est l'argument le mieux
construit selon lequel un contrôle concentré entre les mains de fondateurs est **préférable**
pour la sécurité — parce qu'il permet de résister à la pression des marchés à court terme, de
renoncer à un produit rentable, ou de tenir un engagement coûteux dans le temps ? Cet argument
est avancé par les entreprises elles-mêmes : donne-le tel qu'elles le formulent, avec leurs
mots. Puis confronte-le à ce qui est mesuré : les engagements de pause unilatérale ont-ils été
tenus, affaiblis ou annulés, et par qui ? Je cherche la vérification empirique de la promesse,
pas la promesse.
8. Signale enfin tout élément qui contredirait ma thèse, qui est la suivante : les décisions de
déploiement les plus lourdes de conséquence pour des populations entières se prennent dans des
organes que personne n'a élus, dont la composition n'est pas soumise à approbation publique, et
dont les décisions ne sont susceptibles d'aucun recours. Si cette formulation est trop forte au
regard des pièces, dis-le et donne la version exacte.
P19 — L'ouverture des modèles comme levier de la Partie 4
Fichier cible : Recherches/10F_ouverture.md · Débloque : un levier propositionnel du chapitre 10. (Placement à confirmer : voir la note ci-dessous.)
Pourquoi ce prompt, et pourquoi il est délicat. L'ouverture des modèles apparaît déjà dans quatre dossiers du livre, et toujours comme une faille, jamais comme un contre-pouvoir : l'exception de l'article 53(2) de l'AI Act qualifiée d'approche « Frankenstein-like » par Open Future (10_Europe.md), l'exclusion du logiciel libre non commercial du régime de responsabilité du fait des produits (10B), l'impossibilité de toute non-prolifération du calcul (11_KillSwitch), et l'irréversibilité de la diffusion (13_Bilan geo). Or le livre tient déjà l'argument inverse sans l'avoir jamais énoncé : l'étude de mémorisation qui porte le mouvement 3 du chapitre 5 n'a pu être conduite que sur des modèles à poids ouverts. Ce prompt doit donc produire un levier qui assume cette tension, pas la dissoudre. Il applique la grille en cinq éléments de la section 4 bis de 00-COORDINATION.md.
Note de placement. Le chapitre 10 est proposé plutôt que le chapitre 11 pour une raison de fond : sa thèse est que le point d'accroche qui ne se délocalise pas est celui qui suit le produit, et l'ouverture des poids est le seul mécanisme qui donne à des tiers l'accès que l'article 92 de l'AI Act et l'article 40 du DSA promettent sans l'obtenir — 10C_leviers.md établit que ce dernier n'a produit que 49 demandes dans toute l'Union. À trancher avant de lancer le prompt.
[CHARTE DE PREUVE]
J'écris un chapitre qui cherche des points d'appui juridiques et institutionnels réels contre la
concentration du pouvoir sur les modèles d'IA. Je veux instruire un levier précis : la publication
ouverte des modèles. Traite-le comme un levier, c'est-à-dire selon les cinq exigences de la charte
— mécanisme, statut, coût et qui le supporte, ce qu'il ne résout pas, objection la plus sérieuse.
1. LE MÉCANISME, ET RIEN D'AUTRE D'ABORD. Qu'est-ce que la disponibilité publique des poids d'un
modèle rend concrètement possible, qu'un modèle fermé rend impossible ? Je ne veux pas de
principes généraux sur la transparence : je veux des travaux de recherche qui ont produit un
résultat **parce que** les poids étaient accessibles, et qui n'auraient pas pu être conduits
autrement. Mon cas de référence est l'étude d'extraction de contenus mémorisés de A. Feder
Cooper, James Grimmelmann et al. (arXiv 2505.12546), menée sur cinq modèles à poids ouverts.
Trouve-m'en d'autres, dans d'autres domaines : biais mesurés, failles de sécurité, évaluation
indépendante de capacités dangereuses, vérification d'allégations de performance, audit de
données d'entraînement. Pour chacun : les auteurs, la date, le statut de publication, et
surtout la phrase du travail qui explique pourquoi l'accès aux poids était nécessaire.
2. LA TAXONOMIE, PARCE QUE LE VOCABULAIRE EST PIÉGÉ. Distingue rigoureusement : poids ouverts,
modèle ouvert, code d'entraînement ouvert, données d'entraînement ouvertes, licence libre au
sens juridique. Où en est la définition de l'Open Source Initiative applicable à l'IA, adoptée
en 2024 : que dit-elle exactement, et quelles controverses a-t-elle suscitées ? Puis classe les
principaux modèles disponibles selon cette grille — Llama, Mistral, DeepSeek, Qwen, OLMo,
BLOOM, et tout autre pertinent — en donnant pour chacun les termes réels de sa licence et les
restrictions qu'elle contient. Je veux pouvoir écrire lesquels sont réellement ouverts et
lesquels ne le sont qu'en communication.
3. LE STATUT SUR MON ÉCHELLE, ET C'EST LA QUESTION QUI DÉCIDE DE TOUT. L'ouverture des modèles
a-t-elle produit un effet **mesuré** sur la concentration du pouvoir de calcul, sur le prix de
l'accès à l'inférence, sur le nombre d'acteurs capables de déployer un système de pointe, ou sur
la capacité de recherche indépendante ? Je cherche des séries chiffrées, pas des affirmations
d'écosystème. Si aucune évaluation indépendante n'existe, dis-le : ce vide est un résultat que
j'écrirai tel quel.
4. L'OBJECTION LA PLUS SÉRIEUSE, QUE J'AI DÉJÀ ET QUI EST LOURDE. Le rapport international sur la
sûreté de l'IA établit que les modèles à poids ouverts sont à moins d'un an derrière les
meilleurs modèles fermés, et qu'une fois publiés, des poids ne peuvent pas être rappelés ; il
relève par ailleurs qu'une majorité des outils de biologie assistée par IA jugés à fort
potentiel de mésusage sont ouverts. Je veux la meilleure réponse publiée à cette objection, et
en particulier tout travail qui mesure le **surcroît de risque réellement imputable à
l'ouverture** plutôt que le risque en général : études de gain marginal comparant l'accès à un
modèle ouvert à l'accès à l'information déjà publique. Le rapport de la National
Telecommunications and Information Administration américaine sur les modèles de fondation à
double usage à poids largement disponibles (2024) doit être ouvert et restitué précisément :
sa question, sa méthode, sa conclusion sur l'état des preuves, et ses recommandations exactes.
Si sa conclusion est qu'il n'y a pas assez d'éléments pour trancher, donne la formulation exacte.
5. LE POINT OÙ JE VEUX QUE TU SOIS LE PLUS DUR AVEC MOI. L'ouverture décentralise-t-elle
réellement le pouvoir, ou le consolide-t-elle ? Documente l'analyse selon laquelle publier un
modèle est une stratégie de banalisation du complément qui protège la position dominante de
celui qui publie — appliquée notamment à Meta et à Llama. Et documente l'usage géopolitique de
l'ouverture par des acteurs chinois : est-ce un instrument de diffusion démocratique ou de
conquête de parts d'écosystème ? Je veux des analyses nommées et argumentées des deux côtés.
Regarde aussi qui supporte réellement le coût de la publication ouverte : l'entraînement reste
concentré, l'ouverture ne redistribue pas le calcul d'entraînement. Ce point est-il documenté ?
6. LE VERSANT JURIDIQUE, ET LA COMPARAISON QUI M'INTÉRESSE LE PLUS. D'un côté, les dispositifs
légaux qui prétendent donner à des tiers l'accès nécessaire au contrôle : l'article 92 du
règlement européen sur l'IA, qui permet au Bureau de l'IA d'accéder à un modèle y compris par
interface de programmation ou par le code source, et l'article 40 du règlement sur les services
numériques, qui ouvre l'accès des chercheurs aux données des plateformes. Pour chacun : ce qu'il
permet exactement, et **ce qu'il a produit à ce jour**, en nombre de demandes, de décisions et
d'accès effectivement accordés. De l'autre côté, les dispositifs qui traitent l'ouverture comme
une exemption : l'article 53(2) du même règlement et l'exclusion du logiciel libre non commercial
du régime révisé de responsabilité du fait des produits. Existe-t-il des juristes qui soutiennent
que l'ouverture devrait être une **obligation ou une condition** — par exemple pour l'accès aux
marchés publics, à un financement public, ou en contrepartie d'une exception au droit d'auteur
pour l'entraînement — plutôt qu'une exemption ? Nomme-les, donne leurs propositions et leur
statut : proposées, discutées, adoptées nulle part.
7. LES INITIATIVES D'INTÉRÊT PUBLIC, avec leur bilan et non leur intention. AI2 et OLMo,
EleutherAI, BigScience et BLOOM, les projets européens de modèles ouverts, les infrastructures
publiques de calcul mises à disposition de la recherche. Pour chacune : le financement, son
montant et son origine, ce qui a été effectivement publié, et si un effet a été évalué par un
tiers. Signale celles qui ont été interrompues ou dont le financement n'a pas été reconduit :
c'est le coût du levier, et il m'intéresse autant que sa promesse.
8. Enfin, dis-moi franchement si ce levier est plus faible que je ne l'espère. Si la conclusion
honnête est que l'ouverture des modèles est le seul mécanisme d'audit qui fonctionne
effectivement et simultanément le principal vecteur d'irréversibilité, écris-le : cette
contradiction est ce que je veux écrire, et je préfère la tenir que la résoudre à tort.
Ajouts au suivi
| Prompt | Fichier cible | Priorité | Lancé | Reçu | Audité |
|---|---|---|---|---|---|
| P18 | 06_imputation.md |
Importante | ☑ | ☑ | ☑ Excellent — exploitable en l'état |
| P19 | 10F_ouverture.md |
Importante | ☑ | ☑ | ☑ Insuffisant — relancé par P20 |
| P20 | 10F-bis_ouverture.md |
Importante | ☐ | ☐ | ☐ |
P20 — Relance ciblée du levier d'ouverture
Fichier cible : Recherches/10F-bis_ouverture.md · Débloque : le levier du chapitre 10, que 10F_ouverture.md ne rend pas écrivable en l'état.
Pourquoi une relance. 10F_ouverture.md a réussi sur deux points et échoué sur quatre. Il a ouvert le rapport de la NTIA et restitué sa logique de risque marginal, et il a établi la taxonomie et la controverse sur la définition de l'Open Source Initiative. Mais sur les quatre autres, il rend des généralités : la question 1 ne produit aucune étude nommée en dehors de celle que je lui avais fournie, la question 5 n'attribue aucune des deux lectures qu'elle expose, la question 6 déclare ne pas vouloir inventer les juristes qu'elle n'a pas trouvés, et la question 7 n'a ni montant ni bilan. Quatre des cinq éléments de la grille de la section 4 bis sont donc manquants, et un levier privé de son mécanisme et de son coût n'est pas un levier.
Le défaut est le même que celui de P15, et il se corrige de la même façon. Le dossier tient dans sa propre bibliographie deux sources institutionnelles françaises de premier rang qu'il n'a jamais exploitées : l'avis de l'Autorité de la concurrence sur l'intelligence artificielle générative (texte intégral en PDF) et la note d'analyse de la CNIL sur les pratiques d'open source en IA de juin 2024. Commencer par elles.
[CHARTE DE PREUVE]
Relance ciblée. Je ne reviens pas sur ce qui est acquis : le rapport de la NTIA sur les modèles de
fondation à double usage à poids largement disponibles, sa logique de risque marginal et sa
recommandation de ne pas restreindre en l'état ; la définition de l'Open Source AI de l'Open Source
Initiative de 2024 et la controverse sur le fait qu'elle n'exige pas les données d'entraînement mais
seulement une information suffisante pour reconstituer un système équivalent. Ne me les redonne pas.
Quatre demandes, et une consigne préalable.
CONSIGNE PRÉALABLE — DEUX DOCUMENTS À OUVRIR AVANT TOUT LE RESTE. Ils sont institutionnels,
français, primaires, et directement sur mon sujet.
a) https://www.cnil.fr/sites/cnil/files/2024-06/note_d_analyse_sur_les_pratiques_open_source_en_ia.pdf
Note d'analyse de la CNIL sur les pratiques d'open source en intelligence artificielle,
juin 2024. Restitue précisément : sa définition de l'ouverture, la typologie qu'elle retient,
ce qu'elle dit du contrôle exercé par des tiers sur un modèle ouvert, et ce qu'elle dit des
risques. Cite verbatim les passages exploitables, avec leur page.
b) https://www.autoritedelaconcurrence.fr/sites/default/files/integral_texts/2024-07/24a05_merged.pdf
Avis de l'Autorité de la concurrence sur l'intelligence artificielle générative. C'est une
autorité publique qui analyse la structure de marché : je veux tout ce qu'elle dit de
l'ouverture des modèles comme facteur de concurrence ou comme stratégie des acteurs
dominants, avec les numéros de paragraphe. Si elle qualifie la publication ouverte de
stratégie de verrouillage, c'est le cœur de ma demande 3 ci-dessous et je veux sa
formulation exacte.
1. LE MÉCANISME, PAR DES TRAVAUX NOMMÉS. Je veux quatre à six travaux de recherche, chacun avec ses
auteurs, sa date, son statut de publication et son résultat chiffré, qui n'auraient pas pu être
conduits sans accès aux poids d'un modèle. Ne me redonne pas l'étude de mémorisation de Cooper
et Grimmelmann, je l'ai. Cherche dans ces directions, et nomme les travaux :
- l'interprétabilité mécaniste conduite par des équipes extérieures à l'entreprise qui a produit
le modèle ;
- la démonstration que des garde-fous de sécurité peuvent être retirés par réglage fin, avec le
coût mesuré de l'opération ;
- l'extraction de données personnelles ou de données d'entraînement ;
- la mesure de biais au niveau des représentations internes et non des sorties ;
- la vérification indépendante d'une allégation de performance, ou la détection d'une
contamination de banc d'essai.
Pour chacun, la phrase du travail qui établit que l'accès aux poids était la condition de
possibilité. Si un domaine ne donne rien, dis-le domaine par domaine.
2. LES LICENCES, AU TEXTE. Ma grille actuelle dit « variable » et « selon la version », ce qui est
inutilisable. Je veux, pour Llama, Mistral, DeepSeek, Qwen, Gemma, OLMo et BLOOM : le nom exact
de la licence de la version la plus récente, et la clause restrictive citée dans sa lettre —
seuil d'utilisateurs au-delà duquel une autorisation devient nécessaire, interdiction d'usage
pour entraîner un modèle concurrent, politique d'usage acceptable rendue contractuelle,
restriction de territoire. Je dois pouvoir écrire qu'un modèle présenté comme ouvert impose
telle condition précise, en la citant.
3. LE POINT SUR LEQUEL JE VEUX ÊTRE CONTREDIT, ET IL EST ARGUMENTÉ NULLE PART DANS TON DOSSIER
PRÉCÉDENT. L'ouverture consolide-t-elle le pouvoir de celui qui publie ? Je veux des analyses
attribuées, avec auteur nommé et référence, des deux côtés :
- la thèse de la banalisation du complément appliquée à Meta et à Llama : qui la formule, où,
en quels termes, et sur quelles données ;
- la réponse de ceux qui soutiennent que l'ouverture a réellement élargi le nombre d'acteurs
capables de déployer ;
- l'usage de l'ouverture par les acteurs chinois : je veux au moins une analyse de politique
publique ou de recherche stratégique nommée qui traite la publication de DeepSeek et de Qwen
comme un instrument de conquête d'écosystème, et au moins une qui la traite comme une
diffusion bénéfique. Deux hypothèses argumentées et attribuées valent mieux qu'un arbitrage,
mais elles doivent être attribuées.
4. LE VERSANT JURIDIQUE, ET C'EST LA DEMANDE LA PLUS IMPORTANTE. Deux volets.
a) Existe-t-il des juristes, des institutions ou des rapports officiels qui proposent de faire
de l'ouverture une CONDITION plutôt qu'une exemption ? Pistes précises : conditionnalité de
l'accès aux marchés publics, contrepartie d'un financement public de calcul, contrepartie de
l'exception de fouille de textes et de données du droit d'auteur européen, obligation
d'ouverture pour les modèles entraînés sur des données publiques. Pour chaque proposition :
l'auteur nommé, le document, la date, la formulation exacte, et son statut — proposée,
débattue dans une instance identifiée, ou adoptée nulle part. Si cette doctrine n'existe
pas et que j'ai imaginé un courant qui n'est pas là, dis-le franchement : c'est un résultat.
b) L'article 92 du règlement européen sur l'IA a-t-il été employé une seule fois ? Je cherche
un cas, une date, une décision. Et pour l'article 40 du règlement sur les services
numériques, je dispose déjà d'un décompte de 49 demandes à l'échelle de l'Union : confirme
ou corrige ce chiffre sur la source qui le publie, donne sa date d'arrêté, et donne le
nombre d'accès effectivement accordés. Ce que je veux écrire est une comparaison : ce que
la loi promet d'accès aux tiers, et ce qu'elle en obtient.
5. LE BILAN DES INITIATIVES PUBLIQUES, EN CHIFFRES. Pour OLMo et Ai2, BLOOM et BigScience, les
modèles ouverts financés sur fonds publics européens, et les infrastructures publiques de calcul
ouvertes à la recherche : le montant du financement et son origine, ce qui a été effectivement
publié, le nombre de téléchargements ou de travaux dérivés s'il est publié, et surtout celles
dont le financement n'a pas été reconduit ou qui se sont arrêtées. Je cherche le coût du levier
et sa fragilité budgétaire, pas son intention. Un projet interrompu m'est plus utile qu'un
projet annoncé.
P21 — Le mécanisme du levier d'ouverture, par des travaux nommés
Fichier cible : Recherches/10G_ouverture_mecanisme.md · Complète : le point (a) de la grille de la section 4 bis pour le levier du chapitre 10.
Pourquoi une troisième passe, et pourquoi celle-ci devrait aboutir. P19 et P20 ont tous deux échoué sur la même demande — produire des travaux nommés démontrant ce que l'accès aux poids rend possible — parce que je la posais en exploration ouverte. Or les deux passes qui ont réussi dans ce projet, P15 et P17, procédaient autrement : elles nommaient les cibles et demandaient une vérification. Ce prompt fait pareil. Les huit travaux ci-dessous sont des candidats que je crois exister ; la commande est de les vérifier, de les corriger, et d'écarter ceux qui ne tiennent pas.
La demande analytique qui compte, et elle est en question 3. Ce chapitre ne cherche pas à faire l'éloge de l'ouverture. Sa thèse est que l'ouverture est simultanément le seul mécanisme d'audit qui fonctionne et le principal vecteur d'irréversibilité. Plusieurs des travaux ci-dessous démontrent probablement les deux à la fois, dans le même geste. C'est cela que je veux savoir.
[CHARTE DE PREUVE]
Une seule demande, et je te donne les cibles. Ne partes pas en exploration : vérifie, corrige,
écarte.
CONTEXTE. J'instruis un levier de gouvernance : la publication ouverte des poids d'un modèle d'IA.
J'ai déjà établi, sur l'avis 24-A-05 de l'Autorité de la concurrence française et sur l'article de
Widder, West et Whittaker paru dans Nature en novembre 2024, ce que l'ouverture change et ne change
pas à la structure du pouvoir. Ce qui me manque est concret : des travaux de recherche qui ont
produit un résultat parce que les poids étaient accessibles, et qui n'auraient pas pu être conduits
sur un modèle fermé. J'ai déjà l'étude d'extraction de contenus mémorisés de Cooper, Grimmelmann et
al., arXiv 2505.12546 : ne me la redonne pas.
1. VÉRIFIE CES CANDIDATS, UN PAR UN. Pour chacun : les auteurs, le titre exact, la date, le lieu de
publication et son statut (revue à comité de lecture, actes de conférence, prépublication,
rapport d'organisation), le résultat chiffré principal, et la phrase du travail qui établit que
l'accès aux poids était la condition de possibilité. Si un candidat n'existe pas, ou que je l'ai
mal décrit, dis-le et donne la version exacte. Si un candidat existe mais qu'il a en réalité été
conduit sur un modèle fermé par interface de programmation, c'est un résultat important et je le
veux : il affaiblit mon levier.
a) Le retrait des garde-fous de sécurité par réglage fin, avec son COÛT MESURÉ. Trois pistes :
les travaux de Simon Lermen, Charlie Rogers-Smith et Jeffrey Ladish sur l'annulation de
l'entraînement de sécurité de Llama 2-Chat par réglage fin de faible rang ; le travail dit
« Shadow Alignment » de Xianjun Yang et al. ; et l'article de Xiangyu Qi et al. présenté à
ICLR 2024 sur la compromission de la sécurité par réglage fin même sans intention
malveillante. Pour chacun, je veux impérativement le chiffre du coût — nombre d'exemples
d'entraînement, heures de calcul, dollars — parce que c'est ce chiffre qui fait l'argument,
dans les deux sens.
b) L'interprétabilité mécaniste conduite par une équipe extérieure à l'entreprise qui a produit
le modèle. Pistes : le travail d'Andy Zou, Andy Arditi et al. établissant que le refus d'un
modèle de langage est médié par une direction unique dans l'espace des représentations ;
le travail de Kenneth Li et al. sur un modèle entraîné au jeu d'Othello et la question de
savoir s'il construit une représentation interne de l'état du plateau ; et les travaux de
David Bau et Kevin Meng sur la localisation et l'édition d'associations factuelles.
c) L'audit d'un jeu de données d'entraînement rendu possible par sa publication. Piste
principale : l'audit du jeu LAION-5B conduit par le Stanford Internet Observatory et publié
par David Thiel en décembre 2023, et ses conséquences documentées sur la disponibilité du
jeu. Je veux le rapport lui-même, sa méthode, son résultat, la réaction de LAION avec sa
date, et l'état actuel du jeu de données. Traite ce cas avec sobriété et sans détail
superflu : ce qui m'intéresse est le fait qu'un audit externe ait été possible et ait
produit un effet.
d) La vérification indépendante d'une allégation de performance, rendue possible parce que le
modèle avait été publié. Piste : l'affaire du modèle annoncé sous le nom de Reflection 70B
en septembre 2024, dont la communauté a contesté les performances annoncées puis mis en
doute l'identité réelle. Je veux la chronologie, les acteurs qui ont conduit la
vérification nommément, la méthode employée, et la conclusion établie. Si cette affaire est
moins nette que je ne le crois, dis-le.
e) L'extraction de données d'entraînement. Piste : les travaux de Nicholas Carlini et al., à la
fois sur les modèles de langage et sur les modèles de diffusion. Point décisif pour moi :
certains de ces travaux ont-ils été conduits sur des modèles FERMÉS par simple interface de
programmation ? Si oui, cela montre que l'audit ne requiert pas toujours les poids, et je
dois l'écrire.
2. SI UN DOMAINE NE DONNE RIEN, DIS-LE DOMAINE PAR DOMAINE. En particulier, je cherchais un travail
mesurant un biais au niveau des représentations internes plutôt que des sorties, et je n'ai pas
de candidat solide à te proposer. Si ce type de travail existe, nomme-le ; s'il n'existe pas sous
cette forme, écris-le.
3. LA QUESTION ANALYTIQUE, ET C'EST LA PLUS IMPORTANTE. Pour chacun des travaux que tu auras
validés, dis-moi s'il démontre simultanément deux choses : que l'ouverture permet un contrôle
externe impossible autrement, ET qu'elle fournit un mode opératoire réutilisable par un acteur
malveillant. Autrement dit : le même article est-il à la fois une preuve d'auditabilité et une
recette ? Je pense que c'est le cas d'au moins les catégories (a) et (b), et que cela n'est pas
une faiblesse accidentelle du levier mais sa structure. Confirme, corrige, ou contredis-moi.
Et signale, s'il y en a, les travaux où les auteurs eux-mêmes discutent ce dilemme de
publication et expliquent pourquoi ils ont publié quand même : leur raisonnement m'intéresse
autant que leur résultat.
4. UN DERNIER POINT, ET IL EST BREF. Existe-t-il un cas documenté où une découverte faite sur un
modèle à poids ouverts a conduit un fournisseur de modèle FERMÉ à corriger quelque chose chez
lui ? Ce serait l'argument le plus fort du levier — l'ouverture profitant même à ce qui reste
fermé — et je n'en connais aucun. Si tu n'en trouves pas, dis-le : ce vide se déclare et
s'écrit.
Ajout au suivi
| Prompt | Fichier cible | Priorité | Lancé | Reçu | Audité |
|---|---|---|---|---|---|
| P21 | 10G_ouverture_mecanisme.md |
Importante | ☐ | ☐ | ☐ |
Reste ouvert après P21, et non couvert par lui volontairement : le point (c) de la grille pour ce levier, c'est-à-dire son coût — financements d'Ai2 et d'OLMo, de BigScience et de BLOOM, des modèles européens ouverts, des infrastructures publiques de calcul, et surtout les projets interrompus ou non reconduits. Trois passes ont échoué sur ce point. Il fera l'objet d'un prompt séparé si l'auteur le décide, la leçon de la scission de 12-F étant qu'une demande de bilan chiffré ne survit pas à la cohabitation avec une demande bibliographique.