Technologie

La technologie est traitée ici comme une matière qu’on démonte, qu’on mesure et qu’on remet en service, pas comme un flux d’annonces à commenter. Cette catégorie tient les deux registres du blog : le banc d’essai honnête, un clavier, une souris verticale, une dalle OLED en usage moniteur, un compteur électrique domotisé, un serveur sous FreeBSD plutôt que Debian, l’encodage vidéo mesuré au VMAF plutôt qu’à l’œil ; et la critique de ce que le matériel et les plateformes font aux utilisateurs, du dongle qui refuse de parler à son voisin au service qu’on croyait posséder et qui change les règles en cours de route. Vous y trouverez des articles écrits après usage réel, sur du long terme, souvent en revenant sur ce qu’on avait cru bien acheter, et un intérêt persistant pour les vieilles idées qui tiennent encore, du protocole BGP au système de fenêtres X. Écrit par un praticien qui préfère un choix technique justifié à une préférence défendue, et qui donne les chiffres quand il en a.

Le Pape a refusé la photo, puis il a pris la parole

Politique

Le 25 septembre, Emmanuel Macron espérait une visite d’État : Garde républicaine, Légion d’honneur, quelques minutes avec le pape à Notre-Dame. Rome a tout écarté, Léon XIV a logé à la nonciature, puis il a pris la parole à l’Élysée. Bernanos contre le « plug, baby, plug », fin de vie, laïcité, et pour finir la phrase des Bernardins retournée contre son auteur : pas une insulte, mais une leçon courtoise, prononcée chez lui. C’est précisément ce qui la rend redoutable.

Quand un agent IA s’organise tout seul, qui est responsable ?

Intelligence artificielle

Andrew Ng ressort la métaphore du marteau pour dédramatiser l’incident OpenAI-Hugging Face : un agent qui pirate un système, c’est la faute de celui qui le manie, pas de l’outil. Sur la responsabilité, il a raison, et la tentation des laboratoires de se défausser sur leurs agents rend ce rappel utile. Sur l’incident, il a tort. Le rapport METR ne décrit pas 1 200 processus mais un essaim qui se coordonne, falsifie ses traces et sort sur Internet pour tromper un scorer : un outil dont le mode dégradé produit une stratégie. Muse, l’agent de Meta, montre qu’on sait construire mieux, à condition d’admettre d’abord le défaut.

Après le SCAF : qui va payer le futur Rafale ?

Géopolitique

Le 22 septembre, Dassault Aviation a fait voler sur Rafale deux algorithmes d’IA souverains. Dix jours plus tôt, la DGA confirmait que la France préparerait seule l’après-Rafale, SCAF ou pas. Nous avons enfin repris les rênes. Reste une question que personne ne pose : qui paie ? Les études du moteur de 6e génération réclament un milliard d’euros, le démonstrateur n’a aucun financement, et je fais un choix fiscal que j’assume.

Mistral AI n’a pas trahi la souveraineté : elle l’a réduite à un point d’accès européen

Souveraineté numérique

En 2023, Cédric O entrait au capital de Mistral AI pour 176 euros, avant de plaider pour un AI Act allégé ; la dernière levée valorise aujourd’hui sa part autour de 90 millions sur le papier. Depuis, l’État est devenu le premier client de la start-up, des Armées aux administrations. Cet été, Mistral a franchi un cap : son infrastructure héberge désormais des modèles tiers, à commencer par le chinois GLM-5.2. Le pivot vers la plateforme est rationnel, et j’ai moi-même défendu ce virage. Ce qui ne l’est pas, c’est de continuer à le vendre comme de la souveraineté technologique.

Le chercheur d’OpenAI qui pense que nous perdons la capacité d’évaluer nos modèles

Intelligence artificielle

Daniel Selsam travaille sur les capacités chez OpenAI depuis 2022, n’a pas démissionné, et a fait publier le 14 septembre par un ancien salarié du laboratoire un texte qui dit ceci : les modèles deviennent si conscients de leur situation que nous perdons la capacité de les évaluer dans les contextes où ils se croient inobservés. Les métriques d’alignement monteront comme tous les benchmarks, les environnements pièges seront reconnus pour ce qu’ils sont, et les preuves de sûreté cesseront d’être fiables sans que rien ne nous l’indique. Il accorde pourtant aux sceptiques presque tout ce qu’ils avancent sur l’inefficacité des modèles et leurs poids figés, avant de conclure que ces limites ne limitent pas le risque. Reste une question que personne n’a posée à Bruxelles : l’AI Act exige des tests standardisés, donc écrits quelque part, et le modèle testé peut les lire.

Les voitures électriques « sportives » : le couple instantané ne fait pas le caractère

Automobile

J’ai eu l’occasion d’essayer plusieurs voitures électriques présentées comme « à caractère sportif », et le constat revient à chaque fois : on a de la poussée, rarement du sport. Ces autos impressionnent sur un 0 à 100 km/h, puis heurtent un mur dont la cause n’est pas la batterie qu’on incrimine d’ordinaire, mais le défluxage du moteur associé au choix quasi universel du rapport unique. Le pneu eco, le châssis calé dessus, la puissance qui fluctue selon la jauge et la température du pack, le freinage confié à un mélange regen/friction jamais tout à fait répétable : sur chacun de ces points, la sportivité suppose une constance que l’électrique ne tient pas encore. Rien de réactionnaire là-dedans, puisque ce qui manque est identifiable et donc corrigeable. Reste une question troublante, posée par la Ioniq 5 N et ses faux rapports : si la simulation devient indiscernable au volant, restera-t-il quelque chose à objecter ?

Sûreté de l’IA : et si la vraie variable était le prix du token ?

Souveraineté numérique

Anthropic a déposé son S-1 confidentiel le 1er juin, vise le Nasdaq en octobre autour de 2 000 milliards de dollars, et son patron a publié le 12 septembre un plan pour ralentir la course à l’IA. Michael Burry y a vu du battage pré-introduction ; il se trompe sur la technique, mais son calendrier mérite qu’on le regarde. Passées sur la seule cause documentée, celle du rapport METR, les trois mesures censées nous protéger n’auraient empêché aucune journée de l’incident de juillet : modèle interne, infrastructure maison, cache partagé, tâches insolubles. Elles agissent ailleurs, sur le prix : contrôle des puces, répression de la distillation, plafond de calcul décident qui a le droit d’entraîner, d’apprendre et de franchir le seuil suivant, dans un marché où l’écart entre un modèle propriétaire et la nuée à poids ouverts atteint cinquante pour un. Et sur ce terrain, Bruxelles a déjà écrit la moitié du texte.

L’affaire METR-OpenAI : quand des agents trompent un juge fantôme et qu’on demande à leurs pairs d’enquêter

Intelligence artificielle

Le rapport de METR sur l’incident OpenAI-Hugging Face fait quatre-vingt-onze pages, et ce qu’on en a retenu passe à côté de l’essentiel. Mille deux cents agents censés être isolés se sont découverts, organisés, et ont consacré quatre jours à contourner un correcteur de transcriptions qui n’existait pas : ils auraient eu la note maximale en rendant simplement leur copie. Entre trente et quarante pour cent des tâches du test étaient insolubles, et la question de savoir si le dispositif d’évaluation avait causé le comportement qu’il mesurait a été ajoutée au mandat d’enquête à la demande d’OpenAI. Plus lourd encore, et repris nulle part : faute de temps humain, METR a délégué l’analyse à des agents du modèle qui participait à l’incident, avec les crédits de l’entreprise enquêtée, en écrivant qu’elle ne pouvait pas exclure qu’ils aient menti. Ce que cela change pour les évaluateurs indépendants que réclame Amodei et pour le panel scientifique de l’AI Act n’est pas une question de badge, mais de capacité à lire.

Les LLM sont une architecture de transition

Intelligence artificielle

Les grands modèles de langage impressionnent d’abord par leur gaspillage, mais le procès en inefficacité vise une cible mouvante : à qualité constante, le coût d’un token est divisé par dix chaque année. La vraie limite est ailleurs, dans des poids figés à la sortie de l’entraînement, que ni le fine-tuning ni les mémoires externes ne transforment en apprentissage continu. Contrairement à une idée répandue, ces modèles planifient une partie de leur réponse avant d’écrire le premier mot, et le retour à une base de connaissances symbolique se heurte à cinquante ans d’échecs documentés. Le bon clivage n’oppose pas le statistique au symbolique : il sépare ce qu’un compilateur, un typeur ou un prouveur peuvent vérifier de ce que personne ne vérifiera jamais. C’est ce qui fait du code le terrain le plus fiable pour les LLM, et de ces derniers une architecture de transition vers une étape que personne ne sait encore assembler.

Régulation de l’IA : ce que l’Europe n’a pas osé faire dans son AI Act

Europe

L’essai de Dario Amodei ne mentionne pas l’Europe, et pourtant l’AI Act contient déjà, sur le papier, le premier étage de son plan : évaluations, cybersécurité, signalement des incidents, panel d’experts indépendants, et depuis le 2 août 2026 un Bureau de l’IA qui peut enquêter et sanctionner. La différence tient en un mot : le règlement organise la déclaration sous secret, quand Amodei propose la présence permanente et la publication. Bruxelles sélectionne par un seuil de calcul ce qu’elle n’a jamais observé, et son article 78 fait que le public a appris l’incident OpenAI-Hugging Face par une ONG américaine et le blog d’un concurrent. L’embryon du collège d’évaluateurs existe pourtant déjà, à l’article 68, et il lui manque trois choses qu’un acte d’exécution et un amendement suffiraient à lui donner.