Souveraineté numérique

La souveraineté numérique ne se décrète pas dans un communiqué de presse, elle se constate dans les factures : qui héberge, qui chiffre, qui possède la clé, qui peut couper. Cette catégorie part du principe qu’un pays qui délègue ses données, ses modèles et ses paiements à des juridictions étrangères a déjà répondu à la question, même quand il prétend encore la poser. Vous y trouverez le sujet pris par le bas plutôt que par les colloques : l’IA en local et son coût réel, l’auto-hébergement quand la forge devient agentique, la cryptographie zero-knowledge dont l’administration ne veut pas, la dépossession douce de ce qu’on croit acheter, du Plex qu’on ne contrôle plus au PEA qui achète l’Amérique sans jamais la posséder. Et la question industrielle en toile de fond : pendant que la France vend ses participations et régule son déclin, d’autres fabriquent les machines. Écrit par un praticien qui déploie ces infrastructures pour ses clients, avec la conviction que la souveraineté est un goulot d’étranglement technique et industriel avant d’être une ligne de discours.

Mistral s’endette à 830 millions : souveraineté ou mise sur rouge ?

Souveraineté numérique

Mistral vient d’annoncer 830 millions de dollars de financement par dette — une première dans l’histoire de la société — pour construire son propre datacenter à Bruyères-le-Châtel, au sud de Paris. Le chiffre d’affaires annuel récurrent de l’entreprise est passé de 20 à 400 millions de dollars en douze mois, avec un objectif d’un milliard d’ici fin 2026. Le montage mérite pourtant qu’on y regarde de près : les 13 800 puces sont signées Nvidia — Santa Clara, Californie —, la dette est en partie portée par HSBC et MUFG, et le capital du grand campus prévu pour 2028 vient d’Abu Dhabi. La souveraineté numérique que certains voient dans cette annonce se construit donc avec des puces américaines, des banques britanniques et japonaises, et un fonds émirati. Mistral progresse dans la bonne direction — mais progresser dans la bonne direction et avoir atteint la souveraineté, ce n’est pas la même chose.

TurboQuant : Google divise par 6 la mémoire de vos LLM

Intelligence artificielle

Google Research vient de publier TurboQuant, un algorithme de compression du KV-cache présenté à ICLR 2026, qui s’attaque à l’un des derniers goulots structurels de l’inférence locale. En combinant rotation aléatoire sur hypersphère (PolarQuant) et encodage résiduel à un bit (QJL), la méthode descend à 3 bits par valeur sans fine-tuning ni calibration. Le résultat : une mémoire KV-cache divisée par six, avec un recall parfait jusqu’à 104 000 tokens et une vitesse d’attention multipliée jusqu’à ×8 sur H100. Combiné au CAG, cela permet de charger des corpus six fois plus grands dans le contexte sans saturation mémoire ni dégradation, et sans envoyer la moindre donnée dans le cloud. Le seul bémol : aucune implémentation publique n’existe encore dans llama.cpp, MLX ou vLLM, l’intégration réaliste reste fixée à fin 2026, voire 2027.

Votre RAG a un talon d’Achille : le modèle d’embedding que personne ne choisit vraiment

Intelligence artificielle

Choisir son modèle d’embedding est la décision la plus irréversible d’un pipeline RAG : changer de modèle après avoir indexé ses documents oblige à tout supprimer et recalculer depuis zéro. En mars 2026, Voyage AI s’impose comme le choix naturel pour les stacks Claude grâce à son partenariat officiel avec Anthropic et à sa famille voyage-4 qui introduit un espace d’embedding partagé ; permettant d’indexer en voyage-4-large (qualité maximale) et de requêter en voyage-4-lite (six fois moins cher) sans ré-indexation. Sur le plan économique, un token d’embedding coûte entre 25 et 150 fois moins cher qu’un token LLM en entrée, et sur un corpus de 100 000 documents avec 10 000 requêtes mensuelles, le budget embedding sur 3 ans reste inférieur à 10 dollars ; le LLM d’inférence est le vrai poste de coût. En production, le retrieval vectoriel seul ne suffit plus : la norme 2026 est un pipeline hybride dense + BM25, suivi d’un reranker cross-encoder qui affine les 50 à 100 candidats initiaux avant de transmettre les 5 meilleurs à Claude. Le modèle d’embedding et la taille des chunks forment ensemble la fondation de votre système : fixez les deux avant d’indexer la première ligne de contenu.

Mon chemin de Damas chez les Enfants du Siècle

Culture

Il m’a fallu traverser bien des hivers de l’esprit avant de découvrir que les livres ne sont pas des tombeaux de papier, mais des chemins de Damas. De l’éveil sensuel d’Indiana aux gouffres métaphysiques de la Correspondance de Sand, j’ai appris à respirer au rythme d’un XIXe siècle incandescent. Cette initiation, guidée par des professeurs passionnés, m’a conduit des ombres du fantastique jusqu’au seuil monumental de la nef hugolienne. Au pied de cette cathédrale de mots, j’ai fini par discerner les contours d’un monstre sacré dont l’oraison funèbre pour George Sand a scellé mon propre destin. Sur ce sentier pavé de rêves et de fièvres, j’ai enfin fait ma première véritable rencontre : celle de l’homme que j’allais devenir.

WebMCP : quand les sites web apprennent à parler aux agents IA

Intelligence artificielle

Le 10 février 2026, Google et Microsoft ont publié WebMCP en early preview dans Chrome Canary, un standard W3C qui permet aux sites web de déclarer leurs capacités sous forme de « tools » structurés via l’API navigator.modelContext. Fini les agents IA qui naviguent à l’aveugle par captures d’écran : le site dit directement à la machine ce qu’il sait faire. Pendant ce temps, la DINUM lance le premier serveur MCP français pour data.gouv.fr, ouvrant 45 000 jeux de données publiques aux agents IA. Mais derrière l’élégance technique, trois failles de sécurité majeures restent béantes (isolation inter-onglets, prompt injection via les tools, consentement aveugle) et l’Europe est absente de la table où s’écrit le standard. WebMCP est peut-être le Schema.org des actions, mais sa grammaire se définit à Mountain View et Redmond, pas à Paris.

Le revenu universel, ou comment dresser un peuple à la laisse

Société

Sam Altman dénonce l’AI washing, le Royaume-Uni envisage un revenu universel pour amortir le choc de l’IA, Elon Musk promet que personne n’aura plus d’emploi. Derrière ces discours se dessine un projet : les mêmes qui suppriment votre emploi vous proposent de signer votre chèque de survie. Le revenu universel version Silicon Valley n’est pas un filet de sécurité, c’est un néo-féodalisme numérique où des milliardaires sans comptes à rendre deviennent vos seuls pourvoyeurs. Pendant ce temps, personne ne sait taxer l’IA, et ceux qui devraient payer sont précisément ceux qui écrivent les règles fiscales. Quand la même main supprime votre emploi et signe votre chèque, ça ne s’appelle pas du progrès, ça s’appelle de la servitude.

La bulle IA francophone sur X

Intelligence artificielle

Depuis l’été 2025, la sphère IA francophone sur X tourne en boucle : threads alarmistes, flex lifestyle et prophéties de fin du monde professionnel ; le tout sans code à montrer. Derrière le doomer porn se cache un funnel classique où l’urgence fabriquée devient le produit vendu. Pendant ce temps, les vrais chantiers (Mistral qui bâtit son cloud souverain, l’optimisation web pour les LLM, les agents en production) passent au second plan. Ce billet décortique la mécanique de cette bulle narrative, ses archétypes et son coût réel sur le débat tech français. De la rhétorique sans repo, on en a assez vu.

Le web se voile aux IA : patterns, dette et revanche du HTML sémantique

Intelligence artificielle

Le web n’a jamais été aussi beau pour les humains et aussi opaque pour les IA qui tentent de le lire. Infinite scroll, SPA, lazy loading, shadow DOM, paywalls : chaque innovation UX érige un mur supplémentaire entre votre contenu et les modèles de langage. Ce fossé crée une dette d’accessibilité IA, invisible, silencieuse, payée par l’éditeur qui devient inexistant dans le nouveau funnel de découverte LLMO. Les contre-attaques existent (headless rendering, agents navigateurs, standards émergents) mais ne profitent qu’aux gros acteurs. Le vieux web sémantique (HTML propre, RSS complet, contenu livré au premier octet) prend sa revanche.

Comment les IA lisent le web : tokens, troncature et limites cachées

Intelligence artificielle

Quand une IA comme ChatGPT, Claude ou Gemini consulte votre site, elle ne lit pas votre page entière ; elle en échantillonne une fraction tronquée à ~50 000 tokens (Claude), 30-60 000 (GPT). Sur WordPress, 70% du HTML est du bruit inutile (navigation, footer, CSS Tailwind) qui dévore le budget avant votre contenu. Aucun standard n’existe pour rediriger vers un endpoint JSON optimisé (180 Ko max). Arbre d’accessibilité (Claude in Chrome) et upload fichier contournent le problème. Guide 2026 pour éditeurs : reprenez la souveraineté de votre contenu face aux angles morts des LLM.

Mot de passe volé, Freedom.gov et euro numérique : la semaine où tout s’est fissuré

Souveraineté numérique

L’État français perd 1,2 million de données bancaires sur un mot de passe volé. La même semaine, l’administration Trump dévoile Freedom.gov, un VPN gouvernemental confié à une activiste du Premier Amendement et à un ancien du DOGE accusé d’avoir exposé 300 millions de numéros de sécurité sociale. Pendant ce temps, l’Europe annonce vouloir numériser notre monnaie. Trois promesses de confiance numérique, trois faillites symétriques et au milieu, des citoyens à qui l’on demande de choisir leur tuyau sans jamais voir qui est à l’autre bout.