Intelligence artificielle Mettre en cache les tokens répétitifs d’un prompt n’est pas une optimisation avancée réservée aux ingénieurs — c’est la première mesure à prendre avant même de réfléchir à changer de modèle ou de plan tarifaire. Sur un system prompt de 10 000 tokens envoyé 100 fois par jour, le prompt caching réduit la facture mensuelle de $150 à $15, soit 90% d’économie nette dès la deuxième requête. Le gain n’est pas seulement financier : sur des contextes de 50 000 tokens et plus, le time-to-first-token est divisé par un facteur 5 à 10, ce qui transforme l’expérience utilisateur autant que la facture. Combiné à la Batch API d’Anthropic, le coût tombe à $0,25 par million de tokens d’entrée sur le modèle le plus puissant — soit 5% du tarif normal. Dans un secteur où les abonnements flat fee sont des prix de lancement et non des prix d’équilibre, maîtriser ses coûts d’inférence est devenu une compétence professionnelle à part entière.
Économie Anthropic vient d’annoncer une promotion généreuse : doubler les limites d’utilisation de Claude pendant deux semaines. Généreuse ? Pas si vite. Sur la base des tarifs API publics, un développeur intensif peut consommer plusieurs fois la valeur de son abonnement mensuel — c’est Amazon et Google qui paient la différence, pas Anthropic. Contrairement à Netflix ou Spotify, l’IA n’est pas un service logiciel à coût marginal décroissant : c’est un service énergétique, où chaque token brûle des ressources réelles. Les abonnements flat fee à $20 ou $200 sont des prix de lancement — la correction, discrète d’abord, frontale ensuite, est déjà en marche.
Culture Il m’a fallu traverser bien des hivers de l’esprit avant de découvrir que les livres ne sont pas des tombeaux de papier, mais des chemins de Damas. De l’éveil sensuel d’Indiana aux gouffres métaphysiques de la Correspondance de Sand, j’ai appris à respirer au rythme d’un XIXe siècle incandescent. Cette initiation, guidée par des professeurs passionnés, m’a conduit des ombres du fantastique jusqu’au seuil monumental de la nef hugolienne. Au pied de cette cathédrale de mots, j’ai fini par discerner les contours d’un monstre sacré dont l’oraison funèbre pour George Sand a scellé mon propre destin. Sur ce sentier pavé de rêves et de fièvres, j’ai enfin fait ma première véritable rencontre : celle de l’homme que j’allais devenir.
Politique Le mythe du « vote diplômé » repose sur une manipulation statistique : mettre dans le même sac un ingénieur de Centrale et un chargé de mission associatif ne décrit personne. La vraie variable que personne ne nomme, c’est qui signe votre bulletin de salaire. Voter pour l’État quand l’État vous emploie n’est ni stupide ni cynique — c’est rationnel. Mais ce comportement individuel parfaitement logique produit un déséquilibre structurel : en France, les financeurs de la dépense publique et ses bénéficiaires ne pèsent pas le même poids dans l’isoloir. Le diplôme ne vote pas — le portefeuille, si.
Logiciels L’OCR natif d’Odoo Enterprise m’a toujours semblé être une case cochée plutôt qu’un outil réellement utile : taux de reconnaissance médiocre, aucune mémoire des corrections, aucune logique comptable. J’ai donc construit account-invoice-digitize-ai, un module open source qui remplace entièrement la chaîne de traitement des factures fournisseurs par un pipeline IA. Il supporte six fournisseurs (Claude, GPT-4o, Gemini, Grok, DeepSeek, Mistral), tourne sur Odoo 16 à 19 Community et Enterprise, et ne nécessite aucune dépendance Python supplémentaire. Le module ne se contente pas d’extraire du texte : il raisonne — matching fournisseur par IBAN ou TVA, imputation comptable selon votre plan de comptes, détection de doublons, validation mathématique des totaux, et apprentissage des corrections pour les prochaines factures du même fournisseur.
Intelligence artificielle Denis Yarats, directeur technique de Perplexity, annonce l’abandon de MCP au profit d’APIs directes — et X s’emballe. Pourtant, la déclaration révèle moins une condamnation du protocole qu’une décision d’architecture adaptée à un pipeline déterministe : Perplexity n’a pas besoin de découverte dynamique d’outils, donc MCP est effectivement du surcoût inutile dans son cas. Le vrai problème est ailleurs : les griefs légitimes contre MCP — contexte saturé, auth bancale, friction manuelle — ne sont pas dans la spec, ils sont dans des implémentations paresseuses qui ignorent les primitives de pagination et de sampling prévues dès l’origine. Condamner MCP pour ça, c’est condamner SQL parce que quelqu’un a oublié de filtrer ses requêtes sur une table de cent millions de lignes. Ceux qui enterrent MCP aujourd’hui sont les mêmes qui, en 2007, expliquaient que l’iPhone n’avait pas besoin d’App Store — parce qu’il y avait déjà le web mobile.
Intelligence artificielle Un nouveau paradigme s’impose silencieusement dans l’architecture des systèmes IA : le Cache-Augmented Generation. Là où le RAG imposait une infrastructure lourde — bases vectorielles, chunking arbitraire, pipelines ETL —, le CAG charge l’intégralité du corpus dans la fenêtre de contexte du modèle, une seule fois, et le met en cache. Le mécanisme de KV-cache rend cette approche économiquement viable : grâce au prompt caching d’Anthropic, les requêtes répétées sur le même corpus coûtent 90 % moins cher qu’un appel standard. Le CAG excelle là où le RAG échoue structurellement — la synthèse transverse sur corpus entier — tout en supprimant la dette technique accumulée à chaque décision de chunking. Ce n’est pas la mort du RAG : c’est la fin de sa position de solution par défaut.
Intelligence artificielle La base vectorielle s’est imposée comme réponse par défaut au RAG — non pas parce qu’elle est universellement supérieure, mais parce qu’elle est apparue au bon moment et a hérité de l’aura des LLMs. Pourtant, sur un catalogue WooCommerce avec des SKUs et des références précises, une requête SQL ne confond jamais une vis M4 et une vis M5 : elle ne peut pas, c’est sa nature. BM25 surpasse les embeddings partout où le vocabulaire est précis et stable — codes erreur, termes juridiques, identifiants produit. Les bases de graphes résolvent ce que le cosine ne voit pas : non pas la proximité sémantique entre deux textes, mais la relation structurelle entre deux entités. Le vectoriel reste l’outil dominant pour les corpus hétérogènes et les questions ouvertes — mais il mérite d’être choisi plutôt que subi.
Intelligence artificielle Face au catastrophisme ambiant, il est temps de voir l’intelligence artificielle pour ce qu’elle est : une véritable Renaissance technologique. Contrairement aux discours déclinistes, l’histoire prouve que chaque rupture majeure, de l’imprimerie au web, a toujours démultiplié la création humaine plutôt que de l’éteindre. L’IA ne détruit pas le travail, elle le transforme en déplaçant la valeur de l’exécution technique pure vers la vision et le sens. En permettant à chacun de dialoguer avec la machine en langage naturel, elle brise les anciennes castes pour libérer une nouvelle ère de bâtisseurs. Le seul véritable risque n’est pas l’innovation, mais notre propre inertie face à un monde qui s’invente sans nous.
Démocratie Deux communes sur trois n’avaient aujourd’hui qu’une liste en lice — et pourtant, c’est une assemblée d’élus que personne n’a directement mandatés qui décide des transports, des déchets, de l’urbanisme, et s’endette pour tout cela. L’intercommunalité mutualise des services que les petites communes ne pourraient pas financer seules : l’argument est légitime. Mais on peut mutualiser sans créer une strate politique opaque, dotée de sa propre fiscalité et d’un exécutif que personne n’a directement élu. Le maire renvoie vers la com-com, la com-com hérite des décisions de la mandature précédente — et le citoyen qui cherche un responsable frappe à des portes qui s’ouvrent sur d’autres portes. Le vrai mille-feuille administratif français n’est pas qu’un défaut d’organisation : c’est un système où le pouvoir est toujours ailleurs et la responsabilité toujours avant.