À lire
Des méthodes et des arbitrages, écrits après le terrain.

Un nouvel outil d’IA : ce que ça change pour vos équipes et votre direction
Un travail plus vaste en une seule passe, des tâches exécutées sous supervision, des coûts lisibles d’avance. Ce qu’il faut décider maintenant.
IA en entreprise2026-08-148 min

Omnibus : le report de l'AI Act ne solde rien
Le report déplace une date d'exigibilité, il n'annule pas une obligation. Et il ne touche ni la littératie IA ni les sanctions, déjà applicables.
AI Act2026-08-049 min

Recruter un profil IA : ce qu'il faut vraiment chercher
Les offres demandent des frameworks. Ce qui distingue vraiment un profil, c'est sa capacité à écarter un cas d'usage et à construire une mesure.
Recrutement2026-07-148 min

Les trois gestes qui font tenir un système
Aucun des trois gestes ne demande de savoir entraîner un modèle. Ensemble, ils suffisent à ce qu'une équipe tienne son système sans celui qui l'a construit.
Formation2026-07-1410 min

Former à tenir un système, pas à utiliser un outil
Savoir se servir d'un outil et savoir le tenir sont deux compétences différentes. La seconde est celle qui décide si le système survit au départ du prestataire.
Formation2026-06-099 min

Maintenance : ce qui occupe l'équipe la deuxième année
La deuxième année ressemble peu à la première. Ce qui occupe l'équipe n'est plus la construction mais quatre charges récurrentes que personne n'avait prévues.
Exploitation2026-06-0910 min

La dette technique d'un système d'IA
La dette d'un système d'IA ne se voit pas dans le code. Elle s'accumule dans le prompt, dans le corpus et dans un jeu de tests que plus personne ne met à jour.
Exploitation2026-05-198 min

Préparer un contrôle de conformité en deux semaines
Quand l'échéance approche et que rien n'existe, l'ordre décide de ce qu'on obtient. L'inventaire d'abord, toujours, et il prend une demi-journée.
Conformité2026-05-1210 min

Migrer un agent d'un modèle à l'autre sans régression
Changer de modèle arrive deux à trois fois par an. Sans jeu de tests et sans bascule progressive, c'est une opération à l'aveugle.
Migration2026-04-149 min

Petits modèles sur poste : quand la donnée ne sort pas
Un modèle local sur un ordinateur portable règle la question de la confidentialité par construction. Reste à savoir quelles tâches il traite réellement.
Modèles ouverts2026-04-1410 min

Agent ou simple appel : la question qu'on ne pose pas
Un agent est plus lent, plus cher et plus difficile à superviser qu'un appel simple. Il faut donc une raison précise de l'utiliser.
Agents2026-03-178 min

Mesurer le coût par fonctionnalité
Une facture mensuelle ne dit rien. Étiqueter chaque appel prend une demi-journée et révèle qu'une fonctionnalité minoritaire porte la majorité de la dépense.
Coût2026-03-1010 min

Ce qu'un taux journalier élevé achète réellement
Un taux journalier ne s'achète pas au jour. Il s'achète au risque évité, aux trimestres non perdus et à ce qu'on n'a pas à refaire.
Économie2026-02-178 min

Haut risque : ce qui doit exister avant l'échéance
Une analyse de risque se date. Des journaux ne se reconstituent pas. Ce qui manque le jour de l'échéance manquera définitivement.
AI Act2026-02-1010 min

Forward Deployed Engineer : le métier, pas le titre
Un consultant remet un document. Un prestataire livre un projet. Un Forward Deployed Engineer s'installe, écrit le code dans vos systèmes, et part quand ça tourne.
FDE2026-01-2010 min

Où part réellement un budget d'IA
Le poste dont tout le monde parle est le plus petit. Les trois autres, dont personne ne parle, portent l'essentiel de la dépense.
Coût2026-01-1310 min

Prompting Vulgarisé : Les 12 Anti-Patterns et le Framework R.O.C.C.E
Pourquoi l'IA échoue-t-elle à répondre ? Découvrez les 12 erreurs fatales et comment les corriger avec la méthode R.O.C.C.E.
Prompting2026-01-1115 min

Agents en entreprise : où s'arrêtent les projets
La démonstration est facile, le pilote est possible, la production est rare. L'écart ne s'explique pas par la technique mais par trois questions sans réponse.
Agents2025-12-1610 min

Écrire la fiche d'un système d'IA
Une page par système, cinq rubriques. Ce document sert la conformité, et son vrai bénéfice est ailleurs : il révèle les systèmes qui poursuivent deux buts.
Gouvernance2025-12-0910 min

Observabilité des systèmes d'IA : journaliser quoi, et pourquoi
Un système d'IA ne renvoie pas d'erreur quand il se trompe. L'observabilité n'est donc pas une bonne pratique : c'est la seule façon de savoir ce qui se passe.
Observabilité2025-11-259 min

Reprendre un système d'IA construit par quelqu'un d'autre
Le réflexe est d'ouvrir le prompt. C'est la troisième chose à regarder, et c'est pour cela que les reprises durent trois fois trop longtemps.
Méthode2025-11-1810 min

Évaluer un fournisseur d'IA hors capacités
Les capacités convergent, les conditions d'exploitation non. Quatre critères invisibles décident si un fournisseur tiendra sur trois ans.
Fournisseurs2025-10-2810 min

Ce que coûte un incident sur un système d'IA
Un incident classique se répare. Un incident d'IA se répare aussi, mais il laisse une question : depuis quand, et sur combien de dossiers ?
Exploitation2025-10-148 min

Réduire de moitié le contexte envoyé
Sur les systèmes que je reprends, la moitié du contexte envoyé ne sert jamais. Le retirer divise la facture et améliore souvent la qualité des réponses.
Coût2025-10-0710 min

Soutenir une thèse en IA et déployer en entreprise
J'ai soutenu ma thèse le 26 septembre 2025. Ce que trois ans de recherche changent dans la façon de déployer, et ce qu'ils ne changent pas du tout.
Recherche2025-09-308 min

Recherche hybride : deux façons de chercher, un seul résultat
Chercher par le sens rate les numéros d'article. Chercher par les mots rate les reformulations. Les deux ensemble corrigent la moitié des mauvaises réponses.
RAG2025-09-1610 min

Modèles à usage général : ce qui doit descendre la chaîne
Une part de la conformité ne se produit pas : elle se réclame au fournisseur. Encore faut-il savoir quoi demander, et à quel moment du contrat.
AI Act2025-08-2610 min

GPT-5 : ce qu'une génération majeure ne change pas
Un modèle remplace un modèle. Le corpus mal rangé reste mal rangé, la récupération défaillante reste défaillante, et le périmètre flou le reste aussi.
GPT-52025-08-0710 min

Sanctions de l'AI Act : ce qui devient exigible
Le régime de sanctions s'applique depuis le 2 août 2025. Mais l'exposition la plus courante n'est pas l'amende : c'est l'incapacité à répondre dans un délai contraint.
AI Act2025-08-058 min

Comment lire une annonce de benchmark
Un score annoncé répond à une question générale. Quatre questions le ramènent à votre situation, et le vident, la plupart du temps.
Évaluation2025-07-0910 min

Le refus de répondre est une fonctionnalité
Un système qui répond toujours n'est pas plus utile : il est plus dangereux. Le droit de ne pas savoir est le réglage au meilleur rendement.
Qualité2025-07-087 min

Le prix de l'inférence s'effondre : ce que ça déplace
Quand le coût par requête est divisé par dix, le projet ne devient pas dix fois plus rentable. Le goulot se déplace simplement ailleurs.
Coût2025-06-248 min

Anonymiser avant d'envoyer : ce qui sort n'est pas ce qui est traité
Retirer les identifiants avant l'envoi, les réinsérer après : la technique fonctionne, à condition de savoir précisément ce qu'elle ne protège pas.
Confidentialité2025-06-1710 min

Agents : le risque croît avec la durée sans contrôle
Un agent qui tient une heure fait dix fois plus de choses qu'un agent qui tient six minutes, y compris dix fois plus d'erreurs non détectées.
Agents2025-05-2210 min

Supervision humaine : la concevoir, pas la promettre
Une supervision humaine qui n'est pas dimensionnée est une formalité. Trois conditions la rendent réelle : voir, comprendre, avoir le temps.
Supervision2025-05-139 min

Combien de cas d'usage faut-il abandonner
Sur cinq cas d'usage présentés en cadrage, j'en retiens deux au plus. Écarter les trois autres est la partie du travail qui rapporte le plus.
Cadrage2025-04-158 min

Quand la fenêtre de contexte cesse d'être un argument
La fenêtre géante était un argument de vente pendant deux ans. Devenue universelle, elle ne décide plus rien, et les vrais critères réapparaissent.
Contexte2025-04-1410 min

RAG ou fine-tuning : l'arbitrage par le coût
Le débat RAG contre fine-tuning se tranche rarement sur la qualité. Il se tranche sur ce que coûte la mise à jour, et sur ce qu'on doit pouvoir prouver.
RAG2025-03-259 min

Brancher un modèle sur un progiciel sans API
La moitié des applications métier d'une grande organisation n'expose aucune interface. Trois ponts existent, et le plus visible est presque toujours le pire.
Intégration2025-03-1810 min

Douze pièges qui gâchent vos échanges avec l’IA
Douze erreurs courantes, leurs corrections, et une structure de consigne qui fonctionne.
Pratique2025-03-056 min

Raisonnement hybride : un seul modèle, deux régimes
Le même modèle peut répondre en une seconde ou réfléchir pendant une minute. Décider quand, par règle plutôt qu'au cas par cas, est tout le travail.
Raisonnement2025-02-2410 min

Littératie IA : l'obligation passée inaperçue
L'obligation de littératie IA s'applique depuis le 2 février 2025. Elle n'a pas été reportée, elle concerne presque tout le monde, et presque personne ne l'a vue passer.
AI Act2025-02-118 min

Des réponses fiables, des sources citées, le droit de ne pas savoir
Comment éviter les réponses inventées : partir de vos documents, citer chaque source, évaluer, et savoir dire je ne sais pas.
Fiabilité2025-02-109 min

Pratiques interdites : ce qu'aucun garde-fou ne rattrape
La plupart des obligations se satisfont par des mesures. Une petite liste échappe à cette logique : ces usages sont interdits, point. Il faut savoir la lire.
AI Act2025-02-0210 min

Modèles de raisonnement : ce que ça change dans une architecture
Un modèle qui réfléchit avant de répondre ne s'intègre pas comme un modèle qui répond tout de suite. Latence, coût, traçabilité : trois arbitrages déplacés.
Raisonnement2025-01-219 min

DeepSeek R1 : ce qui change quand entraîner devient abordable
Le coût d'entraînement d'un modèle de pointe chute d'un ordre de grandeur. Le plancher se déplace ; le plafond ne bouge pas, et c'est le plancher qui compte.
Modèles ouverts2025-01-2010 min

Deux cas d’usage concrets en quatre semaines
Une méthode en quatre semaines : cadrer, tester, mesurer, sécuriser. Avec une liste de priorités et des indicateurs.
Méthode2025-01-157 min

Construire un jeu de tests en une journée
Trente lignes, quatre colonnes, une journée de travail. C'est ce qui sépare une équipe qui décide sur des chiffres d'une équipe qui décide sur des impressions.
Évaluation2024-12-0310 min

MCP : le protocole qui rend les agents branchables
Avant, chaque intégration entre un modèle et un outil était du code sur mesure. Un protocole commun change la nature du travail : on branche au lieu de recoder.
MCP2024-11-199 min

Piloter un écran ne vaut pas droit de tout cliquer
Un modèle qui manipule une interface accède à tout ce qu'un utilisateur peut faire. La capacité technique arrive avant les garde-fous, et l'écart est le risque.
Agents2024-10-2210 min

Mesurer l'adoption, pas la satisfaction
Les enquêtes de satisfaction d'un outil d'IA sont excellentes et ne prédisent rien. Ce qui prédit, c'est la fréquence d'usage à six semaines.
Adoption2024-10-157 min

Le coût réel d'un système d'IA en production
Le coût d'un système d'IA n'est pas le prix des jetons. C'est six postes, dont un seul est visible sur la facture du fournisseur.
Coût2024-09-249 min

Modèles de raisonnement : la réflexion devient un budget
La qualité devient un réglage : plus de réflexion, plus de justesse, plus de coût. Ce curseur doit être posé par tâche, jamais une fois pour tout le système.
Raisonnement2024-09-1210 min

Mise en cache du contexte : le répété ne se paie qu'une fois
La plupart des systèmes renvoient le même contexte à chaque requête. Le facturer une seule fois divise la note, à condition d'avoir rangé le prompt dans le bon ordre.
Coût2024-08-1410 min

L'AI Act entre en vigueur : ce que l'ingénieur doit livrer
Le texte est entré en vigueur le 1er août 2024. Voici sa traduction en livrables d'ingénierie, ceux qui se décident à l'architecture et pas à la recette.
AI Act2024-08-0610 min

Sorties structurées : le format garanti supprime une étape fragile
Analyser du texte pour en extraire un objet est la source d'erreur la plus banale d'une chaîne automatisée. Le format garanti la supprime entièrement.
Architecture2024-08-0610 min

Llama 3.1 405B : ce que télécharger des poids ne fournit pas
Le modèle ouvert atteint le niveau des meilleurs fermés. Ce qui reste à fournir soi-même représente l'essentiel du coût, et se découvre après la décision.
Llama2024-07-2310 min

GPT-4o mini : les usages qui basculent quand le coût s'effondre
Le tri systématique du courrier, l'enrichissement de base, le contrôle exhaustif : trois usages qui passent du côté rentable quand le prix unitaire s'effondre.
Coût2024-07-1810 min

Modèles ouverts : quand la souveraineté devient une décision d'architecture
Faire tourner un modèle chez soi n'est pas une position de principe. C'est un arbitrage qui se calcule, et qui se retourne selon le volume et le type de données.
Modèles ouverts2024-07-029 min

Claude 3.5 : quand le palier intermédiaire dépasse l'ancien palier haut
Le palier intermédiaire d'une nouvelle génération dépasse le palier supérieur de la précédente. Toute répartition figée devient un surcoût silencieux.
Claude2024-06-2010 min

Le jour où le modèle a changé sans prévenir
Personne n'a touché au système. Il répond pourtant différemment depuis mardi. C'est un scénario ordinaire, et il se prépare.
Exploitation2024-06-188 min

Agents IA : le périmètre avant l'autonomie
Un agent sans périmètre écrit est un incident en attente. La question n'est pas ce qu'il sait faire, mais ce qu'il n'a pas le droit de faire seul.
Agents2024-05-1410 min

GPT-4o : la latence devient un critère de conception
Sous trois cents millisecondes, un échange devient une conversation. Au-delà de trois secondes, l'utilisateur abandonne. Entre les deux se joue l'adoption.
GPT-4o2024-05-1310 min

Llama 3 : l'écart se resserre sur les tâches structurées
Sur les tâches qui composent l'essentiel du volume réel, l'écart entre ouvert et fermé est devenu négligeable. C'est là que se joue l'économie d'un système.
Llama2024-04-1810 min

Les embeddings, expliqués à une direction
Une direction n'a pas besoin de comprendre les mathématiques. Elle a besoin de savoir quelles décisions ce choix engage, et lesquelles sont coûteuses à revenir.
Pédagogie2024-04-097 min

Évaluation continue : le chaînon manquant des projets IA
Un système d'IA ne tombe pas en panne : il se dégrade. Sans évaluation continue, la dégradation n'est pas détectée, elle est seulement ressentie.
Évaluation2024-03-199 min

Grok : des poids publiés ne sont pas des poids exploitables
Publier des poids et rendre un modèle utilisable sont deux choses distinctes. L'écart se mesure en mémoire vidéo, et il est plus grand qu'annoncé.
Modèles ouverts2024-03-1710 min

Claude 3 : choisir le palier, pas le modèle
Trois modèles d'une même famille, même interface, coûts séparés par un facteur soixante. La question devient : quelle tâche mérite quel palier.
Claude2024-03-0410 min

Gemini 1.5 : un million de jetons, et le test qui compte
Une fenêtre d'un million de jetons ne vaut que si le modèle y retrouve ce qu'on y a mis. Le test tient en une demi-journée et change souvent la conclusion.
Gemini2024-02-1510 min

Sortir du prototype : les cinq verrous
Entre le prototype et la production, il n'y a pas une marche mais cinq verrous. Ils se lèvent dans un ordre précis, et sauter le premier fait tomber les autres.
Production2024-02-069 min

Écrire un prompt système qui tient six mois
Un prompt système bricolé tient trois semaines. Ce qui le fait tenir six mois n'est pas son écriture : c'est ce qu'on met autour.
Prompt2024-01-168 min

AI Act : l'accord politique et ce qu'il annonce pour les ingénieurs
L'accord de décembre 2023 n'était pas un texte définitif, mais il fixait déjà ce qui allait tomber sur les équipes techniques : documenter, tracer, superviser.
AI Act2023-12-128 min

Mixtral : tous les paramètres ne servent pas à chaque jeton
Le mélange d'experts découple la capacité du modèle de son coût de calcul. C'est ce découplage qui rend l'auto-hébergement à nouveau discutable.
Mixtral2023-12-1110 min

Gemini 1.0 : la multimodalité native et ses usages réels
Traiter plusieurs modalités dans un seul modèle supprime une chaîne d'outils. Les gains réels en entreprise sont plus modestes et plus utiles que la démonstration.
Gemini2023-12-0610 min

GPTs sur mesure : ce qu'un assistant sans code ne couvre pas
Construire un assistant devient l'affaire de dix minutes. Ce qui reste à faire ensuite représente l'essentiel du travail, et personne ne l'a annoncé.
Assistants2023-11-0910 min

Former deux cents personnes à l'IA générative : ce qui marche
Une formation à l'IA générative qui présente des outils ne change rien. Ce qui change quelque chose, c'est de faire travailler les gens sur leurs propres dossiers.
Formation2023-11-078 min

GPT-4 Turbo : une grande fenêtre reste une facture
La fenêtre grandit, le prix par jeton baisse, et les factures augmentent quand même. L'explication tient dans une confusion entre capacité et budget.
GPT-42023-11-0610 min

Ce qu'on ne délègue jamais à un modèle
Il ne s'agit pas de ce que le modèle sait faire, mais de ce dont quelqu'un doit répondre. La distinction est simple et elle ne bouge pas.
Gouvernance2023-10-177 min

Mistral 7B : quand un petit modèle change l'arbitrage
La question n'est plus « quel est le meilleur modèle » mais « quelle tâche mérite le grand modèle ». Le routage devient la principale source d'économie.
Mistral2023-09-2710 min

Anatomie d'un POC qui ne passe jamais en production
Le POC a marché. Personne ne l'utilise. Ce n'est pas un problème de modèle : c'est un problème de propriétaire, de mesure et de chemin d'intégration.
Production2023-09-129 min

Llama 2 : la licence compte autant que le modèle
Ce qui change avec Llama 2 n'est pas la qualité du modèle mais son contrat. Trois droits décident si vous pouvez réellement construire dessus.
Modèles ouverts2023-07-1810 min

Le corpus est le projet
On croit lancer un projet d'IA. On lance en réalité un projet de gestion documentaire, et c'est là que tout se joue.
Données2023-07-118 min

Claude 2 : cent mille jetons, ce que ça déverrouille vraiment
Un contrat entier tient désormais dans une seule requête. C'est une rupture d'usage réelle, et ce n'est toujours pas la fin de la récupération documentaire.
Claude2023-07-1110 min

RAG : la seule architecture qui tienne en entreprise
Le RAG n'est pas la solution la plus élégante. C'est celle qui survit à la mise à jour d'un document, à un contrôle et à un changement de modèle.
RAG2023-06-209 min

Découper un document : le choix qui décide de tout
On débat du modèle pendant des semaines et on découpe le corpus en dix minutes. C'est l'inverse qu'il faudrait faire.
RAG2023-05-168 min

PaLM 2 : le multilingue comme contrainte d'architecture
Rédiger dans une langue et répondre dans dix casse la recherche documentaire si l'index ne gère pas la correspondance entre langues. Ce n'est pas un réglage.
Multilingue2023-05-1010 min

GPT-4 : pourquoi vos premiers essais échouent en production
Un prototype convainc parce qu'on choisit ses exemples. La production, elle, choisit les siens. Les quatre écarts qui font tomber les premiers essais.
Production2023-04-188 min

Amazon Bedrock : la couche qui rend le modèle remplaçable
Une API unique devant plusieurs modèles. Ce n'est pas une commodité de facturation : c'est ce qui décide si votre système survivra au prochain changement de génération.
Architecture2023-04-1310 min

Plugins ChatGPT : quand un modèle commence à agir
Un modèle qui appelle un service extérieur ne produit plus du texte : il déclenche une action. Le périmètre cesse d'être une question théorique.
Agents2023-03-2310 min

Confidentialité : ce qu'on a le droit de mettre dans un prompt
La question arrive dans chaque formation, et la réponse « ça dépend du contrat » ne suffit pas. Voici la règle que je donne aux équipes.
Confidentialité2023-03-217 min

GPT-4 : pourquoi une fenêtre de 8 000 jetons impose la récupération
GPT-4 est multimodal, mais sa fenêtre tient dans une quinzaine de pages. Cette limite n'est pas un détail : c'est elle qui a imposé la récupération documentaire.
GPT-42023-03-1410 min

Ce que ChatGPT a changé en comité de direction
Trois mois après le lancement de ChatGPT, la question posée en comité de direction avait changé de nature. Ce que ce basculement a produit, et ce qu'il a coûté.
Direction2023-02-147 min