
Mettre un modèle de langage en production : tout ce qui change
Non-déterminisme, évaluation, coût variable, pannes silencieuses, repli entre fournisseurs, gestion des prompts : le passage en production d'une fonctionnalité IA, poste par poste.
Thème
21 articles sur ce thème, écrits par les équipes qui construisent les applications dont ils parlent.

Non-déterminisme, évaluation, coût variable, pannes silencieuses, repli entre fournisseurs, gestion des prompts : le passage en production d'une fonctionnalité IA, poste par poste.

Pourquoi le trunk SIP découple l'agent de l'opérateur, et pourquoi le vrai verrou se situe dans la gestion des numéros, pas dans le transport.

Décomposition du délai d'un agent vocal téléphonique, poste par poste, et les trois optimisations qui comptent vraiment.

Le découpage en couches d'une application Flutter branchée sur une API existante : où traduire, quoi tester, et ce qui casse sans cette frontière.

Les critères qui décident vraiment entre relationnel et documentaire, et pourquoi la question du volume arrive presque toujours trop tôt.

Ce qui rend le planning d'un club plus complexe qu'un agenda, et comment le modéliser autour des exceptions plutôt que de la répétition.

Pourquoi la reprise de données fait dérailler les projets de remplacement, et la méthode que nous appliquons pour la maîtriser.

Une grille de décision entre tableur, entrepôt et lac de données, avec les trois signaux qui indiquent qu'il faut changer d'étage.

Ce qui casse dans les traitements de fond, et les trois règles qui l'évitent : idempotence, file d'échec, indépendance à l'ordre.

Une analyse technique de ce que le no-code fait bien, de l'endroit précis où il décroche, et de la stratégie qui exploite les deux.

L'architecture d'une application mobile réellement utilisable sans réseau, et pourquoi on ne peut pas l'ajouter après coup.

Six erreurs de modélisation qui ne cassent rien le premier mois et coûtent cher au bout de deux ans, avec la correction pour chacune.

Le cas concret d'une plateforme de gestion d'association déclinée en quatre marques : ce qui est mutualisé, ce qui ne doit jamais l'être, et où se situe la limite.

Pourquoi nous démarrons presque toujours en monolithe modulaire, les trois cas où nous en sortons, et comment préparer une extraction future sans la subir.

Les critères qui décident entre natif, multiplateforme et web, et les coûts cachés de chaque option.

La méthode de diagnostic que j'applique face à une application lente, et les quatre causes qui expliquent l'essentiel des cas.

Les règles de compatibilité que nous appliquons sur nos API, et les erreurs de conception qui obligent à casser le contrat.

Les critères que nous appliquons pour choisir un hébergement, et pourquoi le cloud n'est pas la réponse par défaut.

Les signaux que nous mettons en place sur toutes nos applications, ceux que nous laissons de côté, et comment éviter la fatigue d'alerte.

La méthode de migration progressive que nous appliquons, étape par étape, et les trois conditions sans lesquelles elle échoue.

Comment nous choisissons une technologie pour une application censée vivre dix ans, et pourquoi la performance est un mauvais critère de tri.
Ces articles décrivent notre façon de travailler. Si le sujet vous concerne, le premier échange sert à qualifier, pas à vendre.