Carnet d'ingénierie

Des décisions techniques, pas de la veille recyclée.

Des analyses courtes mais denses sur les agents IA, le backend, les produits SaaS et les architectures qui tiennent quand on les met face au réel.

Vue éditoriale du système : L'attention avant le Transformer
Histoire de la recherche7 min

L'attention avant le Transformer

En 2014, l'attention n'était ni une architecture générale ni un slogan. C'était une réponse précise à un défaut des premiers systèmes de traduction neuronale.

Lire la note
Vue éditoriale du système : Un agent IA devient utile quand sa boucle devient observable
Architecture IA12 min

Un agent IA devient utile quand sa boucle devient observable

Les architectures logicielles modernes reposent sur un principe fondamental de sécurité établi depuis des décennies : la séparation stricte entre le canal des instructions (le code exécutable) et le canal...

Lire la note
Vue éditoriale du système : Un agent IA ne devient fiable qu'avec un harness d'exécution
Systèmes agentiques13 min

Un agent IA ne devient fiable qu'avec un harness d'exécution

Un harness fiable transforme chaque intention en effets idempotents, bornés, traçables et réconciliables, même lorsque le modèle, le réseau ou un outil échoue.

Lire la note
Vue éditoriale du système : RAG, Graph RAG ou Agentic RAG : le type de question décide l'architecture
Architecture IA13 min

RAG, Graph RAG ou Agentic RAG : le type de question décide l'architecture

Une méthode concrète pour choisir le retrieval le moins complexe capable de répondre, du fait isolé au parcours multi-hop et à l’orchestration dynamique.

Lire la note
Vue éditoriale du système : Le vrai coût d'un LLM se décide avant l'entraînement
Architecture IA15 min

Le vrai coût d'un LLM se décide avant l'entraînement

Un développeur backend reçoit pour mission d'intégrer un agent conversationnel capable de manipuler l'inventaire d'une base de données et de rédiger des rapports d'anomalies selon la charte graphique de...

Lire la note
Vue éditoriale du système : Les agents IA deviennent fiables quand la boucle devient le produit
Architecture IA19 min

Les agents IA deviennent fiables quand la boucle devient le produit

Un agent peut ajouter riskscore à GET /accounts/:id, modifier le schéma, ajuster l’interface, faire passer les tests, puis ouvrir une livraison qui semble propre. Le même agent peut aussi casser un client...

Lire la note
Vue éditoriale du système : vLLM transforme la mémoire GPU en système d'exploitation pour LLM
Architecture IA18 min

vLLM transforme la mémoire GPU en système d'exploitation pour LLM

Une API de génération peut recevoir trois requêtes en même temps : un chat court de 600 tokens, un résumé juridique de 18 000 tokens, et une extraction structurée qui demande peu de sortie mais impose un...

Lire la note