Aller au contenu

Notes de terrain sur l'IA en production

Guides longs issus de la pratique kengdev: agents, HITL, automatisation, conformité. Sans hype.

GuidesActu IA
Agent IA pour PME: budget setup, run et pièges
PMEBudgetAgentsHITLROI

Agent IA pour PME: budget setup, run et pièges

Combien coûte un agent IA en PME: fourchettes setup, run (tokens, hébergement, TMA), HITL et ce qu'il faut cadrer avant de signer. Sans vanity metrics.

12 min de lecture
Lire l'article
LLMOps: faire tourner des LLM en production sans chaos
LLMOpsEvalObservabilitéProductionCoûts

LLMOps: faire tourner des LLM en production sans chaos

LLMOps pour PME: evals, versioning prompts, observabilité, coût tokens, garde-fous et déploiement. Différent de MLOps classique et de l'automatisation pipeline.

15 min de lecture
Lire l'article
RAG vs fine-tuning: comment choisir pour une PME
Fine-tuningRAGDécisionCoûtsPME

RAG vs fine-tuning: comment choisir pour une PME

RAG vs fine-tuning: faits changeants, style stable, coût, données, risque. Grille de décision PME + pièges classiques. Lien pipeline RAG et LLMOps.

14 min de lecture
Lire l'article
RAG LLM: brancher un modèle sur vos données sans le fine-tuner
RAGLLMPipelineDonnéesProduction

RAG LLM: brancher un modèle sur vos données sans le fine-tuner

RAG LLM en production: corpus, chunking, retrieval, citations, eval, HITL et coût. Méthode PME pour des réponses ancrées, pas un tutoriel embedding générique.

16 min de lecture
Lire l'article
Claude Code: gérer le contexte, compact, clear et les sessions
Claude CodeContexteMCPSkillsGarde-fous

Claude Code: gérer le contexte, compact, clear et les sessions

Claude Code en profondeur: dump zone, compact vs clear, permissions, skills, plan mode, MCP (build/design), plugins d'autonomie, subagents et tokens. Méthode d'équipe pour garder la qualité.

22 min de lecture
Lire l'article
Context engineering: rendre l'IA déterministe en production
Context engineeringProductionAgentsTokens

Context engineering: rendre l'IA déterministe en production

Context engineering pour agents métier: Write, Select, Compress, Isolate. Ce qui entre dans le modèle, pourrissement de contexte, MCP et tokens, métriques. Frontière claire avec Claude Code.

18 min de lecture
Lire l'article
Code review IA: accélérer sans merge automatique
Code reviewCIQualitéSécurité

Code review IA: accélérer sans merge automatique

Revue de code par IA: premier passage, cohérence, limites métier, commentaire only, calibration bruit. Pas de merge auto. Checklist 2 sprints.

15 min de lecture
Lire l'article
Vibe coding: quand explorer et quand spécifier
Vibe codingSpec-drivenQualitéRPI

Vibe coding: quand explorer et quand spécifier

Vibe coding (terme popularisé début 2025): prototyper vite sans relire le code. Utile en spike; risqué en prod (sécu, maintenabilité). Bascule specs et RPI dès qu'un client ou des données sensibles entrent.

17 min de lecture
Lire l'article
AI native: process, lucidité et delivery d'équipe
AI-nativeÉquipesDeliveryProcess

AI native: process, lucidité et delivery d'équipe

Équipe AI-native: conventions avant outils, KPI lead time/incidents/revue (pas commits), enablement, shadow IT, lucidité. Culture delivery sous accélération IA.

16 min de lecture
Lire l'article
IA locale: Ollama, self-host et vrais critères de choix
IA localeOllamaSouverainetéSécurité

IA locale: Ollama, self-host et vrais critères de choix

IA locale vs cloud: privacy, TCO, qualité, latence, SLA. Ollama pour dev/prototype; prod multi-user = autre stack. Grille de décision et checklist sécu pour PME.

16 min de lecture
Lire l'article
Multi-agent: patterns quand un seul agent ne suffit plus
Multi-agentsArchitecturePatternsOrchestration

Multi-agent: patterns quand un seul agent ne suffit plus

Système multi-agent: routeur, spécialistes, critique, orchestrateur, subagents (Isolate). Seulement si le mono-agent est illisible. Gouvernance tokens et hops.

15 min de lecture
Lire l'article
Model Context Protocol: brancher un agent à tes outils sans chaos
MCPIntégrationAgentsSécurité

Model Context Protocol: brancher un agent à tes outils sans chaos

MCP (standard ouvert, Anthropic fin 2024): host, client, serveur, tools JSON-RPC. Allowlist, tokens des schémas, sécu. Computer use en section. Guide PME.

17 min de lecture
Lire l'article
Automatisation IA: du chat isolé au pipeline
AutomatisationPipelineCI/CDOps

Automatisation IA: du chat isolé au pipeline

Automatisation IA en entreprise: stades sidebar → scripts → agents outillés → CI/CD. ROI, gouvernance, garde-fous. Différent du premier agent métier (support, relances).

16 min de lecture
Lire l'article
Human in the loop: designer la supervision des agents IA
HITLGouvernanceQualitéProduction

Human in the loop: designer la supervision des agents IA

Human in the loop (HITL): seuils, files de validation, capitalisation, fatigue de revue. Pas le build de l'agent: le design de la supervision en production.

16 min de lecture
Lire l'article
Comment créer un agent IA en PME (sans se tromper de cible)
AgentsPMEAutomatisationHITL

Comment créer un agent IA en PME (sans se tromper de cible)

Comment créer un agent IA utile: process d'abord, LLM + outils + contrôle, premier flux qui paie, allowlist, KPI, HITL. Multi-agent plus tard. Méthode de cadrage en 40 minutes.

18 min de lecture
Lire l'article