AI, LLMs, and applied ML.

Notes de terrain d'un ingénieur senior sur l'IA, les LLMs, les agents et l'apprentissage automatique appliqué par Ercan Ermis.

All posts

66 posts

La sortie structurée bat le parsing astucieux

Vous parsez encore du JSON dans du texte modèle avec des regex ? Les sorties structurées Bedrock imposent un JSON Schema : réponse valide par construction.

Apr 06, 2026 5 min

Le Prompt Caching sur Bedrock : la remise de 90 % que la plupart des équipes ignorent

Le prompt caching Bedrock lit un préfixe répété à 90 % de réduction, mais une écriture en cache coûte plus cher qu'un appel sans cache. Le breakpoint décide.

Apr 02, 2026 6 min

AWS Monthly (mars 26) : la gouvernance rattrape les agents

Mars 2026 sur AWS : AgentCore Policy et Evaluations en disponibilité générale, Elemental Inference lancé, gouvernance d'agents en plan de contrôle production.

Mar 31, 2026 5 min

Le streaming des réponses est une décision d'UX, pas de performance

Diffuser les réponses en streaming est un choix UX sur le temps jusqu'au premier token, pas un correctif de vitesse. Cela peut dégrader la sortie structurée.

Mar 24, 2026 5 min

Bedrock Agents contre votre propre boucle maison

Amazon Bedrock Agents gère l'orchestration, la mémoire et les appels d'outils. Voici quand ce framework managé fait gagner du temps, et quand il vous limite.

Mar 18, 2026 5 min

IAM pour les applications LLM : le moindre privilège quand l'appelant est un modèle

Quand l'appelant est un modèle, le moindre privilège s'applique. Donnez à chaque outil d'agent un rôle IAM restreint, pas un jeu large d'identifiants admin.

Mar 14, 2026 5 min

Quelqu'un a Enregistre antrophic.com et le Redirige Directement vers OpenAI

Voici le vrai domaine : anthropic.com. L'entreprise de sécurité IA derrière Claude, fondée par d'anciens chercheurs d'OpenAI, qui rend les systèmes d'IA sûrs.

Mar 11, 2026 4 min

Arrêtez le fine-tuning. Vous avez besoin de RAG, d'un cache et de meilleurs prompts

Fine-tuning et Provisioned Throughput coûtent cher pour la plupart des problèmes LLM. Le chemin moins cher : récupération, cache de prompt, meilleurs prompts.

Mar 09, 2026 5 min

Le découpage en chunks de la base de connaissances, c'est là que meurt la qualité de votre RAG

La plupart des mauvaises réponses RAG sont un problème de récupération, pas de modèle. Le découpage détermine la qualité des Bedrock Knowledge Bases.

Mar 05, 2026 6 min

Bedrock Guardrails ne vous protégera pas de l'injection de prompt

Amazon Bedrock Guardrails filtre le contenu, pas les actions. La défense contre l'injection de prompt : isolation des entrées, allowlists d'outils, scoping IAM.

Mar 03, 2026 6 min

Plus d'Ercan

Deux autres sites, même auteur, terrain différent.