AI, LLMs, and applied ML.
Notes de terrain d'un ingénieur senior sur l'IA, les LLMs, les agents et l'apprentissage automatique appliqué par Ercan Ermis.
All posts
La sortie structurée bat le parsing astucieux
Vous parsez encore du JSON dans du texte modèle avec des regex ? Les sorties structurées Bedrock imposent un JSON Schema : réponse valide par construction.
Le Prompt Caching sur Bedrock : la remise de 90 % que la plupart des équipes ignorent
Le prompt caching Bedrock lit un préfixe répété à 90 % de réduction, mais une écriture en cache coûte plus cher qu'un appel sans cache. Le breakpoint décide.
AWS Monthly (mars 26) : la gouvernance rattrape les agents
Mars 2026 sur AWS : AgentCore Policy et Evaluations en disponibilité générale, Elemental Inference lancé, gouvernance d'agents en plan de contrôle production.
Le streaming des réponses est une décision d'UX, pas de performance
Diffuser les réponses en streaming est un choix UX sur le temps jusqu'au premier token, pas un correctif de vitesse. Cela peut dégrader la sortie structurée.
Bedrock Agents contre votre propre boucle maison
Amazon Bedrock Agents gère l'orchestration, la mémoire et les appels d'outils. Voici quand ce framework managé fait gagner du temps, et quand il vous limite.
IAM pour les applications LLM : le moindre privilège quand l'appelant est un modèle
Quand l'appelant est un modèle, le moindre privilège s'applique. Donnez à chaque outil d'agent un rôle IAM restreint, pas un jeu large d'identifiants admin.
Quelqu'un a Enregistre antrophic.com et le Redirige Directement vers OpenAI
Voici le vrai domaine : anthropic.com. L'entreprise de sécurité IA derrière Claude, fondée par d'anciens chercheurs d'OpenAI, qui rend les systèmes d'IA sûrs.
Arrêtez le fine-tuning. Vous avez besoin de RAG, d'un cache et de meilleurs prompts
Fine-tuning et Provisioned Throughput coûtent cher pour la plupart des problèmes LLM. Le chemin moins cher : récupération, cache de prompt, meilleurs prompts.
Le découpage en chunks de la base de connaissances, c'est là que meurt la qualité de votre RAG
La plupart des mauvaises réponses RAG sont un problème de récupération, pas de modèle. Le découpage détermine la qualité des Bedrock Knowledge Bases.
Bedrock Guardrails ne vous protégera pas de l'injection de prompt
Amazon Bedrock Guardrails filtre le contenu, pas les actions. La défense contre l'injection de prompt : isolation des entrées, allowlists d'outils, scoping IAM.
Plus d'Ercan
Deux autres sites, même auteur, terrain différent.
Cloud, AWS, EKS, Terraform, plateforme.
Notes de terrain de systèmes de production. EKS, IAM, Terraform à l'échelle organisation, observabilité, optimisation des coûts.
Visiter ercan.cloud →Le hub. À propos, conseil, contact.
Hub personnel pour les deux pistes d'écriture. Qui je suis, comment fonctionne le conseil, comment me joindre.
Visiter ercanermis.com →