AI, LLMs, and applied ML.
Note sul campo di un ingegnere senior su IA, LLM, agenti e apprendimento automatico applicato di Ercan Ermis.
All posts
L'output strutturato batte il parsing ingegnoso
Estrai ancora JSON dal testo del modello con una regex? Smetti. Gli structured output di Bedrock impongono uno JSON Schema in decodifica: risposta valida.
Prompt Caching su Bedrock: lo sconto del 90% che quasi tutti ignorano
Il prompt caching di Bedrock legge un prefisso ripetuto con uno sconto del 90%, ma scrivere in cache costa più di una chiamata normale: decide il breakpoint.
AWS Mensile (Mar '26): La Governance Arriva per gli Agenti
Marzo 2026 su AWS: AgentCore Policy ed Evaluations raggiungono la GA, Elemental Inference viene lanciato, e la governance degli agenti arriva in produzione.
Le Risposte in Streaming Sono una Decisione UX, Non di Performance
Lo streaming delle risposte è una scelta UX sul time to first token, non una correzione di velocità. A volte peggiora output strutturati e uso dei tool.
Bedrock Agents vs Costruire il Proprio Loop
Amazon Bedrock Agents gestisce orchestrazione, memoria e chiamate ai tool per te. Quando il framework gestito risparmia lavoro vero e quando ti possiede.
IAM per App LLM: Least Privilege Quando il Chiamante È un Modello
Quando il chiamante è un modello, il least privilege si applica ancora. Dai a ogni tool dell'agente un ruolo IAM ristretto, non credenziali admin ampie.
Qualcuno ha Registrato antrophic.com e lo Punta Direttamente a OpenAI
Ecco il dominio vero: anthropic.com, l'azienda di AI safety dietro Claude, fondata da ex ricercatori OpenAI, che rende i sistemi AI sicuri e interpretabili.
Smetti di Fare Fine-Tuning. Ti Servono RAG, una Cache e Prompt Migliori
Fine-tuning più provisioned throughput è la risposta costosa ai problemi con gli LLM. Il percorso economico è retrieval, prompt caching e prompt migliori.
Il Chunking della Knowledge Base È Dove Muore la Qualità del Tuo RAG
La maggior parte delle risposte RAG sbagliate è un problema di retrieval, non del modello. Il chunking nelle Knowledge Bases decide la qualità del retrieval.
Bedrock Guardrails Non Ti Salva Dal Prompt Injection
Amazon Bedrock Guardrails filtra i contenuti, non autorizza azioni: la difesa reale dal prompt injection è isolamento input, allowlist tool e scoping IAM.
Altro da Ercan
Altri due siti, stesso autore, terreno diverso.
Cloud, AWS, EKS, Terraform, platform engineering.
Note sul campo da sistemi in produzione. EKS, IAM, Terraform su scala organizzativa, observability, ottimizzazione dei costi.
Visita ercan.cloud →L'hub. Chi sono, consulenza, contatti.
Hub personale per entrambe le tracce di scrittura. Chi sono, come funziona la consulenza, come contattarmi.
Visita ercanermis.com →