AI, LLMs, and applied ML.

Note sul campo di un ingegnere senior su IA, LLM, agenti e apprendimento automatico applicato di Ercan Ermis.

All posts

66 posts

L'output strutturato batte il parsing ingegnoso

Estrai ancora JSON dal testo del modello con una regex? Smetti. Gli structured output di Bedrock impongono uno JSON Schema in decodifica: risposta valida.

Apr 06, 2026 5 min

Prompt Caching su Bedrock: lo sconto del 90% che quasi tutti ignorano

Il prompt caching di Bedrock legge un prefisso ripetuto con uno sconto del 90%, ma scrivere in cache costa più di una chiamata normale: decide il breakpoint.

Apr 02, 2026 5 min

AWS Mensile (Mar '26): La Governance Arriva per gli Agenti

Marzo 2026 su AWS: AgentCore Policy ed Evaluations raggiungono la GA, Elemental Inference viene lanciato, e la governance degli agenti arriva in produzione.

Mar 31, 2026 4 min

Le Risposte in Streaming Sono una Decisione UX, Non di Performance

Lo streaming delle risposte è una scelta UX sul time to first token, non una correzione di velocità. A volte peggiora output strutturati e uso dei tool.

Mar 24, 2026 5 min

Bedrock Agents vs Costruire il Proprio Loop

Amazon Bedrock Agents gestisce orchestrazione, memoria e chiamate ai tool per te. Quando il framework gestito risparmia lavoro vero e quando ti possiede.

Mar 18, 2026 5 min

IAM per App LLM: Least Privilege Quando il Chiamante È un Modello

Quando il chiamante è un modello, il least privilege si applica ancora. Dai a ogni tool dell'agente un ruolo IAM ristretto, non credenziali admin ampie.

Mar 14, 2026 4 min

Qualcuno ha Registrato antrophic.com e lo Punta Direttamente a OpenAI

Ecco il dominio vero: anthropic.com, l'azienda di AI safety dietro Claude, fondata da ex ricercatori OpenAI, che rende i sistemi AI sicuri e interpretabili.

Mar 11, 2026 4 min

Smetti di Fare Fine-Tuning. Ti Servono RAG, una Cache e Prompt Migliori

Fine-tuning più provisioned throughput è la risposta costosa ai problemi con gli LLM. Il percorso economico è retrieval, prompt caching e prompt migliori.

Mar 09, 2026 5 min

Il Chunking della Knowledge Base È Dove Muore la Qualità del Tuo RAG

La maggior parte delle risposte RAG sbagliate è un problema di retrieval, non del modello. Il chunking nelle Knowledge Bases decide la qualità del retrieval.

Mar 05, 2026 5 min

Bedrock Guardrails Non Ti Salva Dal Prompt Injection

Amazon Bedrock Guardrails filtra i contenuti, non autorizza azioni: la difesa reale dal prompt injection è isolamento input, allowlist tool e scoping IAM.

Mar 03, 2026 5 min

Altro da Ercan

Altri due siti, stesso autore, terreno diverso.