AI, LLMs, and applied ML.

Notas de campo de um engenheiro sênior sobre IA, LLMs, agentes e aprendizado de máquina aplicado por Ercan Ermis.

All posts

66 posts

Saída Estruturada Vence o Parsing Esperto

Ainda extrai JSON do texto do modelo com regex? Pare. Saídas estruturadas do Bedrock aplicam um JSON Schema na decodificação, então a resposta já nasce válida.

Apr 06, 2026 5 min

Cache de Prompt no Bedrock: O Desconto de 90% Que a Maioria dos Times Ignora

O cache de prompt do Bedrock lê um prefixo repetido com cerca de 90% de desconto, mas escrever no cache custa mais. O breakpoint decide o resultado.

Apr 02, 2026 5 min

AWS Mensal (Mar '26): A Governança Chega para os Agentes

Março de 2026 na AWS: AgentCore Policy e Evaluations chegam ao GA, o Elemental Inference é lançado, e a governança de agentes vira control plane de produção.

Mar 31, 2026 4 min

Respostas em Streaming São uma Decisão de UX, Não de Performance

Streaming de respostas é uma escolha de UX sobre time to first token, não correção de velocidade. Às vezes piora output estruturado e uso de ferramentas.

Mar 24, 2026 5 min

Bedrock Agents vs Construir Seu Próprio Loop

Bedrock Agents cuida de orquestração, memória e chamadas de ferramenta por você. Veja quando o framework gerenciado poupa trabalho e quando ele te domina.

Mar 18, 2026 5 min

IAM para Aplicações de LLM: Least Privilege Quando Quem Chama É um Modelo

Quando quem chama é um modelo, least privilege continua valendo. Dê a cada ferramenta um papel de IAM delimitado e session policy, não credenciais admin amplas.

Mar 14, 2026 5 min

Alguem Registrou antrophic.com e Redireciona Direto para OpenAI

Um dominio com erro de digitacao, antrophic.com, existe e redireciona direto para openai.com. O dominio real da empresa por tras do Claude e anthropic.com.

Mar 11, 2026 4 min

Pare de Fazer Fine-Tuning. Você Precisa de RAG, Cache e Prompts Melhores

Fine-tuning mais provisioned throughput é a resposta cara para a maioria dos problemas de LLM. O caminho barato é retrieval, prompt caching e prompts melhores.

Mar 09, 2026 5 min

O Chunking da Knowledge Base É Onde a Qualidade do Seu RAG Morre

A maioria das respostas ruins de RAG é problema de retrieval, não de modelo. Chunking fixo, semântico ou hierárquico nas Knowledge Bases define a qualidade.

Mar 05, 2026 5 min

Bedrock Guardrails Não Vai Te Salvar de Prompt Injection

Amazon Bedrock Guardrails filtra conteúdo, não autoriza ações. A defesa contra prompt injection é isolar input, allowlist de ferramentas e escopo de IAM.

Mar 03, 2026 6 min

Mais de Ercan

Mais dois sites, mesmo autor, terreno diferente.