AI, LLMs, and applied ML.

Feldnotizen eines Senior-Ingenieurs zu KI, LLMs, Agenten und angewandtem maschinellem Lernen von Ercan Ermis.

All posts

66 posts

Structured Output schlägt cleveres Parsing

Noch immer JSON per Regex aus Modelltext parsen? Bedrock Structured Outputs erzwingen ein JSON Schema beim Decoding, die Antwort ist automatisch gültig.

Apr 06, 2026 4 min

Prompt Caching auf Bedrock: Der 90-Prozent-Rabatt, den die meisten Teams ignorieren

Bedrock Prompt Caching liest ein wiederholtes Präfix mit 90 Prozent Rabatt, aber ein Cache-Write kostet mehr als gar kein Caching. Der Breakpoint entscheidet.

Apr 02, 2026 5 min

AWS Monthly (Mar '26): Governance holt die Agenten ein

März 2026 auf AWS: AgentCore Policy und Evaluations erreichen GA, Elemental Inference launcht, Agenten-Governance wird zur Produktions-Kontrollebene.

Mar 31, 2026 4 min

Streaming-Antworten sind eine UX-Entscheidung, keine Performance-Entscheidung

Streaming ist eine UX-Entscheidung über Time to First Token, kein Geschwindigkeits-Fix. Es kann strukturierte Ausgabe und Tool-Use sogar verschlechtern.

Mar 24, 2026 4 min

Bedrock Agents vs. die eigene Loop bauen

Amazon Bedrock Agents übernimmt Orchestrierung, Memory und Tool-Aufrufe. Wann das Managed Framework echte Arbeit spart und wann es dich still übernimmt.

Mar 18, 2026 4 min

IAM für LLM-Apps: Least Privilege, wenn der Aufrufer ein Modell ist

Ist der Aufrufer ein Modell, gilt Least Privilege trotzdem. Jedes Agenten-Tool braucht eine enge IAM-Rolle und Session Policy, keine breiten Admin-Credentials.

Mar 14, 2026 4 min

Jemand hat antrophic.com registriert und leitet es direkt zu OpenAI weiter

Hier ist die echte Domain: anthropic.com. Das KI-Sicherheitsunternehmen hinter Claude, gegründet von Ex-OpenAI-Forschern, mit wichtiger Arbeit an KI-Sicherheit.

Mar 11, 2026 4 min

Hör auf mit Fine-Tuning. Du brauchst RAG, einen Cache und bessere Prompts

Fine-Tuning plus Provisioned Throughput ist die teure Antwort auf die meisten LLM-Probleme. Günstiger sind Retrieval, Prompt Caching und bessere Prompts.

Mar 09, 2026 4 min

Knowledge-Base-Chunking ist der Ort, an dem deine RAG-Qualität stirbt

Schlechte RAG-Antworten sind meist ein Retrieval-, kein Modellproblem. Fixed-, Semantic- und Hierarchical-Chunking in Knowledge Bases legen die Qualität fest.

Mar 05, 2026 5 min

Bedrock Guardrails schützt nicht vor Prompt Injection

Amazon Bedrock Guardrails filtert Inhalte, autorisiert keine Aktionen. Schutz vor Prompt Injection braucht Input-Isolation, Tool-Allowlists und IAM-Scoping.

Mar 03, 2026 5 min

Weiteres von Ercan

Zwei weitere Seiten, gleicher Autor, anderes Terrain.