AI, LLMs, and applied ML.
Feldnotizen eines Senior-Ingenieurs zu KI, LLMs, Agenten und angewandtem maschinellem Lernen von Ercan Ermis.
All posts
Structured Output schlägt cleveres Parsing
Noch immer JSON per Regex aus Modelltext parsen? Bedrock Structured Outputs erzwingen ein JSON Schema beim Decoding, die Antwort ist automatisch gültig.
Prompt Caching auf Bedrock: Der 90-Prozent-Rabatt, den die meisten Teams ignorieren
Bedrock Prompt Caching liest ein wiederholtes Präfix mit 90 Prozent Rabatt, aber ein Cache-Write kostet mehr als gar kein Caching. Der Breakpoint entscheidet.
AWS Monthly (Mar '26): Governance holt die Agenten ein
März 2026 auf AWS: AgentCore Policy und Evaluations erreichen GA, Elemental Inference launcht, Agenten-Governance wird zur Produktions-Kontrollebene.
Streaming-Antworten sind eine UX-Entscheidung, keine Performance-Entscheidung
Streaming ist eine UX-Entscheidung über Time to First Token, kein Geschwindigkeits-Fix. Es kann strukturierte Ausgabe und Tool-Use sogar verschlechtern.
Bedrock Agents vs. die eigene Loop bauen
Amazon Bedrock Agents übernimmt Orchestrierung, Memory und Tool-Aufrufe. Wann das Managed Framework echte Arbeit spart und wann es dich still übernimmt.
IAM für LLM-Apps: Least Privilege, wenn der Aufrufer ein Modell ist
Ist der Aufrufer ein Modell, gilt Least Privilege trotzdem. Jedes Agenten-Tool braucht eine enge IAM-Rolle und Session Policy, keine breiten Admin-Credentials.
Jemand hat antrophic.com registriert und leitet es direkt zu OpenAI weiter
Hier ist die echte Domain: anthropic.com. Das KI-Sicherheitsunternehmen hinter Claude, gegründet von Ex-OpenAI-Forschern, mit wichtiger Arbeit an KI-Sicherheit.
Hör auf mit Fine-Tuning. Du brauchst RAG, einen Cache und bessere Prompts
Fine-Tuning plus Provisioned Throughput ist die teure Antwort auf die meisten LLM-Probleme. Günstiger sind Retrieval, Prompt Caching und bessere Prompts.
Knowledge-Base-Chunking ist der Ort, an dem deine RAG-Qualität stirbt
Schlechte RAG-Antworten sind meist ein Retrieval-, kein Modellproblem. Fixed-, Semantic- und Hierarchical-Chunking in Knowledge Bases legen die Qualität fest.
Bedrock Guardrails schützt nicht vor Prompt Injection
Amazon Bedrock Guardrails filtert Inhalte, autorisiert keine Aktionen. Schutz vor Prompt Injection braucht Input-Isolation, Tool-Allowlists und IAM-Scoping.
Weiteres von Ercan
Zwei weitere Seiten, gleicher Autor, anderes Terrain.
Cloud, AWS, EKS, Terraform, Platform Engineering.
Praxisnotizen aus Produktionssystemen. EKS, IAM, Terraform im Organisationsmaßstab, Observability, Kostenoptimierung.
Besuchen ercan.cloud →Die Drehscheibe. Über mich, Beratung, Kontakt.
Persönliche Drehscheibe für beide Schreibspuren. Wer ich bin, wie die Beratung funktioniert, wie Sie mich erreichen.
Besuchen ercanermis.com →