AI, LLMs, and applied ML.

Σημειώσεις πεδίου ανώτερου μηχανικού για AI, LLMs, πράκτορες και εφαρμοσμένη μηχανική μάθηση από τον Ercan Ermis.

All posts

66 posts

Το Structured Output Νικά το Έξυπνο Parsing

Ακόμα κάνεις regex-parsing JSON από κείμενο μοντέλου; Το Bedrock structured output επιβάλλει JSON Schema, η απάντηση είναι έγκυρη εξ ορισμού.

Apr 06, 2026 5 min

Prompt Caching στο Bedrock: Η Έκπτωση 90% που οι Περισσότερες Ομάδες Αγνοούν

Το prompt caching στο Bedrock διαβάζει πρόθεμα με περίπου 90% έκπτωση, αλλά η εγγραφή στην cache κοστίζει περισσότερο. Το breakpoint αποφασίζει τι θα πάρεις.

Apr 02, 2026 5 min

AWS Μηνιαία (Μαρ '26): Η Διακυβέρνηση Έρχεται για τους Agents

Μάρτιος 2026 στο AWS: το AgentCore Policy και τα Evaluations φτάνουν σε GA, το Elemental Inference κυκλοφορεί, η διακυβέρνηση agents περνά σε control plane.

Mar 31, 2026 4 min

Οι Streaming Απαντήσεις Είναι Απόφαση UX, Όχι Απόδοσης

Το streaming απαντήσεων είναι επιλογή UX για τον χρόνο πρώτου token, όχι διόρθωση ταχύτητας. Μπορεί να χειροτερέψει structured output και χρήση εργαλείων.

Mar 24, 2026 5 min

Bedrock Agents Έναντι της Δικής σου Loop

Τα Bedrock Agents χειρίζονται orchestration, μνήμη και κλήσεις εργαλείων για σένα. Πότε το managed framework γλιτώνει δουλειά και πότε σιωπηλά σε κατέχει.

Mar 18, 2026 5 min

IAM για Εφαρμογές LLM: Ελάχιστο Προνόμιο Όταν ο Καλών Είναι Μοντέλο

Όταν ο καλών είναι μοντέλο, το ελάχιστο προνόμιο ισχύει ακόμα. Δώσε σε κάθε εργαλείο agent περιορισμένο ρόλο IAM, όχι ευρύ σύνολο διαπιστευτηρίων admin.

Mar 14, 2026 4 min

Κάποιος Κατοχύρωσε το antrophic.com και το Στρέφει Κατευθείαν στο OpenAI

Το domain είναι anthropic.com. Η εταιρεία AI safety πίσω από το Claude, ιδρυμένη από πρώην ερευνητές OpenAI, δουλεύει για ασφαλή και ερμηνεύσιμα AI συστήματα.

Mar 11, 2026 4 min

Σταμάτα το Fine-Tuning. Χρειάζεσαι RAG, Cache και Καλύτερα Prompts

Το fine-tuning με provisioned throughput είναι η ακριβή απάντηση σε προβλήματα LLM. Ο φθηνότερος δρόμος: retrieval, prompt caching και καλύτερα prompts.

Mar 09, 2026 5 min

Το Chunking της Knowledge Base Είναι Εκεί Που Πεθαίνει η Ποιότητα του RAG Σου

Οι περισσότερες κακές απαντήσεις RAG είναι πρόβλημα ανάκτησης, όχι μοντέλου. Το fixed, semantic και hierarchical chunking καθορίζουν την ποιότητά σου.

Mar 05, 2026 5 min

Τα Bedrock Guardrails Δεν Θα Σε Σώσουν Από το Prompt Injection

Τα Bedrock Guardrails φιλτράρουν περιεχόμενο, όχι ενέργειες. Η άμυνα στο prompt injection είναι απομόνωση εισόδου, allowlist εργαλείων και IAM scoping.

Mar 03, 2026 5 min

Περισσότερα από τον Ercan

Δύο ακόμη ιστότοποι, ίδιος συγγραφέας, διαφορετικό έδαφος.