AWS

Filed under

43 posts

Επιλέξτε Vector Database με Βάση το τι Σπάει Πρώτο

Σχεδόν κάθε σύστημα RAG πρέπει να ξεκινά με pgvector. Το χρήσιμο ερώτημα δεν είναι ποια vector database είναι ταχύτερη, αλλά ποια αστοχία σε βρίσκει πρώτη.

Jul 29, 2026 12 min

Agents on Call, Μέρος 8. Παραγωγή: Observability, Evals, και η Μέρα που Θα Πει Ψέματα

OTEL traces στο CloudWatch, Bedrock invocation logging σε S3, ένα eval harness με golden set περιστατικών, και η μέρα που ο triage agent είπε πειστικά ψέματα.

Jul 16, 2026 13 min

Το Kiro Μετά τον Θόρυβο: Τι Άλλαξαν Πραγματικά τα AI IDEs

Οκτώ μήνες μετά το GA του Kiro, το spec επέζησε, το IDE ως επί το πλείστον όχι. Αυτό που άλλαξε είναι πού γίνεται ο έλεγχος, όχι ποιος γράφει τον κώδικα.

Jul 15, 2026 6 min

Παρακολούθηση Κόστους Bedrock ανά Εφαρμογή με Inference Profiles

Τα inference profiles βάζουν ετικέτες κόστους στις κλήσεις Bedrock, μετατρέποντας τον λογαριασμό σε γραμμές ανά ομάδα. Ο σχεδιασμός ετικετών είναι δύσκολος.

Jul 10, 2026 6 min

Agents on Call, Μέρος 7. Διαστασιολόγηση: Τα Μαθηματικά των Tokens που Κανείς δεν Κάνει από Πριν

Τα μαθηματικά διαστασιολόγησης που όλοι αναβάλλουν: tokens ανά περιστατικό, όρια quotas, πότε συμφέρει το Provisioned Throughput, και ο μηνιαίος λογαριασμός.

Jul 09, 2026 14 min

EU AI Act, 2 Αυγούστου: Η Προθεσμία Που Δεν Μετακινήθηκε

Ο Digital Omnibus ανέβαλε τις προθεσμίες υψηλού κινδύνου. Η διαφάνεια του Άρθρου 50 ισχύει από 2 Αυγούστου 2026, και αυτή χτυπά τις περισσότερες ομάδες.

Jul 08, 2026 7 min

SageMaker εναντίον Bedrock: Μια Οργανωτική Απόφαση, Όχι Τεχνική

Το ερώτημα SageMaker ή Bedrock αφορά αν ο οργανισμός σου έχει ομάδα που κατέχει μοντέλα. Επίλεξε για την τοπολογία ομάδων που έχεις, όχι αυτήν της παρουσίασης.

Jul 06, 2026 6 min

Prompt Injection Μέσω των Δικών σου Εγγράφων: Η Επιφάνεια Επίθεσης του RAG

Η βάση γνώσης σου είναι μη έμπιστη είσοδος. Η ανάκτηση δίνει στο μοντέλο κείμενο του επιτιθέμενου, οπότε ο έλεγχος που αποδίδει είναι η σάρωση στην πρόσληψη.

Jul 04, 2026 7 min

Agents on Call, Μέρος 6. Guardrails: Το Κομμάτι που Όλοι Προσπερνούν

Πρώτα threat model, μετά guardrails: Bedrock Guardrails σε Terraform, γιατί το IAM σηκώνει ακόμα το βάρος, και οι αποτυχίες που κανείς δεν δείχνει σε demo.

Jul 02, 2026 15 min

AWS Μηνιαία Σύνοψη (Ιούνιος '26): Οι Agents Αποκτούν Feedback Loop

Ιούνιος 2026 στο AWS: το Summit στη Νέα Υόρκη μετέτρεψε τα production traces σε βελτίωση agents, κυκλοφόρησε το Continuum, και πήγε το AgentCore harness σε GA.

Jun 30, 2026 7 min

Agents on Call, Μέρος 5. Η Ομάδα: Supervisor και Τρεις Ειδικοί

Ένας supervisor αναθέτει σε triage, runbook και cost agents μέσω δικτύου, το AgentCore Memory δένει τα ευρήματά τους, και πότε ένας agent ακόμα αρκεί.

Jun 25, 2026 14 min

Η AWS Έφτιαξε ένα Sandbox για Κώδικα Παραγόμενο από AI: Lambda MicroVMs

Τα AWS Lambda MicroVMs δίνουν στους AI agents χώρο να εκτελούν κώδικα από μοντέλα, απομονωμένο σε επίπεδο VM. Το runtime ήταν το κομμάτι που έλειπε.

Jun 23, 2026 5 min

Το πραγματικό όριο του multi-agent συστήματός σας είναι τα tokens ανά λεπτό

Το Amazon Bedrock εκθέτει πλέον τα όρια tokens ανά λεπτό στο Service Quotas. Για agents, το TPM είναι το πραγματικό ταβάνι κλιμάκωσης. Σχεδιάστε το πριν τα 429.

Jun 21, 2026 6 min

Agents on Call, Μέρος 4. Εργαλεία και το Gateway: MCP, Allowlists, Read-Only ως προεπιλογή

Τα εργαλεία περνούν πίσω από το AgentCore Gateway: scoped Lambdas, cross-account read-only ρόλοι, και το ένα gated μονοπάτι που επιτρέπεται να αλλάξει κάτι.

Jun 18, 2026 16 min

Οι AI Coding Agents Χρειάζονται Κι Αυτοί Staging Environments

Οι ομάδες έδωσαν σε coding agents production credentials και το είπαν velocity. Ο agent χρειάζεται την ίδια κλίμακα περιβαλλόντων όπως κάθε νέος contributor.

Jun 12, 2026 6 min

Agents on Call, Μέρος 3. Πρώτος Agent: Incident Triage στο Strands

Ο πρώτος agent παραδίδεται: ένας triage agent Strands στο AgentCore Runtime, το system prompt του, δύο read-only εργαλεία, και το Terraform ανάπτυξης.

Jun 11, 2026 14 min

Το Claude Code στο CI: Αφήνοντας έναν Agent να Διορθώσει το Build

Το να τρέξεις έναν coding agent στο pipeline σου είναι εύκολο. Η μηχανική βρίσκεται στα guardrails: τι μπορεί να αγγίξει, πότε σταματά, ποιος κάνει review.

Jun 08, 2026 6 min

Agents on Call, Μέρος 2. Το θεμέλιο: Terraform πριν τα tokens

Πριν περάσει έστω ένα Bedrock token: ο λογαριασμός ops-tooling, οι δύο ρόλοι IAM, η πρόσβαση σε μοντέλα, και η απόφαση inference profile, όλα σε Terraform.

Jun 04, 2026 12 min

Το Context Window Δεν Είναι Φίλος Σου

Ένα τεράστιο context window δεν αντικαθιστά το retrieval. Η ανάκληση υποβαθμίζεται όσο μεγαλώνει το prompt, και το κόστος κλιμακώνεται με κάθε token.

Jun 03, 2026 6 min

AWS Μηνιαία Σύνοψη (Μάιος '26): Οι Agents Αποκτούν Πορτοφόλι

Μάιος 2026 στο AWS: το AgentCore Payments δίνει στους agents δυνατότητα συναλλαγής, και το Agent Toolkit for AWS συν GA MCP server ενισχύουν τα εργαλεία.

May 31, 2026 4 min

Agents on Call, Μέρος 1. Το σενάριο: Γιατί μια ομάδα Ops προσλαμβάνει agents

Μια μεσαίου μεγέθους SaaS πνίγεται στη δουλειά on-call και αποφασίζει να προσλάβει agents. Μέρος 1: το σενάριο, η επιλογή stack, η αρχιτεκτονική Bedrock.

May 28, 2026 14 min

Logging Prompts Χωρίς Logging PII

Χρειάζεσαι prompt logs για αποσφαλμάτωση εφαρμογής LLM αλλά δεν μπορείς να κρατάς ωμό PII. Redact πριν την αποθήκευση με Comprehend, μετά όρισε retention.

May 27, 2026 5 min

Όταν το Haiku Νικά το Opus: Model Right-Sizing στο Bedrock

Η προεπιλογή κάθε κλήσης στο Opus φουσκώνει τους λογαριασμούς LLM. Δρομολόγησε ανά κατηγορία εργασίας: Haiku για τη μηχανική πλειοψηφία, Opus για κλιμάκωση.

May 22, 2026 5 min

Το Agentic RAG Είναι Ως Επί Το Πλείστον Latency Που Δεν Χρειάζεσαι

Το agentic RAG κάνει loop μέσα από hops ανάκτησης, καθένα round trip μοντέλου. Συνήθως κερδίζει ένα καλό query. Χρησιμοποίησε loop μόνο όταν αξίζει το latency.

May 18, 2026 5 min

Evals Πριν τους Agents: Δεν Μπορείς να Κυκλοφορήσεις Ό,τι Δεν Μπορείς να Βαθμολογήσεις

Χωρίς eval harness, κάθε αλλαγή σε agent είναι απλή εντύπωση. Χτίσε τον πίνακα βαθμολογίας πρώτα και αντιμετώπισε τον LLM-as-judge ως κρίκο που λαθεύει.

May 14, 2026 5 min

Semantic Caching: Δύο Διαφορετικές Ερωτήσεις, Μία Απάντηση

Το semantic caching επιστρέφει μία αποθηκευμένη απάντηση σε δύο διαφορετικά διατυπωμένες ερωτήσεις. Μειώνει κόστος, αλλά ένα false hit δίνει λάθος απάντηση.

May 11, 2026 5 min

Το Step Functions Είναι ο Πιο Υποτιμημένος Orchestrator Agents

Οι περισσότερες ροές agent δεν χρειάζονται μοντέλο για τη ροή ελέγχου. Το Step Functions δίνει ντετερμινιστικό orchestration, retries και human-in-the-loop.

May 07, 2026 5 min

LLM Gateways: Γιατί Κάθε Ομάδα Πλατφόρμας Χτίζει Ένα Τελικά

Μια δεύτερη ομάδα που καλεί ένα μοντέλο σημαίνει ανεξέλεγκτο fan-out. Το LLM gateway συγκεντρώνει auth, quota, routing, audit. Build vs LiteLLM vs API Gateway.

May 04, 2026 5 min

AWS Μηνιαία (Απρ '26): Το OpenAI Προσγειώνεται στο Bedrock

Απρίλιος 2026 στο AWS: μοντέλα OpenAI, Codex και Managed Agents φτάνουν στο Bedrock. Το AgentCore προσθέτει harness και CLI για γρηγορότερο agent.

Apr 30, 2026 4 min

Cross-Region Inference: Φθηνή Ανθεκτικότητα ή Παγίδα Κατοικίας Δεδομένων;

Το Bedrock cross-region inference εξομαλύνει throughput, αλλά ένα global profile μπορεί να δρομολογήσει prompt εκτός γεωγραφίας. Πρόσεξε την κατοικία δεδομένων.

Apr 26, 2026 4 min

Ο Λογαριασμός LLM Σου Είναι Πρόβλημα Παρατηρησιμότητας

Ένας απροσδόκητος λογαριασμός Bedrock δεν είναι πρόβλημα τιμολόγησης, αλλά ορατότητας. Χωρίς απόδοση tokens σε feature, πελάτη ή agent, δεν το διαχειρίζεσαι.

Apr 21, 2026 5 min

Batch Inference στο Bedrock: Μισή Τιμή Αν Μπορείς να Περιμένεις

Το Amazon Bedrock batch inference τρέχει στο 50% της τιμής on-demand. Το μόνο κόστος είναι η καθυστέρηση, ιδανικό για εργασίες όπου κανείς δεν περιμένει.

Apr 17, 2026 4 min

Multi-Tenant Εφαρμογές LLM: Απομόνωση Πελατών σε Κοινό Μοντέλο

Ένα κοινό μοντέλο Bedrock, πολλοί πελάτες. Το μοντέλο είναι stateless, άρα η απομόνωση είναι δική σου δουλειά: ανάκτηση, όριο ποσόστωσης, ταυτότητα ανά πελάτη.

Apr 13, 2026 5 min

Η Μνήμη Agent Είναι Πρόβλημα Βάσης Δεδομένων, Όχι Πρόβλημα Prompt

Το να χώνεις όλο το ιστορικό ενός agent στο prompt δεν είναι μνήμη, είναι αυξανόμενος λογαριασμός. Η πραγματική μνήμη είναι βάση δεδομένων με ανάκτηση.

Apr 09, 2026 5 min

Το Structured Output Νικά το Έξυπνο Parsing

Ακόμα κάνεις regex-parsing JSON από κείμενο μοντέλου; Το Bedrock structured output επιβάλλει JSON Schema, η απάντηση είναι έγκυρη εξ ορισμού.

Apr 06, 2026 5 min

Prompt Caching στο Bedrock: Η Έκπτωση 90% που οι Περισσότερες Ομάδες Αγνοούν

Το prompt caching στο Bedrock διαβάζει πρόθεμα με περίπου 90% έκπτωση, αλλά η εγγραφή στην cache κοστίζει περισσότερο. Το breakpoint αποφασίζει τι θα πάρεις.

Apr 02, 2026 5 min

AWS Μηνιαία (Μαρ '26): Η Διακυβέρνηση Έρχεται για τους Agents

Μάρτιος 2026 στο AWS: το AgentCore Policy και τα Evaluations φτάνουν σε GA, το Elemental Inference κυκλοφορεί, η διακυβέρνηση agents περνά σε control plane.

Mar 31, 2026 4 min

Οι Streaming Απαντήσεις Είναι Απόφαση UX, Όχι Απόδοσης

Το streaming απαντήσεων είναι επιλογή UX για τον χρόνο πρώτου token, όχι διόρθωση ταχύτητας. Μπορεί να χειροτερέψει structured output και χρήση εργαλείων.

Mar 24, 2026 5 min

Bedrock Agents Έναντι της Δικής σου Loop

Τα Bedrock Agents χειρίζονται orchestration, μνήμη και κλήσεις εργαλείων για σένα. Πότε το managed framework γλιτώνει δουλειά και πότε σιωπηλά σε κατέχει.

Mar 18, 2026 5 min

IAM για Εφαρμογές LLM: Ελάχιστο Προνόμιο Όταν ο Καλών Είναι Μοντέλο

Όταν ο καλών είναι μοντέλο, το ελάχιστο προνόμιο ισχύει ακόμα. Δώσε σε κάθε εργαλείο agent περιορισμένο ρόλο IAM, όχι ευρύ σύνολο διαπιστευτηρίων admin.

Mar 14, 2026 4 min

Σταμάτα το Fine-Tuning. Χρειάζεσαι RAG, Cache και Καλύτερα Prompts

Το fine-tuning με provisioned throughput είναι η ακριβή απάντηση σε προβλήματα LLM. Ο φθηνότερος δρόμος: retrieval, prompt caching και καλύτερα prompts.

Mar 09, 2026 5 min

Το Chunking της Knowledge Base Είναι Εκεί Που Πεθαίνει η Ποιότητα του RAG Σου

Οι περισσότερες κακές απαντήσεις RAG είναι πρόβλημα ανάκτησης, όχι μοντέλου. Το fixed, semantic και hierarchical chunking καθορίζουν την ποιότητά σου.

Mar 05, 2026 5 min

Τα Bedrock Guardrails Δεν Θα Σε Σώσουν Από το Prompt Injection

Τα Bedrock Guardrails φιλτράρουν περιεχόμενο, όχι ενέργειες. Η άμυνα στο prompt injection είναι απομόνωση εισόδου, allowlist εργαλείων και IAM scoping.

Mar 03, 2026 5 min