AI, LLMs, and applied ML.
Ercan ErmisによるAI、LLM、エージェント、応用機械学習に関するシニアエンジニアのフィールドノート。
All posts
モデルへの扉はひとつに。第2回 TerraformかBicepかARMか
Bicepにはstate fileがなく、Entra IDにも触れられない。第2回はゲートウェイのIaC層を選び、本番を勝手に更新するモデルバージョンの既定値を止める。
モデルへの扉はひとつに。第1回 意義編:なぜ中央LLMゲートウェイを建てるのか
ある企業が5つのGenAIアプリのコストを説明できずにいる。第1回はシナリオ、Azureでの自作か購入かの判断、そして本シリーズが築くゲートウェイの全体像を扱う。
オンコールをエージェントに。第8回 プロダクション:可観測性、評価、そして嘘をつく日
CloudWatchへのOTELトレース、S3へのBedrock呼び出しログ、ゴールデンインシデントセットのevalハーネス、そしてトリアージエージェントが自信満々に嘘をついた日。
Kiro、その後: AI IDEが実際に変えたもの
KiroのGAから8か月、生き残ったのはspecで、消えかけているのはIDEの方だ。変わったのはコードを書く主体ではなくレビューの場所だった。
なぜあなたのAIパイロットは調達プロセスで頓挫したのか
AIパイロットの多くは精度で失敗しない。セキュリティレビューやデータ処理契約で止まるのだ。その後に続く12週間を誰もスケジュールしていないからだ。
推論プロファイルによるアプリ単位のBedrockコスト追跡
アプリケーション推論プロファイルはBedrock呼び出しにコスト配分タグを付与し、共有された請求をチーム別の明細へと変える。難しいのはタグ設計の方だ。
オンコールをエージェントに。第7回 サイジング:誰も事前にやらないトークンの算数
誰も事前にやらないサイジングの算数。インシデントあたりのトークン、クォータの天井、Provisioned Throughputの損益分岐点、そして月額請求書を全部見せる。
EU AI Act、8月2日:動かなかった期限
Digital Omnibusは高リスク規制の期限を2027年と2028年に延期したが、Article 50の透明性義務は2026年8月2日のまま変わらず、多くのチームが直面するのはこちらだ。
SageMaker対Bedrock: 技術ではなく組織の意思決定
SageMakerかBedrockかという問いは、実際にはモデルを所有するチームが組織に存在するかどうかの問題だ。スライド上の組織ではなく実際のチーム構造に合わせて選ぶべきだ。
自社ドキュメント経由のプロンプトインジェクション: RAGの攻撃面
ナレッジベースは信頼できない入力源だ。検索は攻撃者が書いたテキストをそのままモデルに渡してしまうため、取り込み時点でのスキャンが最も有効な対策となる。
Ercan の他のサイト
同じ著者、別の領域のサイトが2つ。