エントリー済み

GKEでつくるAgent Platformのアーキテクチャと、OpenTelemetryによる可観測性設計

中級者 Architecture Design

AIエージェントを本番でどう安全に動かすかが、基盤の新しい課題です。エージェントはマイクロサービスでもバッチでもない"第三のワークロード"です。信頼できない生成コードを実行し、状態を持ち、放置すればループでコストを溶かします。本セッションではこの事故を検証環境で意図的に再現し、なぜ構造的に起きるのかを示した上で、基盤の設計領域を「実行隔離・権限・ネットワーク境界・状態・可観測性と継続的評価」の5つに整理し、2つを深掘りします。(1)実行隔離: Agent Sandbox(gVisor)とwarm pool前後の起動レイテンシ実測。(2)可観測性と継続的評価: OpenTelemetryのGenAI規約による計装、暴走を検知して止めるシグナル設計、本番会話からライブ評価データを作りLLM-as-a-Judgeで「ユーザーの不満」を採点するダッシュボード設計まで。GKEは実装例、土台はコミュニティ標準です。対象はエージェントのPoCを本番基盤に育てたいプラットフォームエンジニア/SRE。5領域の設計チェックリスト、隔離と暴走対策の実測データ、継続的評価ループの設計パターンを持ち帰れます

Speaker

Tayzar

グーグル・クラウド・ジャパン合同会社

アプリケーション モダナイゼーション スペシャリスト

グーグル・クラウドにて、アプリケーション・モダナイゼーション・スペシャリストとして Cloud Run や GKE を中心としたプリセルに従事。前職では、LINEメッセージアプリのソフトウェア エンジニアとして数億人が利用する大規模システムの開発や、生成AI向けの RAG ベクトルデータベース構築を牽引。現在はその開発経験を活かし、エンタープライズ企業に対して Agentic AI を活用したアーキテクチャ設計やクラウド ネイティブ開発を推進し、最新技術のビジネス導入を支援している。