250ms 안에 “말 끊고-대답하는” 2026 실시간 Voice Agent 아키텍처: Realtime API vs Streaming STT→LLM→TTS, 무엇을 언제 쓰나 2026-07-07 · AI / Multimodal
**서버리스 챗봇은 끝났다: 2026년 7월, “Stateful Agent + Control/Data Plane 분리”로 가는 AI 앱 아키텍처 패턴 지도** 2026-07-05 · Backend / Architecture
2026년 7월, Kubernetes에서 LLM 서빙을 “GPU 오토스케일”로 굴리는 현실적인 방법: KEDA + (Queue Depth / KV Cache) + DCGM/NVML 2026-07-03 · Infra / Kubernetes