RAG가 “거의 맞는데” 마지막 10%가 안 오를 때: HyDE × Reranking × Query Expansion 실전 최적화 가이드 (2026년 6월) 2026-06-10 · AI / RAG
LLM 요청을 “안전하게” 비동기화하기: Celery + Redis queue/worker 아키텍처 심층 분석 (2026년 6월 기준) 2026-06-09 · Backend / Architecture
6월 2026 오픈소스 LLM/VLM 판도: Llama는 ‘멈춤’, Mistral은 ‘정리’, Qwen은 ‘가속’—그리고 라이선스가 승패를 가른다 2026-06-08 · AI / News