LLM 프롬프트 캐싱 개념 정리 (Prompt Caching)

같은 프롬프트를 매번 다시 처리하지 않도록 캐시하는 프롬프트 캐싱의 전략과 동작 원리, 비용 구조를 정리했다.

2026년 7월 20일

Teams 알람 기반 RCA 멀티 에이전트 설계

Teams 알람에 봇을 멘션하면 전문 에이전트들이 원인을 분석해 응답하는 RCA 워크플로우 설계.

2026년 6월 8일

DevOps 운영에 LLM을 붙일 때 2단계 구조를 고민한 이유

운영 로그 분석에 LLM을 붙일 때 비용과 정확도를 같이 잡기 위한 2단계 구조를 구상했다.

2026년 6월 5일

전사 MCP를 만들 때 가장 어려운 건 '권한'이었다

사내 Atlassian을 MCP로 열면서 사용자별 권한을 그대로 지키는 전사 모델을 설계했다.

2026년 4월 20일

MCP 서버 부하 테스트: nginx 요청 한도와 base64 오버헤드

MCP 서버의 쓰기·읽기 도구 한도를 부하 테스트로 측정하며 만난 nginx body limit과 base64 33% 팽창 문제를 정리했다.

2026년 4월 9일

Claude·Codex·Gemini 멀티 에이전트 오케스트레이터 구현

CLI 코딩 에이전트 세 개를 역할별로 나눠 한 팀처럼 구성해 봤다. 워크트리 격리와 세션 복구까지 함께 정리했다.

2026년 4월 8일

Teams AI 어시스턴트 구축: n8n·RAG·멀티 에이전트

사내 Teams AI 어시스턴트를 n8n·RAG·멀티 에이전트로 일주일에 구축한 기록이다.

2026년 2월 11일

Azure AI Foundry 앞단에 사내 LLM Gateway 구축

Gemini에서 Foundry로 옮기며 앞단 게이트웨이가 없어 사내 LLM 게이트웨이를 직접 만든 과정을 정리했다.

2025년 9월 30일