본문 바로가기
Y
S
영삼넷
youngsam.net
프로그램
기술노트
뉴스
사전
자료실
커뮤니티
명언
소개
TECH NOTES
기술노트
현장에서 검증된 개발 지식을 기록합니다.
전체
AI
Frontend
Backend
Database
Infra
Etc
전체
1
건
최신순
조회순
추천순
#GPU서빙 ✕
1
AI
5분 읽기
KV 캐시 — LLM이 토큰을 하나씩 뱉어도 빠른 이유
LLM이 긴 답변을 빠르게 만드는 비결인 KV 캐시의 원리와, 시퀀스·배치에 비례해 불어나는 메모리 부담, PagedAttention으로 낭비를 줄이는 법까지 정리했다.
#KV캐시
#LLM추론
#PagedAttention
2026.08.14