GPU HBM의 KV cache가 CXL 메모리로 offload되고, 여러 서버의 메모리 pooling과 메모리 tiering으로 이어지는 모습

AI 시대의 필수 소비재, 메모리 이해하기 5편: CXL Workload 알아보기

KV cache offload, 메모리 풀링, 메모리 tiering을 통해 CXL이 실제 워크로드에서 어떻게 쓰이는지 살펴봅니다.

8월 12, 2026 · 8 분 · 1691 단어