0xLucifer.AI
Home
Posts
/dev/log
About
⌘K
×
标签: 分页
KV Cache 与 PagedAttention:推理的内存战争
Jun 29, 2026
为什么 KV Cache 是大模型推理的头号内存杀手?PagedAttention 如何用 OS 的分页思想解决——用广告正排索引的分层加载类比,彻底搞懂。