AI圈报
模型发布 / 更新普通

Prefill、KV cache 与 Prefix caching 三概念解析

信息来源:X:马东锡 NLP (@dongxi_nlp)·
原始标题:三个重要的概念, Prefill, KV cache, Prefix caching 例如,在文档+LLM 的办公场景: A: 文档 +"帮我看看,有哪些风险?" B: 文档+"预算减半,帮我调整…

内容摘要

马东锡 NLP 用文档+LLM 办公场景解释三个概念:Prefill 处理 input,KV cache 保存计算得到的 K/V 供后续生成使用,Prefix caching 在输入变化时只能复用首次 token 变化之前的共同 prefix。以 A、B、C 三轮文档问答为例,C 的输入方案已改变,因此无法完整复用前序缓存。
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:马东锡 NLP (@dongxi_nlp)
站内情报编号intel-07480c8432da76159988c885