🛰️ Daily AI Frontier
‹ back to 2026-07-24

Error Certificates for KV-Cache Eviction via Randomized Design

Research Efficiency & Systems

Ranking

Overall 83
Content 100
Popularity 42

Observed public metrics from 1 member.

Merged summary

TL;DR - This paper introduces randomized KV-cache eviction that enables serving-time error certificates. The certificates help attribute failures to cache eviction and schedule recomputation, but do not reliably predict failures or improve budget escalation.

  • Deterministic top-k eviction cannot consistently estimate attention-output error because discarded values are unidentifiable.
  • Poisson sampling with known inclusion probabilities enables a Hájek softmax correction and retained-set variance estimator.
  • The per-step certificate achieved 0.97 empirical coverage without accuracy loss.
  • Certificates distinguished cache-induced failures (AUC 0.73–0.75) better than output confidence, but output log-probability better predicted overall failure.

Sources (1)

Error Certificates for KV-Cache Eviction via Randomized Design

arXiv cs.LG Peng Xie 2026-07-23 arXiv:2607.21475
Public signals Semantic Scholar citations 0 · Semantic Scholar influential citations 0
Providers: Hugging Face · N/A OpenAlex · N/A Publisher · N/A Semantic Scholar · Citations 0 · Influential citations 0 X · N/A Fetched 2026-08-10 02:54:08.967452 UTC

TL;DR - This paper introduces randomized KV-cache eviction that enables serving-time error certificates. The certificates help attribute failures to cache eviction and schedule recomputation, but do not reliably predict failures or improve budget escalation.

  • Deterministic top-k eviction cannot consistently estimate attention-output error because discarded values are unidentifiable.
  • Poisson sampling with known inclusion probabilities enables a Hájek softmax correction and retained-set variance estimator.
  • The per-step certificate achieved 0.97 empirical coverage without accuracy loss.
  • Certificates distinguished cache-induced failures (AUC 0.73–0.75) better than output confidence, but output log-probability better predicted overall failure.
item →