2026年9月底,字节跳动Seed团队在arXiv发布论文,指出分块KV缓存压缩技术引发的‘相位敏感性’是DeepSeek-V4系列模型长上下文检索性能波动的主因。研究覆盖DeepSeek-V4-Flash、V4-Pro及V4.1-Flash等开源模型,发现因压缩窗口引入Token相位坐标,导致相同信息在不同相位下检索准确率差异高达40个百分点。该现象造成周期性性能衰减,易被平均基准分数掩盖。团队呼吁优化缓存压缩设计以提升长上下文稳定性。