今年9月底,字节Seed团队在arXiv提交论文揭示DeepSeek“抽风”原因。研究发现,模型采用分块KV缓存压缩虽能减少内存成本,但引入了“相位敏感性”,导致相同信息在不同阶段检索难度不一。在采用此类压缩的大型模型中,长上下文检索准确度各阶段间相差高达40个百分点。