幻兹快讯
DeepSeek“抽风”原因曝光
幻兹快讯
2026年10月09日
阅读 13 次

今年9月底,字节Seed团队在arXiv提交论文揭示DeepSeek“抽风”原因。研究发现,模型采用分块KV缓存压缩虽能减少内存成本,但引入了“相位敏感性”,导致相同信息在不同阶段检索难度不一。在采用此类压缩的大型模型中,长上下文检索准确度各阶段间相差高达40个百分点。

Copyright © 幻兹网 All Rights Reserved粤ICP备2026034579号粤公网安备44030002012995号
☰