字节发现 DeepSeek 隐藏 Bug,加点空格,模型翻车
DeepSeek 的省钱杀手锏,为何成了致命盲区? 作者丨高允毅 编辑丨岑 峰 同一个问题问 DeepSeek 两次,只是多敲了几个空格,给出的答案居然一个像“天才”,一个像“智障”。9月底,字节团队的最新论文《Periodic Weak Spots: Phase Sensitivity from Chunked KV-Cache Compression》,直接点名了 DeepSeek V4 系列模型的“神鬼二象性”问题。图注:论文链接 https://arxiv.org/pdf/2609.36322这本质上是底层算法偷懒导致的“周期性失忆”,分块 KV Cache 压缩技术把长上下文切块压缩处理,这就带来一个问题:“位置决定命运”。如果你的核心词不巧落在了切块交界的“信息盲区”里,那模型只能胡言乱语。想象一下,如果让大模型审阅几十页合同,而关键条款刚好卡在“信息盲区”,模型直接无视这条信
deepseek 大模型