用户反馈DeepSeek V4.1 Flash实测体验大幅下降
有用户在𝕏发文吐槽,DeepSeek V4.1 Flash疑似出现了严重降智,实际使用体验非常拉胯,尽管跑分榜单上它的表现依然亮眼,实际使用却又慢、又耗资源,还经常做无用功。
9月16日深夜DeepSeek官方API宕机了几个小时,之后有不少用户发现模型的推理和搜索能力突然下降,怀疑官方借宕机掩护,在深夜偷偷更换了模型检查点(checkpoint)。
用户总结了目前模型存在的几个核心问题:第一是Token效率彻底崩溃,原本五分钟就能完成的任务,现在需要三十分钟,消耗的Token是原来的十倍,最后结果还是错的。
第二个问题是,模型在100k上下文窗口中经常空转,迟迟不开始处理任务。第三个问题是简单任务也处理得异常低效,比如修改六行CSS代码要花两个小时,真正需要修改的部分反而被大量无效步骤淹没。
第四个问题是模型不擅长静态分析,反而偏好做大量不必要的页面操作,遇到安全类问题还会去密码库尝试常见密码,但这种越权尝试最终也无法得到有效结果。
最后用户总结,模型推理长度缩短,搜索能力下降,整体体验像是被悄悄降智了。很多人可能要半个月后才会反应过来,模型便宜、输出速度快不代表能完成实际工作。