AI Pulse
📡 X 信号

用户反馈DeepSeek V4.1 Flash实测体验大幅下降

用户反馈DeepSeek V4.1 Flash实测体验大幅下降

有用户在𝕏发文吐槽,DeepSeek V4.1 Flash疑似出现了严重降智,实际使用体验非常拉胯,尽管跑分榜单上它的表现依然亮眼,实际使用却又慢、又耗资源,还经常做无用功。

9月16日深夜DeepSeek官方API宕机了几个小时,之后有不少用户发现模型的推理和搜索能力突然下降,怀疑官方借宕机掩护,在深夜偷偷更换了模型检查点(checkpoint)。

用户总结了目前模型存在的几个核心问题:第一是Token效率彻底崩溃,原本五分钟就能完成的任务,现在需要三十分钟,消耗的Token是原来的十倍,最后结果还是错的。

第二个问题是,模型在100k上下文窗口中经常空转,迟迟不开始处理任务。第三个问题是简单任务也处理得异常低效,比如修改六行CSS代码要花两个小时,真正需要修改的部分反而被大量无效步骤淹没。

第四个问题是模型不擅长静态分析,反而偏好做大量不必要的页面操作,遇到安全类问题还会去密码库尝试常见密码,但这种越权尝试最终也无法得到有效结果。

最后用户总结,模型推理长度缩短,搜索能力下降,整体体验像是被悄悄降智了。很多人可能要半个月后才会反应过来,模型便宜、输出速度快不代表能完成实际工作。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新