DeepSeek-V4.1-Flash 思考强度争议:max 还是 high

karminski-牙医 · @karminski3 · X·2026-09-14 15:14·14小时前
AI 导读

有人实测 deepseek-v4.1-flash 开 max 思考强度后,被评论建议应改开 high,理由是思考强度开关与性能无关。作者反驳称 DeepSeek 自家 DeepSeek-R1-Zero 论文已证明思考强度越强模型能力越强:Zero-SFT RL 未增加新知识,随思考长度增加,AIME24 跑分从 15% 升至 71%。

karminski-牙医@karminski3
27AI 编辑部评分,满分 100

DeepSeek-V4.1-Flash 思考强度争议:max 还是 high

2026-09-14 15:14· 14小时前
AI 导读

有人实测 deepseek-v4.1-flash 开 max 思考强度后,被评论建议应改开 high,理由是思考强度开关与性能无关。作者反驳称 DeepSeek 自家 DeepSeek-R1-Zero 论文已证明思考强度越强模型能力越强:Zero-SFT RL 未增加新知识,随思考长度增加,AIME24 跑分从 15% 升至 71%。

DS民科怎么这么多, 我测完了 deepseek-v4.1-flash, 开 max, 然后评论跟我说应该开high, 不应该开max.

〇的我买法拉利然后你跟我说挂一档比挂二挡快是吧?

然后跟我说这只是思考强度开关, 跟性能没关系.

干你〇怎么就没关系..... 去年 deepseek 自家发的 DeepSeek-R1-Zero 论文怎么都忘了: http://arxiv.org/abs/2501.12948

就这个论文证明了思考强度越强模型能力越强的. 论文里Zero-SFT RL了一波, 没有增加任何新知识, 随着思考长度增加, AIME24 跑分就从 15% 魔法般的飙到了 71%.

然后震撼业界的雷霆大思考就如同雨后春笋般普及了.....

劝D小鬼对线前看看论文, 大水冲了自家龙王庙了.

来源:karminski-牙医· x.com