DS民科怎么这么多, 我测完了 deepseek-v4.1-flash, 开 max, 然后评论跟我说应该开high, 不应该开max.
〇的我买法拉利然后你跟我说挂一档比挂二挡快是吧?
然后跟我说这只是思考强度开关, 跟性能没关系.
干你〇怎么就没关系..... 去年 deepseek 自家发的 DeepSeek-R1-Zero 论文怎么都忘了: http://arxiv.org/abs/2501.12948
就这个论文证明了思考强度越强模型能力越强的. 论文里Zero-SFT RL了一波, 没有增加任何新知识, 随着思考长度增加, AIME24 跑分就从 15% 魔法般的飙到了 71%.
然后震撼业界的雷霆大思考就如同雨后春笋般普及了.....
劝D小鬼对线前看看论文, 大水冲了自家龙王庙了.