Grok-4.7-high 实测不敌 GPT-5.6-sol-medium

karminski-牙医 · @karminski3 · X·2026-09-23 20:27·9小时前
AI 导读

用户实测 Grok-4.7-high 一天后认为其打不过 GPT-5.6-sol-medium,写了不少垃圾代码。该模型 oneshot 尚可,但工程项目表现拉胯,视野窄、缺代码直觉和经验,常漏边界条件,用分布式锁即可复现死锁且难以修复。

karminski-牙医@karminski3
34AI 编辑部评分,满分 100

Grok-4.7-high 实测不敌 GPT-5.6-sol-medium

2026-09-23 20:27· 9小时前
AI 导读

用户实测 Grok-4.7-high 一天后认为其打不过 GPT-5.6-sol-medium,写了不少垃圾代码。该模型 oneshot 尚可,但工程项目表现拉胯,视野窄、缺代码直觉和经验,常漏边界条件,用分布式锁即可复现死锁且难以修复。

Grok-4.7-high 用了一天了,感觉打不过 GPT-5.6-sol-medium. 写了好多垃圾代码😭

体验下来 oneshot还行, 工程项目就拉了... 主要在视野窄, 以及代码直觉和经验上, 总是会漏掉边界条件. 最简单的复现方法可以是写一个分布式锁. 应该分分钟就死锁了. 然后怎么修都修不好.

来源:karminski-牙医· x.com