意料之中!马斯克官宣 Grok 4.7 延期老马这次亲口承认:Grok 4.7 到底是卡在哪了?根据马斯克在 X 上的最新回应,Grok 4.7 临门一脚被拉回“炼丹炉”,锁定了三个非常极客的技术细节:1. 强化学习把“回答长度”给惩罚狠了马斯克直言,xAI 团队在给 Grok 4.7 做 RL 对齐训练时,可能对“过度冗长的回答”惩罚得太厉害了。这导致了一个致命副作用:模型在面对复杂的高难推理任务(它明明有能力解开)时,为了追求“简短”而太早放弃!2. 对自己的解答“不够严谨”对于要处理 SpaceX 火箭工程、热力学与底层系统代码的 Grok 4.7 来说,任何逻辑幻觉都是致命的。老马表示模型在“自我检查与一步步反思”上的严谨度还没达到出厂标准。3. “老马时间”的经典剧本从 Grok 4.5 到 4.6,马斯克的预告时间表就从未准时过。但对于 2.1T 这种级别的基座重构,多给集群 5-7 天的强化训练时间,往往能在 Benchmarks 上刷出完全不同的战力曲线!
调整战术倒计时,锁定下周五(9 月 18 日): 一直在关注 Grok 4.7 API 节点与 Grok Build 调教的团队,可以把原定本周的压测计划顺延至下周末!利用这延期的几天,刚好可以把 OpenAI GPT-6 Astra 和 Meta Muse Spark 1.3 的代码跑分数据刷透,等下周老马的 2.1T 巨兽一出,直接展开横向撕杀!
