锐意创新 · 敏锐洞察 · 锐不可当

Grok 4.7价格砍半,马斯克的枪口对准了谁的饭碗

近日,马斯克旗下人工智能公司SpaceXAI发布新一代旗舰模型Grok 4.7,定位直指编程与知识工作场景。发布页把它称作可比模型里的最强编程模型,速度两倍,价格一半。有独立开发者晒出账单:同一个代码仓库重构任务,上一代模型耗时四十分钟,Grok 4.7压到二十分钟出头,token费用直接砍半。

希鸥网观察到,Grok 4.7的核心坐标是长周期编程智能体赛道,为软件团队和知识工作者解决长任务中途偏航、结果仍需人工返工的老问题。差异化钩子写在评测表上:CursorBench 4.0得分46.3%,比Grok 4.6高5.9个百分点;Terminal-Bench 4.0从20.3%跃至38.0%。它隶属SpaceXAI,由马斯克直接站台。

价格腰斩不是慈善,是打法。前沿模型的成本大头在推理算力,Grok 4.7换用更大的基础模型,反而敢把单价压到一半,说明SpaceXAI把成本摊到了训练侧而非推理侧。用低价换开发者调用量,再用调用量反哺长任务数据,这是一条先用亏损换场景的路径。谁先吃下企业级工作流,谁就拿到下一轮议价的筹码。

更值得琢磨的是训练范式的转向。Grok 4.7延长了强化学习周期,任务组合中大量样本需要数小时才能完成。这等于把模型从答题者训练成项目经理:读仓库、拆需求、改多处文件、跑测试、自我纠错。SpaceXAI的说法是模型原生理解Grok Bot的运行框架,升级重点从单轮回答挪到了模型与执行环境的持续协作。

用户的心理预期也在迁移。过去企业采购大模型看榜单分数,现在看的是交付物能不能直接用。AA Briefcase v1.1上Grok 4.7拿到1657分,GDPval Elo升至1695分,超过GPT-6 Astra的1542分,逼近Fable 5.1的1735分。HealthBench Professional从48.5%升到56.7%。采购方的提问从“它有多聪明”变成“它能替我完成哪项工作”。

希鸥网认为,这场博弈的输家首先不是同行模型,而是按人头收费的中间层工具。当模型能独立跑完八小时任务链,代码补全插件、初级外包团队、文档代写的价值被直接压缩。获益方是能把AI塞进交付流程的小型软件公司,它们没有历史包袱,十几个人的人均产出可能超过传统五十人团队。受损最深的是靠信息差和人力堆量吃饭的岗位。

对创业者来说,工具越强,人的错配越藏不住。桥水基金创始人瑞·达利欧在《原则》里讲过一条容易被忽略的纪律:把不称职的员工换到新岗位要慎重对待,但不是绝不。留下一个明知不进步的人,代价有三层——他占着岗位产生真实风险,他被困在无法胜任的工作里心生不满,团队还要为他的短板反复补位。AI接管执行链后,这种错配会在两三个月内被数据暴露。

达利欧还说过一句更冷的话:如果一个人无法在合理时间内达到追求卓越的标准,就必须离开。严厉的爱最难给,也最重要。创业者要学的不是冷酷,而是像操作一台机器那样观察自己的团队:哪些环节该交给模型,哪些人放进新位置能长出能力,哪些人留在原位只会拖垮交付。模型的上下文窗口变长了,管理者的判断窗口也该变长。

落到动作上,有三件事值得这个季度就做。把团队里重复度最高的三十分钟级任务列出来,逐项测试能否交给Grok 4.7这类长任务模型;重新定义岗位颗粒度,从“会写某个模块”改成“能定义问题并验收结果”;对连续两个季度产出下滑的成员,先调岗给机会,再设明确的观察期。模型的价格在降,人的试错成本没降,组织调整的窗口比想象中短。

金鸥品牌榜·2026年度创新案例库开放申报了。免费提报,独立评估,入榜品牌将获得电子版《入榜证明》及年度专题公示,优秀案例可获得深度专访+全平台分发。 如需修改或发布文章,请加微信号:sheisceo

阅读量:1370
阅读时间:4分钟