查看: 2|回复: 0

Grok 4.7 发布:综合能力逼近 GPT-5.6 Sol

[复制链接]
发表于 1 小时前 来自手机 | 显示全部楼层 |阅读模式
SpaceXAI 正式发布 Grok 4.7,定位编程与知识工作的旗舰模型。相比 Grok 4.6,新模型采用更大的基础模型,并延长强化学习训练周期,重点强化长时间复杂任务、自我检查和长上下文管理能力。目前已上线 Grok API、Cursor 和 Grok Build。

Artificial Analysis 测试显示,Grok 4.7(xhigh)综合得分 46,较 GPT-5.6 Sol 仅低 1 分,超过 Gemini 3.8 Flash,但仍落后 GPT-6 Astra 和 Claude Fable 5.1。

其编程 Agent 表现提升更明显:搭配 Grok Build 得分 56,较 Grok 4.6 提升 9 分,排名升至第 4,并超过 GPT-5.6 Sol。DeepSWE、Terminal-Bench 和 SWE-Atlas-QnA 等测试也均有明显进步。长流程知识工作同样增强,GDPval-AA 较前代提升 90 Elo。

代价是更高的推理消耗,平均输出约 8.1 万 Token,远高于 Grok 4.6 和 GPT-6 Astra。模型支持 50 万 Token 上下文,API 价格与 Grok 4.6 相同,超过 20 万 Token 后翻倍。
万狸温馨提示:理性消费
1.数码选品:先定用途,再比参数,拒绝 “加点钱更好” 的超支诱惑。
2.购车决策:看平台生命周期,算长期使用成本,刚需比潮流更重要。
3.重点提醒:多查真实评价,少信首发噱头,买得对远比买得新划算。
4.交流准则:聊产品讲实际体验,不抬杠不诋毁品牌,友善分享。
5.氛围维护:遇到分歧先理性沟通,不贴“粉黑”标签,温馨交流。
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注QQ群
手机版|小黑屋|万狸社区-免费活跃数码论坛,手机/电脑/汽车+旅游美食游戏兴趣社区

相关侵权、举报、投诉及建议等,请发 E-mail:572109352@qq.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|桂ICP备16003785号

在本版发帖
客服QQ:572109352
QQ客服返回顶部