xAI 发布 Grok 4.7,主打编码与知识工作
AI guide
AI 导读
xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。
Story tracking
事件追踪
最新进展:评测报道:Grok 4.7在AA-Briefcase上排名仅次于Anthropic模型、略逊于Opus 5且每任务成本约为其50%;Lite中分析质量Elo 1698→1994、演示Elo略降至1499,API成本约$8高于Grok 4.6的$4.40
事件时间线
X:Artificial Analysis (@ArtificialAnlys) 一手信源
评测报道:Grok 4.7在AA-Briefcase上排名仅次于Anthropic模型、略逊于Opus 5且每任务成本约为其50%;Lite中分析质量Elo 1698→1994、演示Elo略降至1499,API成本约$8高于Grok 4.6的$4.40
作者在其公开尽职调查评测场景AA-Briefcase/AA-Briefcase-Lite(要求模型构建市场模型和目标评估deck)中报告Grok 4.7的成绩:排名仅次于Anthropic模型、略逊于Opus 5,每任务成本约为Opus 5的50%;相比Grok 4.6,分析质量Elo由1698升至1994,演示Elo由1531略降至1499;生成示例deck的API成本约8美元(xhigh),高于Grok 4.6(xhigh)的约4.40美元。
阅读原始报道 ↗IT之家(RSS)
SpaceXAI 发布 Grok 4.7 编码和知识处理模型,百万词元输入 2 美元起,已通过 Cursor、Grok Build 及 API 提供
SpaceXAI 宣布推出新一代 Grok 4.7,主打编程和知识工作场景,官方称其采用更大基座模型并接受更长强化学习训练,是目前最强的编码和知识处理模型。发布同时公布多项基准与安全测试成绩、网络安全合作伙伴邀请制访问,并称模型已通过 Cursor、Grok Build 和 Grok API 提供,输入每百万词元 2 美元起、输出 6 美元起。各项成绩与'最强'表述均为官方口径。
阅读原始报道 ↗X:Kim (@kimmonismus)
作者报道Grok 4.7表现不佳
作者在同一段转述中指出Grok 4.7表现不佳(underperformed);原文未说明具体测试、对比对象或背景,仅为简要报道。
阅读原始报道 ↗Hacker News 热门(buzzing.cc 中文翻译)
x.ai发布Grok 4.7模型,当天起在Cursor、Grok Build、Grok API等渠道可用,价格与速度与Grok 4.6相同
x.ai宣布发布Grok 4.7模型,称其为编码与知识工作方面最强模型,采用更大的新基座模型并原生理解Grok Bot harness。价格与速度与Grok 4.6相同,起价每百万输入token $2、输出token $6,另提供双倍速度、双倍价格的快速变体。模型当天起在Cursor、Grok Build可用,并通过Grok API、第三方编码框架及模型路由器和云平台提供。发布方同时公布多项基准成绩,称在CursorBench 4.0上处于价格性能前沿;采用全新安全栈,称在LatchBio生物安全基准以62.4%居首,在HackerBench v0.3上仅放行3.3%高风险双用途提示,并已开始向部分网络安全伙伴提供邀请制红队权限。
阅读原始报道 ↗Artificial Analysis 完整文章(网页) 一手信源
Artificial Analysis评测Grok 4.7:智能指数得分46使SpaceXAI进入前四,Coding Agent Index提升并超越GPT-5.6 Sol
Artificial Analysis发布对Grok 4.7的评测报告:在xhigh推理档下,Grok 4.7在Artificial Analysis Intelligence Index得46分,较Grok 4.6高2分,使SpaceXAI进入前四大AI实验室;在AA-Briefcase得1657 Elo、GDPval-AA得1695 Elo,位居agentic知识工作前沿。配合Grok Build时,Coding Agent Index得56分(升9分),在原生框架模型中排第四,超越GPT-5.6 Sol,仅次于Claude Fable 5.1、GPT-6 Astra和Claude Opus 5。评测还记录其高token用量(每任务约81k输出token)、AA-Omniscience幻觉率由34%降至29%、500k上下文窗口及与Grok 4.6持平的每百万token $2/$6定价。
阅读原始报道 ↗X:Rohan Paul (@rohanpaul_ai)
Grok 4.7 在 Harvey Legal Agent Benchmark 中得分 19.6%,高于 GPT-5.6 Sol Max 的 2.5% 和 Fable 5.1 Max 的 6.7%
据该文,SpaceXAI 的 Grok 4.7 在 Harvey Legal Agent Benchmark 中获得 19.6%,相比之下 GPT-5.6 Sol Max 得分 2.5%,Fable 5.1 Max 得分 6.7%;原文称法律工作是 Grok 4.7 提升最大的领域之一。
阅读原始报道 ↗X:Testing Catalog (@testingcatalog)
Grok 4.7已在Grok Build、Cursor和API上发布,特定任务性能接近Opus 5,价格同Grok 4.6
据该帖报道,Grok 4.7已在Grok Build、Cursor平台及API上发布。作者称其在特定任务上的性能接近Opus 5,定价与Grok 4.6相同,并表示将进行测试。
阅读原始报道 ↗X:Eric Zakariasson (@ericzakariasson)
Grok 4.7模型卡显示多项基准较4.6提升,价格与4.6相同
原文公布Grok 4.7模型卡,与Grok 4.6相比多项基准成绩提升:Terminal-Bench从20.3%升至38.0%,SWE-Marathon从31.9%升至46.0%,HealthBench Pro从48.5%升至56.7%,Legal Agent从15.8%升至19.6%,EEBench从60.0%升至66.0%,价格与4.6相同。
阅读原始报道 ↗X:Elon Musk (@elonmusk, xAI)
Grok 4.7在代理编程方面位列第三,次于Anthropic和OpenAI
原文短讯报道,Grok 4.7在代理编程(agentic coding)方面排名第三,位列Anthropic和OpenAI之后。作者称,考虑到Grok明显更快且成本更低,它是日常工作主力的不错选择。该排名为作者所述,原文未给出具体评测名称或日期。
阅读原始报道 ↗X:Arena (@arena) 一手信源
@SpaceXAI发布Grok 4.7模型
作者称@SpaceXAI的Grok 4.7模型刚刚发布。原文提及将结合过去Grok版本在Agent Arena净改善评分上的走势,邀请用户投票预测4.7的落点,评分将随投票稍后公布。
阅读原始报道 ↗The Decoder:AI News(RSS)
xAI发布Grok 4.7,定价$2/$6每百万token,基准成绩落后于Claude Fable 5.1和GPT-6
据原文,xAI推出迄今最擅长编码和知识工作的Grok 4.7,公司称其基于更大基础模型、经更长强化学习训练并能更好验证自身输出;定价为每百万输入token 2美元、输出token 6美元,可通过Grok API、Cursor和Grok Build使用。在Artificial Analysis Intelligence Index (v4.3.2)十项基准合并中得分46居中游,落后于各得53分的Claude Fable 5.1和GPT-6;在Terminal-Bench 4.0代理编程测试中仅得26%,低于GPT-6 Astra的60%和Claude Fable 5.1的55%,也低于DeepSeek V4.1 Flash的27%。
阅读原始报道 ↗X:Haider (@haider1)
Grok 4.7 xhigh 在 CursorBench 4.0 得分 46.3%(每任务 $6.01),较 Grok 4.6 xhigh 的 41.4% 跳升且成本基本不变
原文指出,Grok 4.7 xhigh 在 CursorBench 4.0 上得分 46.3%,单任务成本 $6.01;相比 Grok 4.6 xhigh 的 41.4%,得分跳升至 46.3% 而成本基本保持不变。
阅读原始报道 ↗X:Artificial Analysis (@ArtificialAnlys) 一手信源
作者评测Grok 4.7(xhigh):Intelligence Index得46分、较Grok 4.6高2分,使SpaceXAI进入前四AI实验室;Coding Agent Index得56分,超越GPT-5.6 Sol
作者评测新发布的Grok 4.7(以xhigh推理强度):在Artificial Analysis Intelligence Index得46分,较Grok 4.6提升2分,使SpaceXAI跻身前四大AI实验室;Coding Agent Index得56分(xhigh配合Grok Build,较Grok 4.6提高9分),超越GPT-5.6 Sol,在原生气动中排第四,仅次于Claude Fable 5.1、GPT-6 Astra和Claude Opus 5。伴随更高token用量,上下文500k、定价与Grok 4.6持平。
阅读原始报道 ↗X:Arena (@arena) 一手信源
Grok 4.7(@SpaceXAI和@elonmusk)现已加入Agent Arena
Grok 4.7(@SpaceXAI和@elonmusk)现已加入Agent Arena,作者邀请用户投票并提交高难度提示。据原文介绍,该Arena基于全球用户数百万个真实世界长周期代理任务测评模型,模型可访问网络搜索、文件系统和终端工具完成复杂工作流,排行榜以因果追踪方法衡量模型相对平均模型的表现。
阅读原始报道 ↗X:Michael Truell (@mntruell)
Grok 4.7 发布,宣称更智能且能力更强,保持相同速度与成本
Grok 4.7 正式发布。该版本被宣称比前代更智能且能力更强,同时保持相同的速度和成本水平;上述为其发布宣称,原文未提供独立验证。
阅读原始报道 ↗X:OpenRouter (@OpenRouter) 一手信源
@SpaceXAI 的 Grok 4.7 模型已在 OpenRouter 上线可用
据该帖,@SpaceXAI 的 Grok 4.7 模型现已在 OpenRouter 上线,用户可立即使用。帖文称其为该团队在编码和知识工作方面最强的模型,能在困难任务上工作更久、更仔细地自查,并在 CursorBench 4.0 基准上处于价格性能的前沿。
阅读原始报道 ↗@mark_k
SpaceXAI发布Grok 4.7,增强编码、长运行代理及知识工作能力,价格速度与Grok 4.6一致
SpaceXAI宣布发布Grok 4.7模型。该版本基于更大的基础模型,通过更长时间的强化学习训练,在编码、长上下文处理、文档与演示文稿创建方面有所提升,并改进了对Grok Bot harness的原生理解及安全系统。价格与速度同Grok 4.6保持一致,输入代币$2/百万、输出$6/百万,另有价格与速度翻倍的快速变体,现已在Cursor、Grok Build及API中可用。
阅读原始报道 ↗X:Eric Zakariasson (@ericzakariasson)
发布方宣布Grok 4.7模型上线,称其为目前最佳模型,可在Cursor、Grok Build、API等多处试用
发布方宣布Grok 4.7模型上线,并将其定位为迄今最佳模型;用户可在Cursor、Grok Build、API或任何获取Token的地方试用。原文还附上Grok 4.6与4.7构建《帝国时代2》的对比示例。原文未点名发布方为xAI。
阅读原始报道 ↗X:SpaceXAI (@SpaceXAI) 一手信源
Grok 4.7 发布,在相同价格和速度下较 Grok 4.6 有显著提升
Grok 4.7 发布。据原文报道,该版本在保持与 Grok 4.6 相同的价格和速度的前提下,有显著改进。原文未给出具体发布日期。
阅读原始报道 ↗Hacker News:AI 热帖
x.ai发布Grok 4.7:主打编码与知识工作,与Grok 4.6同价,公布基准成绩、新安全护栏、定价及多渠道今日上线
x.ai宣布发布Grok 4.7,定位为其在编码和知识工作方面最强的模型,采用比Grok 4.6更大规模的新基础模型并经更长时间强化学习训练,增强长任务处理、自我验证与长上下文管理能力。公告称其配备全新安全护栏堆栈,在拒绝与抗越狱测试中表现最强,在HackerBench v0.3上仅放行3.3%的高风险双重用途提示,并居LatchBio生物安全基准首位(62.4%);同时开始向部分网络安全合作伙伴提供邀请制红队能力访问。基准方面,公告称其在CursorBench 4.0价格性能处于前沿(46.3%),DeepSWE v1.1高努力得分为71.0%。Grok 4.7今日在Cursor、Grok Build上线,并可通过Grok API、第三方编码工具、模型路由和云平台使用,定价为每百万输入token 2美元、输出token 6美元,另提供输出速度与价格均加倍的高速变体。
阅读原始报道 ↗X:Haider (@haider1)
Grok 4.7 出现在 OpenCode 中
作者称 Grok 4.7 出现在 OpenCode 中,作为本周值得关注的动态之一;具体来源与细节未在原文给出。
阅读原始报道 ↗X:Kim (@kimmonismus)
作者称Grok 4.7曾在opencode zen上线但已被删除,视为该模型即将发布、甚至可能当天发布的信号
作者观察到具名模型Grok 4.7曾在opencode zen平台短暂出现、随后已被删除,并认为这是该模型发布临近的信号,甚至可能当天发布。发布本身尚未发生,仅为作者推测;原文未涉及任何官方声明。
阅读原始报道 ↗xAI:News(网页) 一手信源
SpaceXAI发布Grok 4.7编程与知识工作模型
SpaceXAI于2026年9月21日发布Grok 4.7,称其为编程和知识工作方面最强大的模型,采用比Grok 4.6更大的基座并经更长强化学习训练,自我检查能力更强。发布方称其在CursorBench 4.0等基准上价格性能处于前沿,并启用全新安全防护。模型当日即在Cursor、Grok Build、Grok API及第三方渠道可用,起价每百万输入token 2美元、输出6美元,另提供两倍速度、两倍价格的快速变体。
阅读原始报道 ↗X:Kim (@kimmonismus)
传闻:Grok 4.7即将发布(仅传闻,未确认)
一位发帖人称正飞回德国,并提到传闻称Grok 4.7即将发布,希望自己不错过。该消息仅为传闻,并非官方确认的发布。
阅读原始报道 ↗