
SpaceXAI(前身为xAI)正式推出最新AI模型Grok 4.7,该模型专注于编程及专业知识工作,官方宣称其在速度、推理能力及复杂任务处理方面均实现显著提升。
Grok 4.7采用了比Grok 4.6规模更大的基础模型,并通过更长时间的强化学习训练,重点优化了处理需耗时数小时的长周期任务能力。SpaceXAI表示,新模型在代码自查、文档与演示文稿创建以及网络安全任务处理上表现更佳。
目前,Grok 4.7已上线Grok Build、Cursor平台及Grok API。其定价为每百万输入Token 2美元,每百万输出Token 6美元。SpaceXAI创始人埃隆·马斯克在X平台上评价称:“Grok 4.7是智能、速度与低成本的高效结合。”
基准测试表现
在多项权威基准测试中,Grok 4.7展现出强劲竞争力:
- 生物安全:基于LatchBio基准测试,Grok 4.7得分为62.4%。
- 长周期代理任务:在AA Briefcase基准测试中,Grok 4.7获得1,657分,高于Grok 4.6的1,546分。
- 软件工程性能:在Artificial Analysis Coding Agent Index中,Grok 4.7位列第四,仅次于Claude Fable 5.1、GPT-6 Astra和Claude Opus 5。
安全与防御能力
Grok 4.7配备了一套新的安全系统,重点关注网络安全及其他两用领域。公司声称,该模型在保持协助合法安全工作能力的同时,对越狱攻击表现出更强抵抗力。在HackerBench v0.3评估中,仅有3.3%的高风险两用提示词被放行。
此外,SpaceXAI已开始向部分网络安全合作伙伴提供邀请制访问权限,允许其利用模型的红队能力进行防御性研究。