马斯克发布Grok 4.7:AI竞争再升级
AI行业在假期期间依然活跃,各大公司如OpenAI、Anthropic和xAI纷纷加速研发,抢占市场。刚刚,SpaceXAI推出了Grok 4.7,官方称其为当前最强的编程及知识工作模型。该新模型已整合进Cursor、Grok Build和Grok API,并通过各类编程工具和云服务提供。
Grok 4.7的发布时间较马斯克最初预计有所推迟,经历了几次时间调整。与以往的模型相比,本次更新更加注重长时任务操作、自我检查、专业知识应用以及更具竞争力的价格性能比。
根据官方的信息,Grok 4.7采用更大基础模型,并强化了长时间训练和复杂任务的能力,部分任务需耗时数小时。模型在长上下文管理和结果核查方面也有显著改进,特别是在Grok Bot的运行环境中表现优异。 龙8体育
具体成果方面,Grok 4.7在CursorBench 4.0中得分46.3%,相比4.6有明显提升;DeepSWE v1.1的得分从65.2%上升至71.0%。在电气工程基准EEBench中,从53.0%增至64.0%,而针对长期办公的评测也有显著分数提升。
Gok 4.7与其他模型相比,其主要优势在于价格和特定专业任务的表现,但在整体综合成绩上仍未完全领先。尽管在某些评测中表现逊色于Fable和GPT等模型,但在某些法律相关基准测试中却大幅超越其他竞争者。
价格上,Grok 4.7的API定价与4.6相同,且它推出的快速版本使得输出速度翻倍,价格也相应提高。马斯克表示,Grok 4.7集智能、速度与低成本于一体,SpaceXAI甚至声称其速度是同类产品的两倍,价格却只有一半。 龙8体育
除了编程,SpaceXAI还迈向专业工作领域,特别强调其在文档和演示制作方面的能力,旨在满足如律师、护士和金融分析师等专业人士的需求。实际案例展示了Grok 4.7在保险理赔资料核对中的应用,效果显著。
安全性也在此次升级中得到重视,Grok 4.7运用了新的安全防护机制,在相关安全基准测试中取得良好成绩。部分网络安全合作伙伴甚至获得了红队能力以提升防御能力。
尽管Grok 4.7的首次测试结果在网页、3D场景和可视化编程方面引起热议,但用户的反馈却呈现明显的两极分化。 龙8体育