SpaceXAI发布Grok 4.7:主打编程与知识工作,百万词元输入2美元起

2026-09-22 15:10:54   |   文白不白   |   5814

9月22日,SpaceXAI宣布推出新一代Grok 4.7,主打编程和知识工作场景。官方称其采用全新更大规模基础模型,并通过更长时间的强化学习训练提升复杂任务处理能力,是该公司目前最强的编码和知识处理模型——速度是同类模型的两倍,价格却只有一半。

Grok 4.7针对编程和知识工作进行了优化。与Grok 4.6相比,新模型能够在困难任务上持续更长时间,并加强了对自身输出结果的检查能力。在CursorBench 4.0测试中,Grok 4.7面向长时间运行的编程任务,在价格与性能方面处于同类模型的前列。官方同时表示,该模型的运行速度和定价与Grok 4.6相同。

Grok 4.7使用了比Grok 4.6更大的基座模型,并接受了更长时间的强化学习训练。训练数据更加侧重需要数小时完成的复杂任务,同时针对模型的自我验证和长上下文管理能力进行了优化。SpaceXAI还针对Grok Bot harness对Grok 4.7进行了原生训练,使其在对话以及一般知识工作任务中的表现得到提升。此外,该模型在文档和演示文稿生成方面也有所改进。

在GDPval和AA Briefcase两项基准测试中,Grok 4.7均较Grok 4.6有所提升。这些测试要求AI完成律师、护士、金融分析师等专业人士日常工作中的相关任务。官方称,Grok 4.7在两项测试中的表现已达到与其他前沿模型相近的水平。

安全方面,SpaceXAI为Grok 4.7采用了全新的安全防护体系。官方表示,该模型在拒答和抵抗越狱攻击方面达到了公司目前测试中的最高水平。在网络安全和生物领域等具有双重用途的场景中,Grok 4.7试图兼顾合法任务的可用性与危险任务的安全拒答。在LatchBio生物安全基准测试中,该模型取得62.4%的成绩。针对网络安全场景,SpaceXAI表示,Grok 4.7在HackerBench v0.3测试中仅允许3.3%的高风险双重用途提示通过,同时较少阻止合法的安全工作。此外,公司已开始向部分网络安全合作伙伴提供邀请制访问权限,用于红队能力和防御研究。

目前,Grok 4.7已通过Cursor和Grok Build提供,同时开放Grok API,并支持第三方编程工具、模型路由服务及云平台。价格方面,Grok 4.7每百万词元输入起价为2美元,输出起价为6美元。SpaceXAI同时还提供了高速版本,输出速度翻倍,但价格也翻倍。

特别提醒:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字、图片等内容的真实性、完整性、及时性本站不作任何保证或承诺,请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益,请及时发送相关信息至bireading@163.com,本站将会在48小时内处理完毕。

SpaceXAI发布Grok 4.7:主打编程与知识工作,百万词元输入2美元起

2026-09-22 15:10:54 浏览量: 5814 作者: 文白不白

9月22日,SpaceXAI宣布推出新一代Grok 4.7,主打编程和知识工作场景。官方称其采用全新更大规模基础模型,并通过更长时间的强化学习训练提升复杂任务处理能力,是该公司目前最强的编码和知识处理模型——速度是同类模型的两倍,价格却只有一半。

Grok 4.7针对编程和知识工作进行了优化。与Grok 4.6相比,新模型能够在困难任务上持续更长时间,并加强了对自身输出结果的检查能力。在CursorBench 4.0测试中,Grok 4.7面向长时间运行的编程任务,在价格与性能方面处于同类模型的前列。官方同时表示,该模型的运行速度和定价与Grok 4.6相同。

Grok 4.7使用了比Grok 4.6更大的基座模型,并接受了更长时间的强化学习训练。训练数据更加侧重需要数小时完成的复杂任务,同时针对模型的自我验证和长上下文管理能力进行了优化。SpaceXAI还针对Grok Bot harness对Grok 4.7进行了原生训练,使其在对话以及一般知识工作任务中的表现得到提升。此外,该模型在文档和演示文稿生成方面也有所改进。

在GDPval和AA Briefcase两项基准测试中,Grok 4.7均较Grok 4.6有所提升。这些测试要求AI完成律师、护士、金融分析师等专业人士日常工作中的相关任务。官方称,Grok 4.7在两项测试中的表现已达到与其他前沿模型相近的水平。

安全方面,SpaceXAI为Grok 4.7采用了全新的安全防护体系。官方表示,该模型在拒答和抵抗越狱攻击方面达到了公司目前测试中的最高水平。在网络安全和生物领域等具有双重用途的场景中,Grok 4.7试图兼顾合法任务的可用性与危险任务的安全拒答。在LatchBio生物安全基准测试中,该模型取得62.4%的成绩。针对网络安全场景,SpaceXAI表示,Grok 4.7在HackerBench v0.3测试中仅允许3.3%的高风险双重用途提示通过,同时较少阻止合法的安全工作。此外,公司已开始向部分网络安全合作伙伴提供邀请制访问权限,用于红队能力和防御研究。

目前,Grok 4.7已通过Cursor和Grok Build提供,同时开放Grok API,并支持第三方编程工具、模型路由服务及云平台。价格方面,Grok 4.7每百万词元输入起价为2美元,输出起价为6美元。SpaceXAI同时还提供了高速版本,输出速度翻倍,但价格也翻倍。

,

Copyright ©2018 铋读网 All Rights Reserved.

京ICP备18051707号

京公网安备 11011302001633号