券商观点|传媒:AI产业研究系列|模型跟踪 SpaceXAI/Grok 4.6:后训练驱动能力跃升,性价比重塑格局

2026-08-18 21:21:38
来源:同花顺iNews
分享
文章提及标的

    2026年8月18日,国盛证券(002670)发布了一篇传媒行业的研究报告,报告指出,AI产业研究系列|模型跟踪 SpaceXAI/Grok 4.6。

报告具体内容如下:

事件:8月12日,SpaceXAI正式发布新一代前沿大模型Grok 4.6,重点强化长程智能体、复杂编程与知识工作能力,同步推出AI代理产品Grok Bot。
点评:
新一代前沿大模型,核心能力为能够跨越多个步骤处理复杂任务。Grok 4.6聚焦于长时间运行的智能体以及更具野心的交互式和视觉工作能力,能够持续处理跨多步骤的复杂任务,包括研究主题、分析信息、跨代码库协作,以及将创意转化为完整应用。Grok 4.6为1.5万亿参数模型,在Grok 4.5基础上加大了对长程智能体任务的训练投入。

在多项独立评测中跻身全球前沿模型第一梯队。Grok 4.6在由九项基准测试汇总的综合智能指数中获得61分,与OpenAI当前最强旗舰模型持平,仅落后Anthropic两款旗舰模型(62分、63分),处于全球第一梯队。
1)在高价值职场任务评测中,Grok 4.6以1753分居于对比模型前列,仅落后Claude Opus 5;
2)在编程能力评测中,Grok 4.6以69.9%的成绩领先OpenAI旗舰模型。

能力跃升主要来自后训练阶段的策略优化,而非参数规模扩张。继GLM-5.3、DeepSeek V4-Flash之后,Grok 4.6在参数规模不变的情况下实现能力提升,综合智能指数较前代提升5分,编程与智能体能力跻身行业第一梯队,再度验证后训练对模型能力提升的重要性。我们认为,后训练阶段的数据筛选与训练策略精细化,正成为驱动模型能力跃升的核心动能,行业竞争重心已从规模转向训练效率。

API价格仅为同梯队前沿模型的一半左右,长程任务平均成本不足1美元,性价比优势明显。Grok 4.6的API定价为每百万输入Token 2美元、每百万输出Token 6美元,较Anthropic与OpenAI旗舰模型低60%以上。在长程知识工作评测中,Grok 4.6平均约53轮即可完成任务,而Anthropic旗舰模型需约103轮,输入消耗仅为后者的四分之一,单任务平均成本约0.84美元。我们认为,在长程智能体与成本敏感的规模化部署场景中,Grok 4.6以不足竞品一半的单位成本实现第一梯队能力,是高并发、长任务场景下的高性价比选择。

同步推出AI代理产品Grok Bot,将Grok 4.6封装为可自主执行任务的“AI队友”,标志公司从模型供应商向企业AI平台转型。Grok4.6于8月11日发布测试版,拥有独立云端计算环境,可登录用户现有工具自主执行任务、完成后才返回汇报。目前Grok 4.6已接入Cursor与Grok Build。我们认为,Grok Bot将模型能力封装为企业级智能体服务,并通过Cursor补齐开发者生态短板,在长程智能体与企业生产力场景中具备落地价值。

风险提示:大模型迭代不及预期;行业竞争加剧风险;算力不足风险

更多机构研报请查看研报功能>>

声明:本文引用第三方机构发布报告信息源,并不保证数据的实时性、准确性和完整性,数据仅供参考,据此交易,风险自担。

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME