Grok 4.6正式发布,多项测试对标GPT-5.6 Sol

Grok 4.6正式发布,多项测试对标GPT-5.6 Sol

北京时间8月12日晚间,SpaceXAI正式发布新一代大语言模型Grok 4.6。该模型在Grok 4.5的基础上进一步强化了长时间运行的智能体任务能力,尤其在复杂交互与视觉工作方面表现突出,能够持续处理包含大量步骤的资料研究、信息分析、大型代码库处理等任务,甚至可将宽泛的产品构想直接转化为可运行的应用初版。

在基准测试方面,Grok 4.6在多项智能体编程和知识工作测试中达到前沿水平。根据综合9项基准测试的Artificial Analysis Intelligence Index,Grok 4.6与GPT-5.6 Sol取得相同成绩,展现出强劲的竞争力。训练层面,Grok 4.6经历了比前代更长的补充训练,数据涵盖筛选后的模型生成推理数据、高级技术概念数据及高质量工程数据,并配合改进后的优化器与训练方案,为后续监督微调和强化学习奠定基础。训练团队还利用Grok 4.5重新生成覆盖不同推理强度和智能体运行框架的SFT轨迹,并进行了广泛的智能体强化学习训练,覆盖知识工作、通用编程、内核优化、Web开发及计算机辅助设计等领域。

在实际项目测试中,Grok 4.6展现出更多自主测试和验证行为,能够在继续执行任务前主动检查已完成的工作,视觉与交互式项目的初版成果也较前代有所提升。安全方面,此次安全评估覆盖部署前能力测试、安全防护校准及部署后和第三方测试,规模为历来最大,在提高实用性的同时有效控制安全风险。

目前,Grok 4.6已在Cursor和Grok Build上线,首周向用户提供两倍内含使用额度,同时通过API开放,并登陆OpenRouter、Vercel和Cloudflare等合作平台。价格方面,每100万个输入Token收费2美元,每100万个输出Token收费6美元,速度更快的版本价格为普通版本的两倍。

原创文章,作者:野游栗,如若转载,请注明出处:https://www.kejixun.co/article/759789.html

野游栗的头像野游栗认证作者

相关推荐

发表回复

登录后才能评论