SpaceXAI的Grok 4.6与OpenAI最佳模型持平,价格更低
Grok 4.6在性能和价格上双重突破:AI指数得分61分,追平OpenAI GPT-5.6 Sol,代理任务基准排名第二,定价比Claude Opus 5和GPT-5.6 Sol便宜60%以上,现已在API和Cursor等平台上线。
原贴
查看原文原文
中文翻译
Grok 4.6 追平了前沿模型,但成本低得多。根据 Artificial Analysis Intelligence Index,SpaceXAI 的新模型得分 61 分,与 OpenAI 的 GPT-5.6 Sol 持平。只有 Anthropic 的 Claude Opus 5(63 分)和 Claude Fable 5(62 分)得分更高。这比其前代 Grok 4.5 提升了 5 分。Grok 4.6 在代理任务上表现尤其出色,这类任务中模型需要独立执行多步骤工作流。在旨在衡量计算机上真实世界知识工作的 GDPval-AA v2 基准中,它以 1,753 的 Elo 得分排名第二,仅次于 Claude Opus 5。它完成复杂任务约需 53 步,而 Claude Opus 5 大约需要 103 步。定价保持在每百万 token 2 美元/6 美元。这比 Claude Opus 5(5 美元/25 美元)和 GPT-5.6 Sol(5 美元/30 美元)便宜 60% 以上。Grok 4.6 现已通过 API、Cursor、Grok Build 以及 OpenRouter、Vercel 和 Cloudflare 等合作伙伴提供。第一周内,x.ai 在 Grok Build 和 Cursor 中提供双倍使用配额。
核心信息
Grok 4.6在性能和价格上双重突破:AI指数得分61分,追平OpenAI GPT-5.6 Sol,代理任务基准排名第二,定价比Claude Opus 5和GPT-5.6 Sol便宜60%以上,现已在API和Cursor等平台上线。
- Grok 4.6在性能和价格上双重突破:AI指数得分61分,追平OpenAI GPT-5.6 Sol,代理任务基准排名第二,定价比Claude Opus 5和GPT-5.6 Sol便宜60%以上,现已在API和Cursor等平台上线。
- 原贴提到:Grok 4.6 catches up to frontier models while costing far less. According
- 来源:the-decoder.com
成为会员查看完整内容
你已经看到了这篇内容的前置整理,剩余深度部分仅对会员开放。