AI 圈大事记

Grok 4.7发布:智能体知识工作跻身前沿,编码得分升至56

模型AI 评分 88/100Artificial Analysis 完整文章(网页)待复核
AI 聚合

本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手

本条选题由第三方线索发现;线索方提供的摘要未被采用,本页内容依据下方信源整理。线索来源:AIHOT

Grok 4.7在Intelligence Index得46分,使SpaceXAI跻身前四AI实验室。其智能体知识工作显著提升,AA-Briefcase达1657 Elo(较4.6高111),仅次于Claude Opus 5与Fable 5.1;GDPval-AA达1695 Elo(领先90)。编码代理指数升至56(增9),原生套件排名第四,超越GPT-5.6 Sol。代价是输出token用量激增,每任务约81k,较4.6与GPT-6 Astra分别多125%和196%。上下文500k token,定价维持输入2美元、输出6美元每百万token不变,推理努力可配至xhigh。

为什么值得看

智能体知识工作与编码能力大幅跃升并跻身前沿,但token消耗翻倍,直接影响成本评估。

xAIGPTClaude智能体定价

信源1

  1. [1]Artificial Analysis 完整文章(网页)线索来自 AIHOTArtificial Analysis 评测 Grok 4.7:智能体知识工作跻身前沿,编码代理得分升至 56

关键事实

  • Grok 4.7在Intelligence Index得46分,SpaceXAI进入前四AI实验室[1]

  • AA-Briefcase得1657 Elo(较4.6高111),仅次于Claude Opus 5和Fable 5.1[1]

  • 编码代理指数达56(较4.6升9),原生套件排第四,超GPT-5.6 Sol[1]

  • 每任务输出token约81k,较Grok 4.6多125%,较GPT-6 Astra多196%[1]

  • 上下文500k token,定价输入2美元输出6美元每百万token,与4.6相同[1]

相关 · 模型

本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。