返回实验室

JEVLAB NEWS Research & data

SpaceXAI 发布 Grok 4.7

AI-assisted summaries and translations. Check original sources for context and performance claims.

CHOI · @choi.openai · 原文语言: 한국어

SpaceXAI 推出了 Grok 4.7,重点在于通过强化学习提升复杂任务和编程能力。尽管在文档分析和代码生成方面有所进步,但整体智能水平的提升幅度相对有限。

译文摘要 · AI-assisted; check the original.

查看原文

一览完整讨论串

使用AI独立概述CHOI的连续帖子。图片和视频归原作者所有,原文中的主张未经独立验证。

  1. Grok 4.7 发布
  2. 技术升级
  3. 基准评估
  4. 推理成本与效率
  5. 办公任务表现
  6. 编程能力提升
  7. 其他领域表现
  8. API 定价
  9. 成本效益分析
  10. 总结评价
  11. 官方公告

Grok 4.7 发布

SpaceXAI 正式发布了 Grok 4.7,现已集成至 Cursor、Grok Build 和 Grok API 中。

Grok 4.7 发布
@choi.openai · 原始帖子 ↗

技术升级

新版本引入了更大的基础模型,并专注于通过强化学习处理长时间任务。演示显示其在城市建筑和车辆细节表现上更为细腻。

基准评估

根据 Artificial Analysis 的数据,Grok 4.7 获得 46 分,较 4.6 版本的 44 分有小幅提升,但与领先模型仍有差距。

基准评估
@choi.openai · 原始帖子 ↗
基准评估
@choi.openai · 原始帖子 ↗

推理成本与效率

单任务输出 Token 数量增加了 125%,生成时间缩短至 7.1 分钟。更高的 Token 使用量意味着在相同单价下成本会增加。

推理成本与效率
@choi.openai · 原始帖子 ↗

办公任务表现

在文档处理任务中,Grok 4.7 表现出色,分析质量大幅提升,但在结果呈现质量上略有下降。

办公任务表现
@choi.openai · 原始帖子 ↗

编程能力提升

编程代理指数从 47 升至 56,超过了 GPT-5.6 Sol,在多个编程基准测试中均有显著进步。

编程能力提升
@choi.openai · 原始帖子 ↗

其他领域表现

在长上下文推理等领域表现平平,甚至出现小幅下滑。幻觉率有所降低,但整体准确率保持不变。

其他领域表现
@choi.openai · 原始帖子 ↗

API 定价

Grok 4.7 维持了极具竞争力的定价,每百万 Token 输入/输出分别为 2 美元和 6 美元。

API 定价
@choi.openai · 原始帖子 ↗

成本效益分析

CursorBench 测试显示,在相似性能下,Grok 4.7 的成本低于 GPT-5.6 Sol,但在最高推理设置下,其他模型表现更优。

成本效益分析
@choi.openai · 原始帖子 ↗

总结评价

Grok 4.7 在特定任务和成本控制上表现积极,但整体智能提升幅度未达预期,与顶级模型仍存在差距。

总结评价
@choi.openai · 原始帖子 ↗
总结评价
@choi.openai · 原始帖子 ↗

官方公告

有关 Grok 4.7 的详细发布信息可访问 x.ai 官方网站查看。

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-21
Discovered via
www.threads.com

前十名

付费推广

  1. 01Wallpets $125
  2. 02Walltank $85
  3. 03Chowder $50
  4. 04Falconer $45
  5. 05Lemonpod $40
  6. 06Menta $35
  7. 07Sway $30
  8. 08Peon-Ping $25
  9. 09Zeron $20
  10. 10Guideless $15
赞助