模型发布SpaceXAI · SpaceXAI
Grok 4.7“同价同速升级”:社区正反 Demo 指向任务总成本
- 发布日期
- 2026-09-22
- 类型
- 模型发布
- 相关机构
- SpaceXAI
- 信息来源
- SpaceXAI
这件事意味着什么
【官方主张】
SpaceXAI 称 Grok 4.7 相比 4.6 有显著提升,价格与速度不变;官方发布页列出的 20 万 prompt token 以下价格为输入 2 美元/百万 token、输出 6 美元/百万 token。Elon Musk 将其定位为 agentic coding 位列 Anthropic、OpenAI 之后的第三名,同时强调速度更快、成本更低。
【社区案例】
采集到的 X Demo 包括开放世界城市、Blender、可交互 SVG 等一次性正向展示;另一作者则报告 Three.js 火箭任务效果不佳,Grok 花费 1.59 美元、Kimi 约 6 美元,并称其在 3D/前端任务中 token 消耗偏高。这些都是明确归因的社区个案,不是可直接横比的基准:提示词、agent harness、推理档位、重试、环境和挑选过程均未统一。
【独立结论】
低 token 单价不等于低任务成本。复现实验应冻结公开测试集,并统一 harness、工具权限、运行环境、模型设置和验收测试;每个模型×任务至少随机运行 5 次,拆分报告首次成功率、尝试与重试次数、输入/输出/推理/缓存 token、墙钟时长、工具与基础设施费用、人工返工分钟、最终成功率及每个验收通过任务的总成本。同时公开提示词、容器或 lockfile、随机种子和原始轨迹;社区案例只有在该协议下重跑后才进入横向结论。
继续了解相关进展
本页由 AGI Pulse 聚合,仅保留标题与链接,不转载正文。