让 AI 查资料、做分析,再把结果整理成能直接交付的成品,比回答一道题难得多:它得长时间工作、调用工具,还不能中途掉链子。Grok 4.6瞄准的正是这类“知识工作”,也就是研究、写作、分析和规划等认知任务,并已同步进入 Grok Build、Cursor、Grok Bot 和 API——软件调用模型的标准接口。
据量子位报道,Grok 4.6在衡量真实工作能力的 GDPVal-AA v2 中得到1753分,高于报道所列的 GPT-5.6 Sol 和 Fable 5 Max;但在测试命令行多步操作的 Terminal-Bench v3.0 中仅得26%,仍落后于 GPT-5.6 Sol 的34.6%。这些跑分来自 SpaceXAI 官方材料,尚不能等同于所有实际场景表现。
价格是另一张牌:每百万 Token——模型处理和生成的文本片段——输入2美元、输出6美元,与 Grok 4.5持平;单次请求超过20万 Token 后,整条请求的输入、输出价格会翻倍。配合 API、编程工具和首周双倍用量,马斯克阵营这次不只更新模型,也在用更低门槛争夺开发者入口。