以前,模型网关只看见一批请求,却未必知道背后是哪类 Agent 在工作、上一步工具跑了多久,或长对话是否已经压缩。Claude Code v2.1.273 新增五个可选 HTTP 请求头——随网络请求附带、但不属于正文的元数据——把这些运行状态交给网关,方便监控和排错。
新增信息包括请求类别、Agent 类型、此前工具耗时,以及是否发生上下文压缩。上下文压缩是把过长的对话和工具结果浓缩后再交给模型,用来控制文本量和成本。对负责统一转发、鉴权、限流和日志的 LLM gateway 来说,这意味着可以更细地辨认请求来自哪里、运行到什么状态,也显示 Claude Code 的观测范围正从单次模型调用扩展到整条 Agent 工作链路。
这些请求头并非默认启用,需要设置 CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 主动开启;发布说明没有披露各字段的具体取值、数据保留方式或网关将如何使用它们。