Skip to main content
方法:client.getGeneration()。

示例

参数

  • id(字符串,必填):之前调用返回的请求 ID。

返回值

生成记录(JSON) 如果网关保存了完整请求详情,返回记录会包含 replay_supported 和 replay_request。将 replay_request 发回原端点即可受控地重新运行请求。 时间字段遵循网关统一语义:
  • latency_ms:记录到的首个 token 或首个输出字节/帧的耗时
  • generation_ms:记录到的延迟后生成耗时
最后修改于 2026年10月2日