一次运行的节点级归因
| 节点 | tokens | 成本 | 耗时 | 状态 |
|---|---|---|---|---|
| start | — | — | 2ms | 成功 |
| rag·kb | 312 | $0.0004 | 188ms | 成功 |
| llm·answer | 1,204 | $0.0031 | 812ms | 成功 |
| llm·summary | 987 | $0.0026 | 745ms | 成功 |
| end | — | — | 1ms | 成功 |
| 合计 | 2,503 | $0.0061 | 1.7s |
* 示意数据。并行节点耗时按墙钟时间归因,不重复累加。
用量事件聚合
细粒度用量事件支持按工作空间、时间范围、提供商、模型四个维度聚合查询——财务要月账单,工程要模型对比,同一份数据回答两种问题。
运行历史与回放
每次运行的逐节点输入输出、状态与事件流完整留存(按套餐保留 7 天至 1 年+),可回放定位「当时到底发生了什么」。
OTel + Prometheus 原生
OpenTelemetry 埋点与 Prometheus 指标开箱即用,接入你现有的 Grafana / 告警体系,不需要为 AI 工作负载单独建一套监控。
继续了解产品能力