CnOps 智能运维与可观测社区
首页开源项目实践文章视频课程常见问答开发者工具STAROps 专题
导航菜单
首页开源项目实践文章视频课程常见问答开发者工具STAROps 专题

CnOps 智能运维与可观测社区

愿景

CnOps 智能运维与可观测社区是一个以"智能运维与可观测"为核心的开放、包容、分享的技术社区,旨在聚集运维专家、开发者和爱好者,共同探讨、学习和分享可观测最佳实践与最新技术,与众多技术社区合作互动,共同探讨交叉领域的技术挑战,推动可观测领域的创新与进步。

内容社区

  • 实践文章
  • 视频课程
  • 开源项目
  • 常见问答
  • 开发者工具

友情链接

  • Prometheus
  • Grafana Lab
  • OpenTelemetry
  • LoongCollector

关注我们

阿里云云原生公众号阿里云云原生
阿里云可观测公众号阿里云可观测

Copyright © 2026 CnOps 社区. All rights reserved.

首页问答AI 应用的可观测性要解决哪三大痛点?关键指标(TED、TTFT、TPOT)分别是什么?

AI 应用的可观测性要解决哪三大痛点?关键指标(TED、TTFT、TPOT)分别是什么?

#可观测性#TED#TTFT#TPOT#OpenTelemetry

agenticOps | 2026-05-23

AI 应用可观测性主要解决三大痛点:用得起来(性能/报错定位)、用得省(成本/token 消耗)、用得好(质量评估)。

数据采集侧通过 OpenTelemetry 探针(如 LoongSuite)挂载到 Java、Python 应用以及 vLLM/SGLang 推理框架,采集全链路 tracing、指标、日志(含输入输出、token、tools)以及 GPU 使用率等。

关键指标从传统的 **RED(Request/Error/Duration)**升级为 TED(Token/Error/Duration),Token 消耗成为新黄金指标之一。此外模型推理还需重点关注:

  • TTFT(Time to First Token):从 input 送入到第一个 token 输出的耗时,决定交互流畅度。
  • TPOT(Time Per Output Token):首包之后平均每 token 的耗时,反映 decode 阶段性能。
  • KV Cache 命中率、GPU 利用率、吞吐:影响推理效率和成本。

在评估层面则关注 Planning(任务拆解质量)、工具调用(是否选对 tool、参数是否准确)、RAG 召回质量、以及准确性/偏见/毒性等模型输出维度,形成从开发到线上持续追踪的循环。

推荐文章

超过 2000+ 位开发者正在阅读

给 OpenClaw 加上企业级 Memory

给 OpenClaw 加上企业级 Memory

4646 阅读

阿里云 STAROps 全域智能运维平台发布!

阿里云 STAROps 全域智能运维平台发布!

3453 阅读

阿里云正式发布 RCA Benchmark

阿里云正式发布 RCA Benchmark

2716 阅读

推荐视频

UModel 最佳实践 Vol.1 UModel 数据建模全景解读

UModel 最佳实践 Vol.1 UModel 数据建模全景解读

3854 观看50:35
云监控2.0全景:可观测范式升级与智能运维蓝图

云监控2.0全景:可观测范式升级与智能运维蓝图

2532 观看41:06

推荐工具

精选可观测领域开发者工具

云监

云监控 2.0 沙箱体验

7483 使用

免费

免费网络拨测工具

2746 使用