CnOps 智能运维与可观测社区
首页开源项目实践文章视频课程常见问答开发者工具STAROps 专题
导航菜单
首页开源项目实践文章视频课程常见问答开发者工具STAROps 专题

CnOps 智能运维与可观测社区

愿景

CnOps 智能运维与可观测社区是一个以"智能运维与可观测"为核心的开放、包容、分享的技术社区,旨在聚集运维专家、开发者和爱好者,共同探讨、学习和分享可观测最佳实践与最新技术,与众多技术社区合作互动,共同探讨交叉领域的技术挑战,推动可观测领域的创新与进步。

内容社区

  • 实践文章
  • 视频课程
  • 开源项目
  • 常见问答
  • 开发者工具

友情链接

  • Prometheus
  • Grafana Lab
  • OpenTelemetry
  • LoongCollector

关注我们

阿里云云原生公众号阿里云云原生
阿里云可观测公众号阿里云可观测

Copyright © 2026 CnOps 社区. All rights reserved.

首页问答如何通过 Hermes 可观测能力定位 Token 成本过高的原因?

如何通过 Hermes 可观测能力定位 Token 成本过高的原因?

#Token成本#成本归因#Trace分析#Hermes

CNOps | 2026-05-15

通过 Hermes 可观测插件,可以从多个维度定位 Token 成本过高的根因。首先在 CMS 2.0 控制台的 AI 应用可观测中查看 Token 消耗趋势和请求波动的全局指标,发现异常时段。然后沿着具体请求的 Trace 链路展开,查看每个 chat span 中记录的 gen_ai.usage.input_tokens、gen_ai.usage.output_tokens 和 gen_ai.usage.total_tokens,即可精确到每一次模型调用的 Token 消耗。常见的成本飙高原因包括:某一轮上下文突然膨胀导致 input_tokens 激增、某个工具返回了过大的结果被注入上下文、最后一轮回答的 output_tokens 过长、或者某类任务触发了过多的 ReAct step 轮次。根节点 invoke_agent span 还提供了整次运行的累计 Token 汇总,从而实现精准的成本归因。

推荐文章

超过 2000+ 位开发者正在阅读

给 OpenClaw 加上企业级 Memory

给 OpenClaw 加上企业级 Memory

4646 阅读

阿里云 STAROps 全域智能运维平台发布!

阿里云 STAROps 全域智能运维平台发布!

3453 阅读

阿里云正式发布 RCA Benchmark

阿里云正式发布 RCA Benchmark

2716 阅读

推荐视频

UModel 最佳实践 Vol.1 UModel 数据建模全景解读

UModel 最佳实践 Vol.1 UModel 数据建模全景解读

3854 观看50:35
云监控2.0全景:可观测范式升级与智能运维蓝图

云监控2.0全景:可观测范式升级与智能运维蓝图

2532 观看41:06

推荐工具

精选可观测领域开发者工具

云监

云监控 2.0 沙箱体验

7483 使用

免费

免费网络拨测工具

2746 使用