这是一个结构性问题而非个别插件的缺陷。Agent的真实执行模式是ReAct迭代系统,每一轮包含判断、工具选择、结果吸收和下一步规划。但市面上大多数基于llm_input/llm_output hook实现的插件,由于多轮对话只触发一次llm hook,会将整个多轮执行过程压成"单个LLM span + 多个TOOL span"。这导致三个典型问题:看不到中间轮次的真实LLM输入输出(只看到会话开头和结尾)、Trace结构与真实执行不一致(排障时容易被误导)、并发及连续调用下容易断链或串链导致run关联不稳定。用单个LLM span概括整轮行为会天然丢失中间语义。




