面对 "1000 节点每台补采约 10GB、目标 Logstore 256 shard、每 shard 上限 5MB/s、每台日常 1MB/s" 这类场景,可以从限流和超时两方面控制:
- 第一步:限流 MaxSendRate:估算可用写入 = 256×5 − 1000×1 = 280MB/s,平均每台约 0.28MB/s ≈ 290000 B/s。在
flusher_sls.MaxSendRate设置约 290000 B/s 即可避免触发 shard write quota。 - 第二步:放大执行超时 ExcutionTimeout:按 286KB/s 速率,补采 10GB 至少需要约 10.2 小时;建议将
ExcutionTimeout设置为 86400(1 天),给采集预留足够余量。
二者组合后既不会挤占线上持续采集流量,又能保证 OneTime 任务在执行窗口内完成,对补采进行 "时长 + 流量" 的双重兜底。




