LoongCollector在高输入负载(1GB/s日志生成速率)场景下的性能变化:
| 版本 | 采集速率 | CPU | 内存 |
|---|---|---|---|
| iLogtail(优化前基准) | 135 MB/s | 1.12核 | 65MB |
| LoongCollector(架构升级后,未优化) | 115 MB/s | 1.08核 | 65MB |
| LoongCollector(四步优化后) | 280 MB/s | 1.24核 | 65MB |
关键数据:
- 相比iLogtail提升100%(135→280 MB/s)
- 相比优化前的LoongCollector提升143%(115→280 MB/s)
- 内存保持不变(65MB)
- CPU仅增加10%(1.12→1.24核)
四步优化的贡献:
- Memory Arena + 避免shared_ptr:性能从115超越135
- 事件池化:进一步提升约15%
- 直接序列化:消除发送阶段的冗余拷贝
在Prometheus抓取场景对比中,LoongCollector CPU 1.41核/内存508MB,VMAgent CPU 2.48核/内存1300-2048MB,同样展现出显著的性能优势。




