在优化前的测试中发现,简单增加处理线程数量并不能线性提升性能。使用16线程并行处理时,最高吞吐量仅为约270MB/s,仍无法达到客户期望的300MB/s。这是因为性能瓶颈出在算法层面而非硬件资源层面:boost::regex_match的全量匹配机制导致单次正则匹配的时间与日志行长度成正比,增加线程只能并行更多的低效匹配操作,而无法改变单次匹配的效率。此外,线程数增加到一定程度后,线程调度开销、内存竞争等问题会进一步削弱扩展效益。这表明仅依靠增加硬件资源难以实现质的突破,必须从算法层面进行根本性优化。




