向量索引的根本局限在于向量相似度是文本层面的近似匹配,而非结构层面的关系推理。具体表现为:import pkg/a2a 在代码里是一条确定性的依赖关系,但在向量空间里只是一个文本片段的相似度信号;找到所有直接或间接依赖某个模块的代码需要图遍历而非向量检索;接口变更的影响沿调用链传播需要确定性的 calls 关系。Augment Code 的评测也显示,Cursor 在 50+ 文件的跨文件重构中会出现不一致——前 30 个文件改对了,后 20 个因上下文窗口溢出而产生错误。CodeIndex 本质上是更聪明的搜索引擎,帮 Agent 找到代码片段但不替 Agent 做结构化推理。




