RAG之前火过我觉得是llm技术发展过程中应对幻觉,私有知识,上下文等问题的一个直接有效的解决方案,还有关键是做起来不复杂,谁都可以做RAG。

但是实际上我基本没看到有效果很好的宣传,或许证明了这个技术效果没有那么好?(也可能我看的比较少)

RAG已死我的理解是失去了技术主导。(特别是向量RAG)

对于传统的向量RAG一方面是模型自带的长上下文能力就会吞掉RAG的一部分价值,另一方面很多场景也不需要向量检索(模型智力在线+基础的搜索工具就可以实现很好的效果),还有大部分场景下维护这套系统的成本经常高于收益。

但是如果把RAG理解为模型在生成前按需取得外部证据,那我觉得确实没死,agent的检索能力肯定是必要的,只是或许融入了其他的概念,比如Agentic Search,Context Engineering这些