跳到正文
原文
Weaviate Blog·· 2026-05-06AI 评分50

Your LLM Is Only as Good as What It Retrieves

Your LLM Is Only as Good as What It Retrieves

AI 导读

检索质量是RAG系统中预测输出退化最可靠的单一指标,模型规模无法弥补检索缺陷。实验在HaluEval、TruthfulQA和FaithDial上发现检索层故障占幻觉的很大比例,与HELM和FaithDial分析结论一致。五种常见检索失败模式包括检索漂移、上下文截断、过期索引污染、低相关性top-k检索和多智能体间通信错误,且这些失败通常不可见,需要专用评估层才能检测。

来源:Weaviate Blog · weaviate.io