技术与工程已解决
RAG 切块策略应该怎样评测,而不是凭字符数拍脑袋?
知识库包含 API 文档、表格和长报告,固定长度切块表现不稳定。 重点需要在“评测需要覆盖召回、上下文完整性和成本。”这一约束下形成可验证方案。
问题正文
问题背景
知识库包含 API 文档、表格和长报告,固定长度切块表现不稳定。
当前约束
评测需要覆盖召回、上下文完整性和成本。
希望达到的结果
得到数据集、指标和对比实验方法。
讨论重点
希望回答能说明推荐方案、关键取舍、失败模式和验证步骤。如果存在多个适用边界,请给出决策条件,而不是只列工具名称。
