MCP 返回的网页或文档内容包含提示注入时,客户端应该在哪里拦截?
搜索 Server 会把不可信页面文本送入模型,内容可能诱导调用高权限工具。 重点需要在“不能简单删除所有指令性文本,也不能信任 Server 已清洗。”这一约束下形成可验证方案。
问题正文
问题背景
搜索 Server 会把不可信页面文本送入模型,内容可能诱导调用高权限工具。
当前约束
不能简单删除所有指令性文本,也不能信任 Server 已清洗。
希望达到的结果
得到内容标记、工具隔离与二次授权方案。
讨论重点
希望回答能说明推荐方案、关键取舍、失败模式和验证步骤。如果存在多个适用边界,请给出决策条件,而不是只列工具名称。
