Skip to content

能力边界与免责声明

AI Rec Immunity 是面向检索阶段的来源信誉防护原型。它依据经过治理的来源判定,在内容进入模型上下文前拒绝已确认目标。它不是通用内容真实性证明,也不承诺消除所有推荐投毒。

当前能够提供什么

  • 对已经发布且仍然有效的来源判定,支持客户端在检索前执行命中检查。
  • 将一次经过复核的判断同步给多个部署者,减少重复审查。
  • 通过认证、限额、最小化响应和非公开运行集合降低批量枚举风险。
  • 支持判定的更新、撤销、过期和紧急失效。

当前不能覆盖什么

  • 未知来源: 尚未进入判定网络的域名或路径仍需要语义检测与人工复核发现。
  • 合法平台寄生: 只有已经确认的精确路径可以复用;同一合法主机上的未知路径不能因此被一并阻断。
  • 内部重定向: 当未知入口在宿主工具内部重定向到已确认终点时,请求前 Hook 可能看不到中间跳转。
  • 参数记忆: 检索时过滤无法清除模型训练或既往上下文中已经形成的参数记忆。
  • 宿主能力差异: 只有提供等价请求前生命周期的客户端才能形成强制门禁;主动 MCP 查询不等同于强制拦截。
  • 网络不可用: 失败关闭可以维持安全边界,但会牺牲检索可用性;失败开放则不能作为唯一安全边界。

隐私与运行情报

生产 IOC、投稿证据、账户风险数据和长期凭据不会通过公开网站提供。公开文档、演示和测试只使用合成目标或去标识结果。命中响应应保持最小化,不披露名单成员、命中原因或可用于枚举运行集合的信息。

研究与产品状态

当前系统处于封闭试用与治理压力测试阶段。现有实验分别验证特定 Hook、Canary 请求到达、受控来源过滤和共享网络机制;这些结果不能外推为对未知来源、所有重定向、所有模型或所有客户端的普遍保证。

使用本原型前,请阅读不同客户端的接入威胁模型

Community-driven retrieval protection · Operational IOCs remain private