目前,世界上最强大的 AI 模型都托管在云端你无法控制的服务器上。AI 智能体释放了巨大的生产潜力,但这种潜力被一个巨大的妥协所束缚:要完成任何有用的事情,你就得盲目地把敏感信息发送到自己的基础设施之外。

我们认为围绕这一点的漠不关心是危险的。把原始的工作流数据交给云端端点会带来你以前没有面临过的风险,包括:

  • 训练数据收割:你的专有代码和私人数据被用来训练未来的 AI 模型。
  • 攻击面扩大:多出一个故障点,你的数据可能因安全漏洞或意外泄露而暴露。
  • 监管风险:围绕跨境或第三方数据共享的义务(例如 GDPR、HIPAA),你突然之间就必须遵守。
  • 第三方变现:AI 提供商根据含糊的服务协议将你的数据分享给分包商,或直接将其变现。
  • 凭据泄露:暴露你的运营数据、商业机密和客户的机密数据;窃取你的创新创意、内部 IP 地址和 API 密钥。
  • AI 提供商利用你的内容对付你:你发送的数据可能根据你所写的内容触发不透明的限制、惩罚性定价或服务拒绝——例如,因为代码库中提到了竞争工具而被额外收费或被拒绝服务(Hacker News)。

为了应对这一问题,我们发布了一个名为 Agent Redactor 的 MIT 开源解决方案。Agent Redactor 是一个本地安全代理,位于你的 AI 智能体和大语言模型(LLM)之间。我们喜欢把它看作是你敏感数据的透明 AI 防火墙。

它利用设备端的 ONNX AI 模型,结合确定性的正则表达式和关键词规则,在任何数据离开你的设备之前,自动检测并脱敏 API 请求中的个人身份信息(PII)、凭据和专有数据。随后,软件会在 LLM 的响应中无缝还原原始值,甚至能跨流式传输的分块重新拼接。你的工作流永远不会中断,但云提供商只能看到 <<REDACTED_PII_1>>。通过确保敏感数据和 API 密钥严格保留在本地,Agent Redactor 让开发者和企业能够安全地采用 AI 工具,而不必牺牲数据隐私或合规性。

拿着油性记号笔的 Agent Redactor 狐狸吉祥物

为什么选择 MIT 开源?

我们相信,像这样的隐私软件必须是开源的。信任需要验证,而不是给予。

AI 提供商已经声称你的数据是安全的,但泄露事件仍在不断被披露。仅凭言语无法赢得信任。我们没有只是告诉你 Agent Redactor 是安全的,而是将其以 MIT 许可证发布,这样你就可以亲自验证。没有遥测,没有必需注册的账户,也没有隐藏的云端调用。

任何人都可以阅读源代码,清楚地看到它做了什么,并据此监督我们。随着时间的推移,我们希望这种开放能吸引贡献者提交代码、报告缺陷,并以我们无法独自完成的方式帮助强化这个工具。这就是开源的真正优势:问题能够被快速发现和修复——公开地,由比我们更多的人共同完成。

我们目前的进展

Agent Redactor 的首个版本支持 Windows,现已可用。macOS 和 Linux 版本即将推出。

你可以在 agentredactor.negativestarinnovators.com 阅读文档并下载应用,或在 Agent Redactor 的 GitHub 仓库审计我们的代码。试用一下,保护你的机密,并告诉我们你的想法。