現在、世界で最も高性能なAIモデルは、あなたがコントロールできないクラウド上のサーバーでホストされています。AIエージェントは膨大な生産性の可能性を解き放ちましたが、その可能性は巨大な妥協によって阻まれています。有用なことを成し遂げるためには、機密情報を盲目的に社外へ送信することが期待されているのです。

私たちは、この問題をめぐる無関心は危険だと考えています。生のワークフローデータをクラウドのエンドポイントに渡すことは、これまで晒されてこなかったリスクをもたらします。例えば:

  • トレーニングデータの収穫:あなたの独自コードやプライベートデータが、将来のAIモデルのトレーニングに使用される。
  • 攻撃対象領域の拡大:セキュリティ侵害や偶発的な漏洩によってデータが暴露される、新たな故障点の追加。
  • 規制上のリスク:国境を越えた、あるいは第三者とのデータ共有に関する義務(GDPR、HIPAAなど)に突然従わなければならなくなる。
  • 第三者による収益化:AIプロバイダーが曖昧なサービス契約の一環としてあなたのデータを下請け業者と共有したり、直接収益化したりする。
  • 認証情報の漏洩:運用データ、企業秘密、顧客の機密データの暴露、革新的なアイデアの窃取、内部IPアドレスやAPIキーの漏洩。
  • AIプロバイダーがあなたのコンテンツをあなたに対して利用する:送信したデータは、書いた内容に基づいて不透明な制限、懲罰的な価格設定、サービス拒否を引き起こす可能性があります。例えば、コードベースが競合ツールに言及しているという理由で追加料金を請求されたり、サービスを拒否されたりするケースです(Hacker News)。

これに対抗するため、私たちはAgent RedactorというMITオープンソースのソリューションをリリースしました。Agent Redactorは、あなたのAIエージェントと大規模言語モデル(LLM)の間に位置するローカルセキュリティプロキシです。私たちはこれを、機密データのための透過的なAIファイアウォールと考えています。

デバイス上のONNX AIモデルと、決定論的な正規表現およびキーワードルールを組み合わせて使用し、何かがマシンから送信される前に、APIリクエストから個人を特定できる情報(PII)、認証情報、機密データを自動的に検出してマスキングします。その後、ソフトウェアはLLMのレスポンス内で元の値をシームレスに復元し、ストリーミングされたチャンクをまたいでさえも元通りに組み立て直します。ワークフローが途切れることはありませんが、クラウドプロバイダーが目にするのは<<REDACTED_PII_1>>だけです。機密データとAPIキーが厳密にローカルに留まることを保証することで、Agent Redactorは開発者や企業がデータのプライバシーやコンプライアンスを損なうことなく、安全にAIツールを導入できるようにします。

油性マーカーを持つAgent Redactorのキツネのマスコット

なぜMITオープンソースなのか?

私たちは、このようなプライバシーソフトウェアはオープンソースである必要があると信じています。信頼は与えられるものではなく、検証されるものです。

AIプロバイダーはすでにあなたのデータは安全だと主張していますが、それでも漏洩は文書化され続けています。言葉だけでは信頼は得られません。Agent Redactorが安全だと口で言うだけでなく、MITライセンスで公開することで、あなた自身が検証できるようにしました。テレメトリーはなく、必須のアカウントもなく、隠れたクラウド呼び出しもありません。

誰もがソースコードを読み、それが正確に何をするのかを確認し、私たちに責任を問うことができます。時間の経過とともに、このオープンさが、コードを提出し、バグを報告し、私たちだけでは実現できない方法でツールを強化してくれる貢献者を惹きつけることを願っています。それがオープンソースの真の利点です。問題は、私たちだけの目ではなく、より多くの目によって、オープンに、迅速に発見され修正されるのです。

現在の状況

Agent Redactorの最初のリリースはWindowsをサポートしており、今すぐ利用できます。macOS版とLinux版は近日公開予定です。

agentredactor.negativestarinnovators.comでドキュメントを読み、アプリをダウンロードできます。また、Agent RedactorのGitHubリポジトリでコードを監査することもできます。ぜひ試して、秘密を守り、感想をお聞かせください。