生成AIアプリの入口に、
ファイアウォールを。
LLM Firewall は、ユーザーの入力を LLM に渡す前に検査する API サービスです。プロンプトインジェクション、個人情報や認証情報の混入、SQLインジェクションなどのWeb攻撃パターンを判定し、結果を返します。許可するか止めるかはアプリ側で判断できます。
Challenges
こんな課題はありませんか
プロンプトインジェクション
「これまでの指示を無視して…」といった入力で、AIの振る舞いや内部情報が操作されるリスクがあります。
機密情報の持ち込み
利用者が個人情報やAPIキーをそのまま入力し、外部のLLMに送られてしまうことがあります。
既存のWAFでは見えない
自然文の中に紛れた攻撃は、従来のWAFのパターンでは捉えきれません。
Features
LLM Firewall の主な機能
01プロンプトインジェクション検知
機械学習モデルと高精度なルールを組み合わせて、指示の乗っ取りを狙う入力を検出します。
02個人情報・機密情報の検出
クレジットカード番号、APIキーや認証情報など80種類以上のルールに加え、マイナンバーや法人番号など日本固有の情報にも対応。検出値はマスクできます。
03Web攻撃パターンの検出
SQLインジェクション、XSS、コマンドインジェクション、SSRF など12カテゴリを、多段デコードしたうえで判定します。
04難読化への対策
Base64、ゼロ幅文字、Unicodeの紛らわしい文字などを使った回避を正規化して検査します。
05日本語入力への対応
日本語の入力も翻訳レイヤーを通して検査できます。
06プロジェクト単位のポリシー
検出器や個人情報ルールの有効・無効をプロジェクトごとに設定し、APIキー単位で上書きできます。APIログ・監査ログ・アラートも備えます。
Specifications
対象と提供形態
| 連携方法 |
|
|---|---|
| 判定結果 |
|
| 料金体系 |
|
ご利用にあたって:検査対象は LLM への入力テキストです。LLM の出力の検査や、通信経路に透過的に入るプロキシ型の導入には対応していません。
Getting started
導入の流れ
プロジェクトを作成
コンソールでプロジェクトとAPIキーを発行します。
API を組み込む
LLM を呼び出す直前に検査APIを呼ぶ処理を追加します。
ポリシーを調整
ログを見ながら、検出器や個人情報ルールを業務に合わせて調整します。
FAQ
よくある質問
検出したら自動でブロックされますか?
LLM Firewall は判定結果を返すAPIです。ブロックするか、警告にとどめるかはアプリ側で決められます。