トップ / サービス / LLM Firewall

生成AIアプリの入力検査

生成AIアプリの入口に、
ファイアウォールを。

LLM Firewall は、ユーザーの入力を LLM に渡す前に検査する API サービスです。プロンプトインジェクション、個人情報や認証情報の混入、SQLインジェクションなどのWeb攻撃パターンを判定し、結果を返します。許可するか止めるかはアプリ側で判断できます。

Challenges

こんな課題はありませんか

プロンプトインジェクション

「これまでの指示を無視して…」といった入力で、AIの振る舞いや内部情報が操作されるリスクがあります。

機密情報の持ち込み

利用者が個人情報やAPIキーをそのまま入力し、外部のLLMに送られてしまうことがあります。

既存のWAFでは見えない

自然文の中に紛れた攻撃は、従来のWAFのパターンでは捉えきれません。

Features

LLM Firewall の主な機能

01プロンプトインジェクション検知

機械学習モデルと高精度なルールを組み合わせて、指示の乗っ取りを狙う入力を検出します。

02個人情報・機密情報の検出

クレジットカード番号、APIキーや認証情報など80種類以上のルールに加え、マイナンバーや法人番号など日本固有の情報にも対応。検出値はマスクできます。

03Web攻撃パターンの検出

SQLインジェクション、XSS、コマンドインジェクション、SSRF など12カテゴリを、多段デコードしたうえで判定します。

04難読化への対策

Base64、ゼロ幅文字、Unicodeの紛らわしい文字などを使った回避を正規化して検査します。

05日本語入力への対応

日本語の入力も翻訳レイヤーを通して検査できます。

06プロジェクト単位のポリシー

検出器や個人情報ルールの有効・無効をプロジェクトごとに設定し、APIキー単位で上書きできます。APIログ・監査ログ・アラートも備えます。

Specifications

対象と提供形態

連携方法
  • REST API(APIキー認証)
  • LLM を呼び出す前に、入力テキストを送信して判定結果を受け取る
判定結果
  • 悪性かどうか・重大度・検出器ごとの結果
料金体系
  • 処理したトークン数に応じた従量課金

ご利用にあたって:検査対象は LLM への入力テキストです。LLM の出力の検査や、通信経路に透過的に入るプロキシ型の導入には対応していません。

Getting started

導入の流れ

  1. プロジェクトを作成

    コンソールでプロジェクトとAPIキーを発行します。

  2. API を組み込む

    LLM を呼び出す直前に検査APIを呼ぶ処理を追加します。

  3. ポリシーを調整

    ログを見ながら、検出器や個人情報ルールを業務に合わせて調整します。

FAQ

よくある質問

検出したら自動でブロックされますか?

LLM Firewall は判定結果を返すAPIです。ブロックするか、警告にとどめるかはアプリ側で決められます。

組み合わせると効果的なサービス

LLM Firewall の詳細・デモのご依頼

ご利用環境に合わせた導入方法や料金について、担当者からご説明します。