Prompt Injection

読み方は「プロンプトインジェクション」。意味と使われ方を根拠つきで確認できます。

Prompt Injection
プロンプトインジェクション

複数資料で一致

30秒で分かる答え

Prompt Injectionは、ユーザー入力、文書、Webページ、メールなどに悪意ある指示を混ぜ、AIモデルやAIエージェントの本来の指示・目的から外れた出力や操作へ誘導する攻撃です。直接入力する場合と、取得した外部データに埋め込む間接攻撃があります。完全な文字列フィルターだけでは防ぎきれません。

AIへの指示を外部の悪意ある入力で上書き・誘導する攻撃

Prompt Injectionの意味・使い方

要点と背景

一行でいうと

AIへの指示を外部の悪意ある入力で上書き・誘導する攻撃

Prompt Injectionは、AIモデルへ渡される入力に攻撃者の指示を混ぜ、システム指示やユーザーの本来の目的に反する出力や行動を誘導する攻撃です。NISTの敵対的機械学習の用語整理では、プロンプト攻撃や、外部データに含まれる指示でAIエージェントを乗っ取る間接プロンプトインジェクションが、AIシステムのセキュリティ上の課題として扱われています。直接攻撃は利用者が入力欄へ悪意ある文を送る形、間接攻撃はWebページ、メール、文書、コード、検索結果など、エージェントが後から読むデータに指示を埋め込む形です。入力を命令とデータに完全分離することが難しいため、最小権限、ツールの許可範囲、外部データの隔離、出力検証、重要操作の確認、監視、レッドチームなどを組み合わせます。Prompt Injectionを防げるという単一プロンプトや特定の禁止語だけで安全性を保証せず、実際のデータ経路と実行権限を対象に継続評価します。

使われる分野・文脈

掲載データの使用場面

AIセキュリティAIエージェントプロンプト攻撃外部データ連携ガードレール

確認時の注意

断定を避けるポイント

NIST、OpenAI、Anthropicの資料で、入力や外部データ内の悪意ある指示による誘導と、権限・監視・検証を含む対策を確認した。単一の防御策で解決すると断定しない。

関連する用語

同じ分野・使用文脈から探す

根拠資料と確認状況

確認日・出典

確認状態

複数資料で一致

最終確認

2026/8/21

調査した根拠と項目別の確認履歴をもとに掲載しています。

掲載方針を見る

読み方と意味を、
分けて確認。

正式名称、意味、使われる分野を分けて記録しています。