·著者: AI Resource Hub Team
プロンプトインジェクション攻撃と防御:開発者ガイド
プロンプトインジェクション攻撃の仕組み、実例、LLMアプリケーションを保護する実証済みの防御戦略を学びます。
プロンプトインジェクションとは?
攻撃者が細工された入力でLLMの動作を操作し、指示を無視させたり機密データを漏洩させる攻撃。
攻撃タイプ
- 直接インジェクション: 以前の指示を無視するよう明示的に指示。
- 間接インジェクション: 取得コンテキストに隠された悪意ある指示。
- ジェイルブレイキング: 安全ガードレールを回避。
防御戦略
- 入力サニタイゼーション: 疑わしいパターンをフィルタ。
- 指示階層: システム指示とユーザー指示を明確に分離。
- 最小権限: 不要なデータにアクセスさせない。
- ガードレール: Guardrails AIやNeMo Guardrailsを使用。
セキュリティプロンプト