コンテンツへスキップ
·著者: AI Resource Hub Team

プロンプトインジェクション攻撃と防御:開発者ガイド

プロンプトインジェクション攻撃の仕組み、実例、LLMアプリケーションを保護する実証済みの防御戦略を学びます。

プロンプトインジェクションとは?

攻撃者が細工された入力でLLMの動作を操作し、指示を無視させたり機密データを漏洩させる攻撃。

攻撃タイプ

  • 直接インジェクション: 以前の指示を無視するよう明示的に指示。
  • 間接インジェクション: 取得コンテキストに隠された悪意ある指示。
  • ジェイルブレイキング: 安全ガードレールを回避。

防御戦略

  • 入力サニタイゼーション: 疑わしいパターンをフィルタ。
  • 指示階層: システム指示とユーザー指示を明確に分離。
  • 最小権限: 不要なデータにアクセスさせない。
  • ガードレール: Guardrails AIやNeMo Guardrailsを使用。
セキュリティプロンプト