生成AI記事に内部プロンプトが混入したらどう直す? ― 公開本文と執筆指示を分離する

ITニュースカテゴリを表すパンダのイラスト ITニュース

この記事について
この記事は、生成AIを活用した自動生成フローで作成しています。OWASPのLLMセキュリティ資料を参照し、旧記事に混入していた内部執筆指示を除去して内容を再構成しました。

検証ステータス:📘 公開本文の構造確認済み

生成AIで記事を自動生成していると、style_prompt、構成指示、モデル向けの注意書きなど、本来は公開しない内部情報が本文へ混ざることがあります。これは単なる見た目の問題ではなく、公開データと制御情報の境界が崩れているサインです。

公開本文と執筆指示を別データにする

記事本文へ「見出しをこの順で出力する」「この文言は出力禁止」といった制御文を混ぜず、執筆ルールは専用ファイルやシステム側へ置きます。WordPressへ渡すのは公開用本文だけにします。

公開前に機械チェックする

たとえば次の語や構造が本文に残っていたら、公開を止める検査を入れられます。

style_prompt
system_prompt
internal prompt
developer message
<h1>  # テーマ側がタイトルを出す場合

ただし、単純なキーワード除去だけで安全になるわけではありません。重要なのは、生成AIへ渡す制御情報と公開対象データを最初から別経路にすることです。

システムプロンプトを秘密保管庫として扱わない

OWASPは、システムプロンプトを秘密情報や本質的なセキュリティ制御として扱うべきではないとしています。APIキー、パスワード、内部トークンなどの秘密値はプロンプトへ埋め込まず、別の秘密情報管理機構で扱います。

公開後に見つけた場合

  1. 公開本文から内部指示を削除する。
  2. 本文H1やMarkdown漏れなど周辺の生成崩れも確認する。
  3. 秘密情報が含まれていた場合は、本文削除だけで終わらず該当秘密の失効・再発行を検討する。
  4. 同じ生成経路の記事を横断検索する。
  5. 公開前バリデーションを追加して再発を防ぐ。

公式情報・一次情報

この記事の更新履歴

  • 2026-09-13 追加:公開本文と内部指示の分離、公開前検査、発見後の対応手順を追加。
  • 2026-09-13 変更:内部執筆指示がそのまま公開されていた記事を、プロンプト漏えい対策の実務記事へ再構成。
  • 2026-09-13 削除:style_prompt、構成指示、重複H1、未検証の半導体ニュース本文、架空コード例を削除。

文書情報

記事タイトル
生成AI記事に内部プロンプトが混入したらどう直す? ― 公開本文と執筆指示を分離する
作成日
更新日
Source URL
https://papanda925.com/?p=5337

ライセンス: 本記事のうち、当サイトが権利を有する本文・自作図表は、特記なき限り CC BY 4.0 で利用できます。生成AIを活用して作成・編集した内容を含みます。コードについて、別途ライセンス表示またはリンク先GitHubリポジトリのライセンスがある場合は、その条件を優先します。引用・第三者資料・画像・商標等は本ライセンスの対象外です。 利用ポリシー

タイトルとURLをコピーしました