GPT-6 Astra、直接攻撃は防ぐが文書埋め込みのプロンプトインジェクションに依然脆弱
GPT-6 Astra、直接攻撃は防ぐが文書埋め込みのプロンプトインジェクションに依然脆弱
| 項目 | 内容 |
|---|---|
| ジャンル | AI |
| 日付 | 2026-09-05 |
| 元記事 | The Decoder |
要約
OpenAIの最新モデルGPT-6 Astraは幻覚(ハルシネーション)の発生率を大幅に低下させ、直接的なプロンプト攻撃に対する防御力も向上している。しかし、AIが読み込む文書内に悪意ある指示を埋め込む「間接プロンプトインジェクション」については8.5%のシナリオで失敗することが研究者によって確認された。これはClaude Opus 5の4.8%失敗率を上回る水準であり、自律エージェントが機密情報を扱う用途での安全性に疑問符がつく。文書処理や自律エージェント運用においてモデルの能力が向上しても、入力データ経由の攻撃に対する脆弱性は残っており、エンタープライズ展開には追加の防御策が必要とされる。