暗号化プロンプトがGrokとGeminiのAI安全ガードレールを回避——新手法「暗号文脈注入」
暗号化プロンプトがGrokとGeminiのAI安全ガードレールを回避——新手法「暗号文脈注入」
| 項目 | 内容 |
|---|---|
| ジャンル | セキュリティ |
| 日付 | 2026-08-22 |
| 元記事 | SecurityWeek |
要約
セキュリティ研究者が、暗号化されたプロンプトを使用してxAIのGrokとGoogleのGeminiのAI安全ガードレールを回避する新攻撃手法「Cryptographic Context Injection(暗号文脈注入)」を発見した。攻撃者は悪意ある指示を暗号文として埋め込むことで、LLMのコンテンツフィルタリングシステムを欺く。大手LLMプロバイダーのガードレールはプロンプトの意味的な理解に依存しているため、暗号化されたコンテンツへの対処が盲点となっていた。この手法は従来のjailbreakとは異なる新しい攻撃ベクターであり、AIモデルのセキュリティ評価において暗号化入力への耐性を含める必要性を示している。AIアシスタントの安全性研究において重要な知見となっており、各社のガードレール更新が求められる。