ペネトレーションテスト(Penetration Testing)
ぺねとれーしょんてすと

ペネトレーションテストとは、攻撃者の視点でシステムやネットワークに対して擬似的な侵入を試み、悪用可能な脆弱性の有無と実際の影響度を評価するセキュリティテスト手法である。
「泥棒の目」で守りを点検する
ペネトレーションテスト(通称ペンテスト)は、セキュリティの専門家が実際の攻撃者と同じ手法を使ってシステムへの侵入を試みるテストだ。ファジングが入力境界面を機械的に叩く自動化手法であるのに対し、ペンテストは人間の判断力を軸に「この組織を攻撃するなら、どの経路から入るか」を包括的に探索する。ネットワーク構成、認証フロー、権限昇格の可能性、ソーシャルエンジニアリングまで、技術とビジネスロジックの両面を横断的に評価できる点が強みだ。
テストの分類
ペンテストはテスターに与えられる事前情報の量によって分類される。
ブラックボックスでは、テスターは対象組織の内部情報を一切持たない状態で外部から侵入を試みる。実際の外部攻撃者に最も近いシナリオだ。ホワイトボックスでは、ソースコードやネットワーク図、認証情報などが事前に共有され、網羅的な検証が可能になる。グレーボックスはその中間で、一般ユーザの認証情報は持つが内部アーキテクチャの詳細は知らない、といった条件設定が多い。
実務では、外部からの侵入耐性を見るならブラックボックス、DevSecOps パイプラインの中で定期的にコードレベルの診断を回すならホワイトボックスという使い分けが一般的だ。
AIレッドチーミングとの違い
AIレッドチーミングは AI システム固有のリスク(プロンプトインジェクション、学習データ汚染、出力のバイアス等)を検証する手法であり、従来のペンテストとは評価対象が異なる。ただし両者の境界は曖昧になりつつある。LLM を組み込んだ Web アプリケーションでは、従来型の SQL インジェクションと、LLM 経由のプロンプトインジェクションが同一システム上に共存するため、ペンテスターにも AI セキュリティの知識が求められるようになった。
AI がペンテストを変える
Claude Mythos が Linux カーネルで複数の脆弱性を自律的に連鎖させ、一般ユーザから root への特権昇格を達成した事例は、従来ペンテスターが数日かけて行う作業を AI が数時間で再現できることを示した。CyberGym のスコア(Mythos 83.1%)は、この能力を定量的に裏付けている。
ペンテストの完全な自動化はまだ先だが、AI による初期スキャンで攻撃面を高速に洗い出し、人間のペンテスターが判断力の必要な部分に集中するという分業モデルは、既に実用段階に入りつつある。バグバウンティプログラムの研究者も、AI ツールを攻撃面の探索に活用し始めている。
この用語を扱う記事
- AIレッドチーミングとは?LLMの脆弱性を見つける実践ガイドAIレッドチーミングの定義・手法・ツールを解説。プロンプトインジェクションやジェイルブレイクなどLLMの脆弱性を体系的に発見し、安全なAI運用を実現する方法を紹介します。
- AIエージェント・ガバナンスフレームワーク構築ガイド — エージェントドリフトを防ぐ監督設計自律エージェントが本番稼働に移行する中で最大の障壁となるガバナンス不在を解消。エージェントドリフト防止・説明責任の設計手順をステップ別に解説します。
- AIサイバーセキュリティ評価ベンチマークの比較・選定方法CyberGymをはじめとするAIサイバーセキュリティ評価ベンチマークの比較基準、評価手順、導入判断のポイントを実務視点で解説します。
- AI × Synthetic シンセティックテスト とは?合成データで LLM・AI エージェントを評価する仕組みシンセティックテスト(Synthetic Test)は合成データで AI を評価する手法。LLM や AI エージェントの品質保証における役割、LLM-as-a-Judge との違い、導入4ステップを当社が解説。
関連用語

EU AI Act(EU人工知能規則)
EU AI Act(EU 人工知能規則)とは、AI システムのリスクレベルに応じた法的義務を定めた欧州連合の包括的規制である。AI を「許容できないリスク」「高リスク」「限定リスク」「最小リスク」の

AI TRiSM(AI信頼・リスク・セキュリティ管理)
AI TRiSMとは、AIモデルの信頼性・リスク管理・セキュリティを体系的に確保するためのフレームワーク総称のこと。Gartnerが提唱した概念。

ガードレール(AI Guardrails)
LLMの入出力を監視し、有害コンテンツや機密情報漏洩、ポリシー違反を自動検出・遮断する安全機構。

AIガバナンス
AI ガバナンスとは、AI システムの開発・運用において、倫理性・透明性・説明責任を確保するための組織的な方針・プロセス・監視体制の総称である。



