AIエージェント能力アトラス › 仕事ごとの一覧 › ソフトウェア開発 › セキュリティ(脆弱性発見/ペンテスト/修正)
脆弱性発見・自動ペネトレーションテスト
Vulnerability discovery / automated penetration testing
4/52026年: 専門家並み
2030年(予測): 5/5 専門家超え
2030年(予測): 5/5 専門家超え
02022
12023
22024
32025
42026
42027予
52028予
52030予
0 できない / 1 デモ止まり / 2 補助 / 3 実務品質(要確認) / 4 専門家並み / 5 専門家超え。「予」は予測。
専門家と比べて
トップクラスのバグバウンティハンターに匹敵する事例が既に登場
できること
対象理解・攻撃経路計画・動的適応を自律で行い、実運用のバグバウンティで人間トップハンターと同水準の成果
まだできないこと
ビジネスロジック特有の脆弱性(業務文脈を理解しないと気づけない設計ミス)の発見
なぜそうなのか
パターン化された脆弱性クラスには強いが、対象システム固有の業務ルール違反は文脈理解が必要で弱い
これからの予測の根拠
DARPA AIxCCの成果が2025年8月に全てオープンソース化され技術普及が加速、2028年には自動化がさらに一般化すると予測
いま使える主な道具
XBOW、DARPA AIxCC finalists (Atlantis等)
根拠
- AI Pentesting Agents 2026: The Rise of 39+ Tools Tested 2026-06
39以上の自律ペネトレーションテストツールが主要な脆弱性クラス全てで稼働し、一部は経験豊富な人間研究者の検出率に接近 - Will AI Kill the Bug Bounty Industry? 2026-02
完全自律ペンテストエージェントXBOWが2025年7月にHackerOneグローバルリーダーボード1位を史上初めて獲得
同じ分野のほかの仕事(セキュリティ(脆弱性発見/ペンテスト/修正))
AIエージェント能力アトラス 2026(2026-09-06 時点・v1.0)の1マスです。レベルは公開された実験・ベンチマーク・報告から付けた目安で、2027年以降は予測です。全マスに根拠のリンクがあります。作者は個人で、AI(Claude)と一緒に調べて作っています。