AIエージェント能力アトラス › 仕事ごとの一覧 › ソフトウェア開発 › レビュー・テスト・品質保証
コードレビュー(PRレビュー)
Code review (pull request review)
2/52026年: 補助
2030年(予測): 4/5 専門家並み
2030年(予測): 4/5 専門家並み
02022
12023
22024
22025
22026
32027予
32028予
42030予
0 できない / 1 デモ止まり / 2 補助 / 3 実務品質(要確認) / 4 専門家並み / 5 専門家超え。「予」は予測。
専門家と比べて
機械的な一次チェックはジュニアレビュアー相当だが、人間が指摘する論点の15〜31%しか拾えない
できること
スタイル・明白なバグ・既知の脆弱性パターンの機械的一次チェックを高速に実施
まだできないこと
設計意図との整合性、ビジネスロジックの妥当性など『高次の懸念』の指摘
なぜそうなのか
diffのみからのレビューでは変更の背景文脈が欠落し、人間が拾う論点の大半を見落とす
これからの予測の根拠
PR全体のコンテキスト(設計文書・過去議論)を統合するツールが増えれば改善するが、『高次の懸念』の検出は2028年でも人間主体が続くと予測
いま使える主な道具
CodeRabbit、Greptile、GitHub Copilot Code Review、Devin Review
根拠
- SWE-PRBench: Benchmarking AI Code Review Quality Against Pull Request Feedback 2026-03
フロンティアAIモデルはdiffのみのレビュー設定で人間指摘事項の15〜31%しか検出できない - AI Code Review Only Catches Half of Your Bugs 2026-01
AIレビューは機械的一次チェックとしては有効だが、高次の懸念は人間のレビュアーに依存すべきと結論
同じ分野のほかの仕事(レビュー・テスト・品質保証)
AIエージェント能力アトラス 2026(2026-09-06 時点・v1.0)の1マスです。レベルは公開された実験・ベンチマーク・報告から付けた目安で、2027年以降は予測です。全マスに根拠のリンクがあります。作者は個人で、AI(Claude)と一緒に調べて作っています。