AIエージェント能力アトラス › 仕事ごとの一覧 › 研究・問題解決 › 数学
競技プログラミング(ICPC/IOI級アルゴリズム設計)
Competitive programming (ICPC/IOI-level algorithm design)
2030年(予測): 5/5 専門家超え
0 できない / 1 デモ止まり / 2 補助 / 3 実務品質(要確認) / 4 専門家並み / 5 専門家超え。「予」は予測。
専門家と比べて
2025年ICPC世界大会でOpenAIのシステムが12問全問正解し、当時の世界最高人間チーム(11/12)を上回った。2026年IOIではNVIDIAのシステムが人間最高得点者を37点上回る535.4/600を記録し、大会史上初めて全人間参加者を上回った。
できること
実際の大会ルール・時間制限下で、未見のアルゴリズム問題群を人間トップチーム/選手を上回る正答率で解答できる。DeepMindのGemini 2.5 Deep Thinkは人間チームが誰も解けなかった問題を解いた。
まだできないこと
大会という明確な評価関数(テストケースのpass/fail)がない、仕様が曖昧な実世界のソフトウェア設計問題には同じ性能は再現されていない。単一大会での勝利であり、あらゆる形式のプログラミング業務への一般化は未実証。
なぜそうなのか
競技プログラミングは自己検証可能(サンプル入出力で採点)な閉じた問題であり、大量の強化学習・自己対戦的探索と相性が良い。曖昧な要件定義や長期保守性が絡む問題は評価信号が弱く、この強みが移転しにくい。
これからの予測の根拠
2025-2026年に既に人間トップを上回っており、以降も評価関数が明確な競技という性質上、優位は継続・拡大すると見て5を維持。
いま使える主な道具
GPT-5 (OpenAI reasoning ensemble)、Gemini 2.5 Deep Think、NVIDIA Nemotron-3-Ultra-CC + GenCorrect
根拠
- OpenAI and DeepMind Top World's Biggest Coding Contest 2025
OpenAIが12/12、DeepMindが10/12(人間最高は11/12) - OpenAI outperforms humans and Google at the world's top collegiate programming contest 2025
人間トップチームを上回った初の事例として報道 - NVIDIA AI Outscored Every Human at IOI 2026: How GenCorrect Made It Possible 2026-09
IOI2026で人間最高得点者を37点上回る535.4/600
同じ分野のほかの仕事(数学)
- 競技数学(IMO/Putnam級)
- 定理証明・形式化(Lean/Isabelle)
- 未解決問題への貢献(Erdős問題・主要予想)
- 大規模計算実験・構成的探索(AlphaEvolve/FunSearch型)
- 数学論文の査読相当チェック(証明検証・誤り検出)
AIエージェント能力アトラス 2026(2026-09-06 時点・v1.0)の1マスです。レベルは公開された実験・ベンチマーク・報告から付けた目安で、2027年以降は予測です。全マスに根拠のリンクがあります。作者は個人で、AI(Claude)と一緒に調べて作っています。