AIエージェント能力アトラス › 仕事ごとの一覧 › 研究・問題解決 › 数学

競技プログラミング(ICPC/IOI級アルゴリズム設計)

Competitive programming (ICPC/IOI-level algorithm design)

5/52026年: 専門家超え
2030年(予測): 5/5 専門家超え
02022
12023
42024
52025
52026
52027予
52028予
52030予

0 できない / 1 デモ止まり / 2 補助 / 3 実務品質(要確認) / 4 専門家並み / 5 専門家超え。「予」は予測。

専門家と比べて

2025年ICPC世界大会でOpenAIのシステムが12問全問正解し、当時の世界最高人間チーム(11/12)を上回った。2026年IOIではNVIDIAのシステムが人間最高得点者を37点上回る535.4/600を記録し、大会史上初めて全人間参加者を上回った。

できること

実際の大会ルール・時間制限下で、未見のアルゴリズム問題群を人間トップチーム/選手を上回る正答率で解答できる。DeepMindのGemini 2.5 Deep Thinkは人間チームが誰も解けなかった問題を解いた。

まだできないこと

大会という明確な評価関数(テストケースのpass/fail)がない、仕様が曖昧な実世界のソフトウェア設計問題には同じ性能は再現されていない。単一大会での勝利であり、あらゆる形式のプログラミング業務への一般化は未実証。

なぜそうなのか

競技プログラミングは自己検証可能(サンプル入出力で採点)な閉じた問題であり、大量の強化学習・自己対戦的探索と相性が良い。曖昧な要件定義や長期保守性が絡む問題は評価信号が弱く、この強みが移転しにくい。

これからの予測の根拠

2025-2026年に既に人間トップを上回っており、以降も評価関数が明確な競技という性質上、優位は継続・拡大すると見て5を維持。

いま使える主な道具

GPT-5 (OpenAI reasoning ensemble)、Gemini 2.5 Deep Think、NVIDIA Nemotron-3-Ultra-CC + GenCorrect

根拠

アトラス全体の地図をひらく →

同じ分野のほかの仕事(数学)

AIエージェント能力アトラス 2026(2026-09-06 時点・v1.0)の1マスです。レベルは公開された実験・ベンチマーク・報告から付けた目安で、2027年以降は予測です。全マスに根拠のリンクがあります。作者は個人で、AI(Claude)と一緒に調べて作っています。