AIエージェント能力アトラス › 仕事ごとの一覧 › 基盤能力(横断) › ツール使用・API・MCP
API/関数呼び出しの正確性
Function/API calling accuracy
4/52026年: 専門家並み
2030年(予測): 5/5 専門家超え
2030年(予測): 5/5 専門家超え
02022
22023
32024
42025
42026
42027予
52028予
52030予
0 できない / 1 デモ止まり / 2 補助 / 3 実務品質(要確認) / 4 専門家並み / 5 専門家超え。「予」は予測。
専門家と比べて
APIドキュメントを読んで正しい引数を組み立てる作業はジュニアエンジニア以上の速度・正確性に達している
できること
数百のツール定義から適切な関数を選び、型に沿った引数で呼び出す。構造化出力の遵守率は高水準
まだできないこと
ドキュメント化されていない暗黙の制約(レート制限の実運用挙動など)への対応は失敗しやすい
なぜそうなのか
関数呼び出しは訓練データ・RLHFで重点的に強化されてきた領域であり、フォーマット遵守は成熟技術
これからの予測の根拠
既に高水準のため2028年までの伸びしろは主に長鎖ツール呼び出しの信頼性向上に限られる
いま使える主な道具
Claude (tool use)、GPT-5.x function calling、MCP
根拠
- Tau Bench: The 2026 Enterprise Evaluation Guide 2026-05
τ-benchでのツール使用評価、2026年5月時点のリーダーボード結果
同じ分野のほかの仕事(ツール使用・API・MCP)
AIエージェント能力アトラス 2026(2026-09-06 時点・v1.0)の1マスです。レベルは公開された実験・ベンチマーク・報告から付けた目安で、2027年以降は予測です。全マスに根拠のリンクがあります。作者は個人で、AI(Claude)と一緒に調べて作っています。