AIエージェント能力アトラス › 仕事ごとの一覧 › 個人の生活 › 情報探索・調べもの・買い物比較
複雑な質問への検索AI回答(AI Overview/AI Mode)
AI-generated answers to complex questions (AI Overviews/AI Mode)
3/52026年: 実務品質(要確認)
2030年(予測): 4/5 専門家並み
2030年(予測): 4/5 専門家並み
12022
22023
22024
32025
32026
32027予
42028予
42030予
0 できない / 1 デモ止まり / 2 補助 / 3 実務品質(要確認) / 4 専門家並み / 5 専門家超え。「予」は予測。
専門家と比べて
図書館司書やコンシェルジュ並みの即応性はあるが正答率は劣る。Googleは年間5兆件規模の検索を処理しており、たとえ的中率9割でも毎時数千万件の誤答を生む計算になる
できること
複雑な多段階の質問への自然文回答、フォローアップ質問での文脈保持、複数ソースの統合要約
まだできないこと
事実正確性の保証(AI Overviewsの約半数に引用元が支持しない主張が含まれるとの分析あり)、基礎的な日付計算等の単純ミスの排除
なぜそうなのか
流暢さと事実正確性が分離しており、要約時に出典にない主張を混入させる傾向がある
これからの予測の根拠
Googleは2026年5月にReddit等一次情報の引用強化を発表するなど改善を継続するが、検索規模ゆえの絶対誤答数は当面残る
いま使える主な道具
Google AI Mode、Google AI Overviews、Bing Copilot
根拠
- Oumi's Study Finds 50% of AI Overviews Untrustworthy 2026
AI Overviewsの約半数が引用元に支持されない主張を含む - Google's AI Overview Struggles with Basic Calendar Math 2026-01
2027年が「来年ではない」と誤答する等の基礎的誤り事例
同じ分野のほかの仕事(情報探索・調べもの・買い物比較)
AIエージェント能力アトラス 2026(2026-09-06 時点・v1.0)の1マスです。レベルは公開された実験・ベンチマーク・報告から付けた目安で、2027年以降は予測です。全マスに根拠のリンクがあります。作者は個人で、AI(Claude)と一緒に調べて作っています。