AIエージェント能力アトラス › 仕事ごとの一覧 › コンテンツ制作 › 小説・物語
推敲・自己評価による改稿
Self-revision and quality self-assessment of a draft
3/52026年: 実務品質(要確認)
2030年(予測): 4/5 専門家並み
2030年(予測): 4/5 専門家並み
12022
22023
22024
32025
32026
32027予
42028予
42030予
0 できない / 1 デモ止まり / 2 補助 / 3 実務品質(要確認) / 4 専門家並み / 5 専門家超え。「予」は予測。
専門家と比べて
自己採点が甘く、外部審査(別モデル/人間)併用が前提の運用が標準
できること
文法・一貫性の機械的チェック、複数視点からのフィードバック生成、改稿案の並列提示
まだできないこと
自分の生成物の質を客観的に評価すること。自己評価の甘さは既知のバイアスとして繰り返し指摘される
なぜそうなのか
生成物を高く評価する方向のバイアスが訓練プロセス(人間フィードバックからの強化学習など)に起因する
これからの予測の根拠
自己評価バイアスは訓練目的関数由来のため短期改善は限定的。多審査員方式・外部ベンチマーク併用が主な進展経路と予測
いま使える主な道具
Claude Fable 5.1、GPT-5.6、外部評価パネル型ワークフロー(3審査員方式など)
根拠
- How to Evaluate AI Novel-Writing Quality in 2026: 7 Dimensions 2026
AI小説評価の7次元と、自己評価に頼らないことの重要性を提示
同じ分野のほかの仕事(小説・物語)
AIエージェント能力アトラス 2026(2026-09-06 時点・v1.0)の1マスです。レベルは公開された実験・ベンチマーク・報告から付けた目安で、2027年以降は予測です。全マスに根拠のリンクがあります。作者は個人で、AI(Claude)と一緒に調べて作っています。