← yuichi916.github.io
書き出しを、読者より先に読む。
冒頭を貼るだけ。Web小説1,222作品の読者評価で較正した物差しが、
あなたの書き出しがどのあたりにいるかと、直せる癖を返します。
0字
原稿はどこにも送信されません。ブラウザの中で数値に変換し、その数値だけを採点に送ります。
1,222作品で較正
(著者954人・5ジャンル)
0.73学習していないジャンルでの
判別精度(AUC)
81%上位10%に入った作品が
実際に高評価だった割合
何を測っているか
小説投稿サイトで読者が付けた評価の重さ(総合評価点 ÷ 評価した人数)です。
ブックマーク数ではありません。何人に届いたかではなく、読んだ人がどれだけ高く評価したかを測ります。
題材では減点しません。
漢字・カタカナをすべて記号に潰してから測っているので、「悪役令嬢」「婚約破棄」「転生」といった
題材はモデルに届きません。見ているのは句読点・語尾・会話の運び方だけです。
題材を残したほうが数字は上がりました(0.748 対 0.729)が、それは
「流行りの題材かどうか」を当てているだけで、書き手の役に立ちません。落としました。
できること・できないこと
| 問い | 答え |
| この書き出しは読者に高く評価されそうか | 測れます(AUC 0.73) |
| 直せる癖はどこか | 出ます(下の診断結果に) |
| 改稿の前後でよくなったか | 同じ物差しで比べられます |
| この作品は伸びるか・売れるか | 測れません |
| この1作の合否 | 保証しません |
AUC 0.73 は「高評価の作品と低評価の作品を1つずつ並べたとき、
正しいほうを高く採点する確率が73%」という意味です。1作ごとの当否ではなく、
並べたときの順序の精度です。
どう検証したか
Web小説5ジャンル1,222作品(著者954人)。各ジャンルで評価の重さの上位25%と下位25%を使い、
中間は使いません。
| ジャンル | 作品数 | そのジャンルを外して学習→当てる |
| 異世界恋愛 | 477 | 0.742 |
| ハイファンタジー | 308 | 0.729 |
| 現実世界恋愛 | 218 | 0.716 |
| ヒューマンドラマ | 83 | 0.708 |
| ローファンタジー | 136 | 0.611 |
| 加重平均 | 1,222 | 0.729 |
- 著者単位で分割。同じ作者が学習側と評価側に跨ると、作風を覚えただけの精度が出ます
- ジャンルを丸ごと外して当てています。未知のジャンルの原稿でもこの水準という意味です
- 並べ替え検定で、偶然ならどこまで出るかを実測(中央0.479・最大0.573)。p = 0.0099
- 本文の長さだけでも AUC 0.646 出るため、長さの帯を揃えても効くことを確認済み
- 同じ題材(婚約破棄・悪役令嬢・転生を含む385作品)の中に限っても 0.754 で分かれます
原稿の扱い
本文はサーバに送りません。 ブラウザの中で次の処理をします。
- 漢字・カタカナ・英字を記号に潰す(題材を消す)
- 2〜4文字のつながりに分解し、ハッシュ関数で番号に変える
- 番号ごとの個数だけを送る
送られるのは数字の並びだけで、そこから本文は復元できません。
サーバ側は本文が送られてきたリクエストを明示的に拒否します。
この診断でできないこと
- 売れるかは分かりません。 測っているのは「読んだ人が高く評価するか」です
- 1作品ごとの当否は保証しません。 2作品を並べたときの順序の精度です
- 冒頭12,000字しか見ていません。 中盤の失速や終盤の破綻は範囲外です
- 直せば上がるとは限りません。 相関を測ったものであって、因果を確かめたものではありません。
指摘された癖を機械的に潰しても、数字だけが動くことがあります
- 文学的な価値の評価ではありません。 小説投稿サイトの読者が付けた点数を正解に置いています
- 学習したのはWeb小説5ジャンルです。純文学・ホラー・推理は実測していません