参照資料と検証状況
確認日：2026-10-11

以下は方法設計の参考資料。新しい配点・字数・抽出率が実証されたという意味ではない。
全文の再配布ではなく、URLと採用点・限界のみを記録する。

[S1] ハーメルン「必須タグ」
https://syosetu.org/?mode=readme_view&fid=17
一次資料：運営の公式説明。今回Web本文を確認。
採用：AI本文利用の定義と、文体の印象や検出サービスのみを客観的根拠としない扱い。
限界：タグは使用割合や本文品質を測る指標ではない。タグなしはAI不使用の証明ではない。
補助：検索関係の除外設定
https://syosetu.org/search/?mode=search_ngword
補助：ランキングの説明
https://syosetu.org/?fid=107&mode=faq_view
取得方式や仕様は次回実行時にも確認する。

[S2] 電撃小説大賞「編集部によるワンポイントアドバイス」
https://dengekitaisho.jp/novel/
一次資料：出版社・編集者による創作助言。今回Web本文を確認。
採用：見せ場の配置、人物の行動原理、言動の説得力、過不足のない文章。
限界：創作上の助言であって普遍的な採点規則ではない。市場で売れる題材、新人の伸びしろは本評価に移さない。

[S3] 集英社オレンジ文庫「2025年ノベル大賞 選評／三浦しをん」
https://orangebunko.shueisha.co.jp/online/2025novelaward_comment_miurashiwon
一次資料：作家による具体的な選評。今回Web本文を確認。
採用：整理された構成と人物の生きた感じは同一ではない。寄り道が厚みを作ることもある。
限界：一人の選考委員の判断。すべての作品に寄り道・心理の複雑さを要求しない。新人としての情熱・将来性を完成本文の点に移さない。

[S4] Ursula K. Le Guin, Navigating the Ocean of Story – Session 1
https://www.ursulakleguin.com/bvc-navigating-the-ocean-of-story-session-1
一次資料：作家本人の創作相談。今回Web本文を確認。
採用：show/tellの機械的な優劣づけをしない。説明的な語りも有効に機能し得る。
限界：英語圏の作家の助言。作家の個別の好みを普遍的な減点規則にしない。

[S5] Yuki Asano & Marco Bastos (2026)
How Creative Is AI Writing? Generative and Collaborative AI in Japanese Fiction
Journal of Creative Communications, online August 30, 2026
https://journals.sagepub.com/doi/10.1177/09732586261463934
DOI: 10.1177/09732586261463934
一次資料：出版社掲載の研究論文。直接openは取得に失敗したが、検索経由で出版社の本文を取得し、方法・結果・限界を確認。
概要：58人が25の日本語小説試料について、後半の4条件を順位評価。純文学11、エンターテインメント10、ラノベ4を含む。
採用：短い抜粋の整い方と、作品固有の魅力・語りを区別する。評価の好みや文脈欠落にも注意。
限界：LLM評価者・一般読者・専門家の日本語小説三者比較ではない。長編全体の評価実験でもない。人間AI共同制作が人間原文より優れるという統計的裏付けは得ていない。
日本語小説で英語研究と同一の語彙偏重を再現した証拠としては扱わない。

[S6] Murakami et al., Oogiri-Master: Benchmarking Humor Understanding via Oogiri
https://arxiv.org/abs/2512.21494
本文：https://arxiv.org/html/2512.21494v1
一次資料：著者による研究原稿。今回HTML本文を確認。
採用：日本語の笑いは単純な語彙量では評価できず、特徴を強く指示すると判断が悪化する場合もある。指標は文脈に従属させる。
限界：日本語大喜利の研究であり、小説の章構成・長期的読書体験の研究ではない。短いほど良いという小説採点には転用しない。

[S7] Evaluating Creative Short Story Generation in Humans and Large Language Models
https://arxiv.org/html/2411.02316v5
一次資料：著者による研究原稿。今回HTML本文の方法・分析を確認。
採用：評価者群による偏りと、語彙的複雑さに引っ張られる可能性への警戒。
限界：英語の5文の物語。訓練済み評価者は創作経験のある心理学大学院生2人。日本語ラノベ読者一般を代表しない。異なる単語数等との関連から語彙偏重の因果を断定しない。

[S8] 集英社オレンジ文庫「第231回短編小説新人賞 選評『24seconds』」
https://orangebunko.shueisha.co.jp/online/no231newfaceaward_comment_24seconds
一次資料：公開選評ページ。今回ページ取得を確認。
用途：人間の選考委員間で、好みと描写上の具体的な問題を分ける設計資料。
状態：この会話で既に選評が紹介されているため、未知の盲検テスト資料には使わない。新基準での作品本文の採点は未実施。

[S9] 集英社オレンジ文庫「第233回短編小説新人賞 選評『まちがいさがし』」
https://orangebunko.shueisha.co.jp/online/no233newfaceaward_comment_machigai_sagashi
一次資料：公開選評ページ。今回ページ取得を確認。
用途：同型の場面や反復を、意味の変化と読ませ方で判断する設計資料。
状態：この会話で既に選評が紹介されているため、未知の盲検テスト資料には使わない。新基準での作品本文の採点は未実施。

【検証台帳】
公式タグ定義：参照済み。
編集者・作家の助言：設計に反映済み。
日本語関連研究：上記範囲で参照済み。
新6軸の人間選評との一致検証：未実施。
独立した未読作品による確認：未実施。
実作品での順位逆転／提示順の安定性検証：未実施。
このパックのJSON・CSV・字数計算等の構造テスト：別添08_preflight_report.json参照。
構造テストの成功は、作品評価の妥当性を証明しない。
