LLMといっしょに小説を書き始めて1ヶ月の感想

無限にプロットを修正しているのでまだ書き始めてはいない。プロットを起こすのも書くうちに入ってるので書いてることにする。

ローカルのGemma3で作業してたんだけど、ローカルだとせいぜい8000トークンくらいしか引き回せない。Gemini Advanced が1ヶ月無料なのでとりあえず1ヶ月使うかという気持ちで Google One のアップグレードをしたのが連休入る前。半月くらい使ってみての結論は、もうローカルに戻れないなという感じ。月額払いましゅう……。

Gemini 2.5 Proは100万トークン使える。この一点だけでGeminiを使おうという気持ちになっている。小説一本書くには文庫1冊分の本文だけで10万トークン必要になる。なので10万トークンそこそこのLLMは基本的に使えません。だって舞台設定とかプロットとか一緒にコンテキストに乗せる必要があるんだから、本文もコンテキストに乗せようとしたらあふれるよね。

Google AI Studio の Gemma 3 27B は完全に無料で使うことができて、API経由でも使える。一日とか一ヶ月の利用制限はあるけど、まあほとんど制限内で使えると思う。Gemma 3 を普通に使うんだったら Google AI Studio でいいだろう。ローカルで使う用途があるとすれば、1Bとか4Bの軽量モデルをアプリケーションに組み込んだり、アカウント停止措置を取られそうなセンシティブなプロンプトのテストをしたいとき。ローカルで環境立てられるのにこしたことはない。それ以外は Google AI Studio でよい。ただし128Kトークン、つまり10万トークンくらいなので、さっき書いたとおり、文庫1冊分の本文を食わせて終わり。これだとちょっと厳しい。Gemini は 100万トークン使えるので、使うなら Geminiの方がいい。性能もいい。Google AI Studio で Gemini 2.5 Pro / Flash を使うのはレートリミット考えるとけっこう苦しいが、2.0くらいならそれなりに使えるんじゃないかと思う。Gemini 2.5 Pro を使うなら Gemini Advanced から。まあでもAPI 課金してもいいと思う。2025年5月現在なら同等の性能帯で一番安いはず。

Gemini 2.5 Pro の他、Meta の Llama 4 Maverick、OpenAI の ChatGPT 4.1など100万トークンのロングコンテキストモデルが続々出てきているので、今後はみんな100万トークンの世界になると思う。Claude 3.7も今はまだなってないけど100万トークンに拡張されることが予定されている。そうなってくるとClaude 3.7 も捨てがたい。でもGemini Advanced は定額で使い放題なのがあまりにも魅力的で。APIGoogle AI Studio という別のサービスになるので対象外だけど、NotebookLM PlusでRAGとして使ったりできるし、Google Drive 2GB 付いてくるし、などを考えると、とりあえず今のところは無料期間過ぎてもこのままサブスク継続することになるかなーと思っている。Google Drive 2GBはもともと使ってたけどね。差額で Gemini Advanced が付いてくるって感じなのであんまり高い感じはしてない。

NotebookLM PlusはNotebookLM の利用上限と使える機能が拡張されたやつで、ファイルの内容についてラジオ風に解説する音声を生成する謎機能がある。これがけっこうおもろくて、まだ本文書いてない作品のプロットをわたしたらあたかも作品が存在するかのように感想を語り合ってくれる。個人で創作してると孤独感と戦うことになるが、これはなんかそれなりに孤独感をやわらげる効果がある気がする。

NotebookLMもGemini Advanced も使うならGoogle Docsと連携して使ったほうが便利。Google Docsは正直あんまり使い勝手はよくない。ローカルで書いたテキストをGoogle Docs に同期するみたいなのがやりたい。

Gemini 使って何をやっているかというと、プロットと舞台設定、キャラクター設定をまとめたテキストを投げて、「このファイルの内容を評価して」みたいな感じで中身についての意見を出力させる。「キャラクターの感情変化に焦点を当てて」とか「ストーリーに矛盾はないか」とか「舞台装置的すぎるキャラクターはいないか」とか「背景情報に不足はないか」とか、そういう感じで聞くとよい。そうすると「このキャラクターの行動原理が薄いので掘り下げる必要がありそう」とか「この設定についての説明がないので深い背景情報を補足したほうがいい」とかの課題点をピックアップしてくれる。つまり Gemini を担当編集として使っている。Gemini はよくも悪くも好みとか癖があんまりないので、出てくるものの評価も基本的には王道から外れない。そこの独創性は自分がやればいいところなので、人間が冒険して、LLMに軌道修正させるというやり方が向いている。

同じことをClaudeでやったところClaudeは更に既存市場の類似作品との差別化みたいな話まで勝手に始めたのでびっくりしてひっくり返っちゃった。そこまで頼んでない。でも作品のウィークポイントの指摘もClaudeのほうが鋭い感じがある。今のとこ一番創作向きな気がする。コンテキストウインドウ拡大したら契約するかも。

プロットが出来上がってないものについても、スタートとゴールを決めて、「この結末を迎えるまでの過程として必要になるエピソードを提案してください」みたいな感じで聞いたらそれっぽいエピソードを出してくれる。ここで提案されるエピソードの出来自体はわりとどうでもよくて、出てきたものを見て今自分がどういう内容を欲しているのか気付きを得るのが目的。出てきたエピソードのいいところを拾い上げ、悪いところを改善して、プロットに組み込んでLLMに「提案された内容をもとに以下のようなプロットを組みました。意見をください」って聞く。そうすると出来上がったプロットがストーリー上どういう機能があるのかとか不足している内容とかを教えてくれる。これを繰り返していくとだんだん形になっていく。

LLMがなくて自分一人で書いていた頃は、自分で書いて自分で読み返してを繰り返すんだけど、自分で書いた内容について評価するのって本当に難しくて、何しろ自分は内容を知っているし背景情報も脳内にあるから何が不足しているのかわからない、気付けない。今は壁打ち相手になってくれる。苦手だったところを補ってくれる感じがする。書きたいアイデアを具現化しやすくなった。ていうか世の中の人はよくこんなこと個人でやってるな……なんでできるんですか?

aoitaku.hatenablog.com

8年前のわし、いいこと言ってる。ちゃんとその時代が来つつあるというか飛び越えていくよ。自然言語を評価するためのspecを自然言語で記述して評価させるところまで来てる。逆にいうと形式的なspecから形式的な評価を出力させるのはかえって手間がかかるわりにそこまででもないんじゃないかと思う。機械的に検査するのはもうだいたい出来る。

あのとき書けなかった物語が今は書ける。あらためてそう思う。

こちらからは以上です。