コメディをAIに書かせる — 外すことが構造的にできない

AIが最も苦手とするのが笑いです。理由は単純で、笑いは外すことで起きるからです。予想と違う語が来るから笑う。ところがモデルは、予想通りの語を選ぶように作られています。もっとも確率の高い続きを選ぶ装置に、外せと言っているようなものです。

笑いの条件は二つあり、両方必要

人が笑うのは、予測が裏切られたときです。ただしそれだけでは足りません。裏切られた結果が安全でなければ、笑いではなく恐怖や不快になります。

予測の裏切りと、安全性。この二つが同時に成立したときだけ笑いが出る。

だから書き手の仕事は二段構えになります。まず読者に予測させること。次にそれを外し、しかも外した先が危なくないと分からせること。前者を省くと何も起きません。裏切るには、まず予測を作らせなければならない。

「フリ」と呼ばれているものの正体はこれです。フリとは予測の生成装置であって、単なる前置きではありません。

笑いのツボは、最も個人差の大きい領域である

笑いは、恐怖と並んで個人差の大きい反応です。同じ文章を読んで、片方が声を出して笑い、片方が真顔になる。 これはどちらかの感覚が鈍いのではなく、単に異なるツボを持っているだけです。

市場が供給できるのは、ここでも最大公約数です。多くの人が笑う型は決まっていて、商業のコメディはそこへ最適化されます。自分だけが笑う種類のズレは、企画として通りません。

そのうえ、笑いは説明すると死にます。だから「こういう笑いが好きだ」と人に説明して探してもらうこともできない。自分のツボに合う作品を探す手段が、ほぼ存在しないジャンルです。

一人のために作れるというのは、ここでは特に効きます。誰にも受けなくていいなら、自分のツボだけを狙えます。 そして笑いは、狙いが合った瞬間の反応が最も分かりやすい。合っているかどうかを判定するのは簡単です。

間は、意味ではなく改行の位置で決まる

ここがこのジャンルの核心だと思います。

まったく同じ文章でも、どこで改行するかによって笑えるかどうかが変わります。語彙も語順も変えていないのに、です。

理由は、読者が文を読む速度を、書き手が改行で制御しているからです。改行は読み手に一瞬の停止を強います。その停止のあいだに読者は予測を完了する。そこへ次の行が来て、裏切る。

一行で全部書いてしまうと、予測が完了する前に答えが来てしまい、何も起きません。

要するに、笑いの技術のかなりの部分は、文章術ではなく組版です。

一行に収めた場合

 部長は真剣な顔で三十分も熱弁をふるったが、要するに昼飯をどこで食べるかという話だった。

配置を変えた場合

 部長は真剣な顔で、三十分、熱弁をふるった。

 全員が黙って聞いていた。誰も口を挟めなかった。

 昼飯をどこで食べるかという話だった。

天丼は、一回目が面白くないことに耐える技術

同じことを繰り返して笑いを取る手法を天丼と呼びます。三回繰り返すのが基本形とされます。

構造を分解すると、一回目は何も起きません。ただの事実です。二回目で読者が「またか」と認識する。三回目でようやく笑いになる。

つまり書き手は、面白くないと分かっている一回目を、平然と置いておく必要があります。ここで不安になって一回目から盛ると、三回目が効かない。

この「効かない一手を我慢して置く」という感覚は、伏線とよく似ています。実際、笑いの設計と推理小説の伏線設計は、思っているより近いところにあります。

ツッコミの機能は、読者の代行

会話のコメディでツッコミ役が置かれるのは、リズムのためだけではありません。

ボケだけを提示されると、読者は自分でそれが変だと判定しなければなりません。判定には時間がかかるし、そもそも変だと気づかない読者も出る。

ツッコミは、その判定を代行します。「それはおかしいだろ」と作中の誰かが言った瞬間、読者は判定作業から解放され、笑うことだけに集中できる。

だから、ツッコミの遅速がそのまま笑いの質を決めます。即座に入れると軽快になり、一拍置くと可笑しみが増し、最後まで誰も触れないと不穏になります。同じボケでも、ツッコミの位置で三通りの読み味が作れます。

長編ではキャラ、短編では状況

実務的な使い分けを一つ。

短い話では、状況の異常さで笑わせるのが効率的です。読者がキャラを覚える前でも成立します。

長い話になると、状況の奇抜さは続きません。読者が慣れるからです。長編で持つのはキャラのほうで、その人物が何をするかが予測できるようになってから、予測どおりのことをやることが笑いになる。

つまり長編のコメディでは、途中から笑いの構造が反転します。裏切りから、期待どおりへ。読者が「この人はこうする」と思っている状態を作れれば、あとはそのとおりに動かすだけで効く。

——AIが笑いを最も苦手とする理由

他のジャンルでもAIの弱点を書いてきましたが、コメディは群を抜いています。理由を分けて書きます。

一つめ。モデルは予測の外れを最小化するよう訓練されています。笑いは予測を外すことで起きます。ここまでは推理でも書きましたが、頻度が違う。推理は結末で一度外せばいい。コメディは数行おきに外し続けなければなりません。仕組みとの摩擦が、桁違いに大きい。

二つめ。上に書いたとおり、間は改行の位置で決まります。ところがモデルが最適化しているのは語の並びであって、紙面上の配置ではありません。意味の空間にはいますが、組版の空間にはいない。改行を「文の区切り」としては扱えても、「読者の予測が完了するまでの待ち時間」としては扱えていない。

三つめ。笑いには賞味期限があります。言い回しも、話題も、数年で古くなる。学習データは過去の集積なので、出てくるのは少し前に流行った形です。そして少し前に流行った笑いは、いま最も寒く感じるものでもあります。

四つめ、これが決定的だと思います。書き手は、自分の書いたギャグが滑ったかどうかを判定できます。読み返して笑えなければ、それは失敗です。この判定は理屈ではなく、反射で出る。モデルには、その反射がありません。自分の出力が面白いかどうかを検証する手段を持たないまま出力している。

付け加えると、笑いの一部は「言ってはいけないことの近くを通る」ことで成立します。現在のモデルはその近辺を避けるよう調整されているので、安全な側から出てこない笑いは、構造的に出にくい。

だから、人間が担うのは判定と配置

分担ははっきりします。

一つ、滑ったかどうかの判定。これは人間にしかできません。出てきたものを読んで、笑えないものを容赦なく削る。生成そのものより、この選別のほうが仕事です。

二つ、改行の位置。文章を書かせたあとで、間だけ自分で入れ直す。語を変えずに配置だけ直すと、効かなかったものが効くようになることがあります。作業としては短時間で済みます。

三つ、天丼の設置。何を三回繰り返すかを先に決めて渡す。放っておくと、一回目から面白くしようとして構造が崩れます。

逆に、周辺の状況描写、会話の肉付け、キャラの言動の量産は任せて構いません。素材を大量に出させて、笑えるものだけ拾う。打率が低くても、母数で押せる部分です。

最後に

コメディを書くときにいちばん効いたのは、技術論ではなく、自分が本当に笑ったことを思い出す作業でした。

面白い状況を考えるのではなく、実際に可笑しかった瞬間の構造を分解する。たいてい、大したことは起きていません。誰かが真顔で言った一言とか、間が悪かっただけとか。

その「大したことのなさ」を再現できると、作り物ではない笑いになります。派手な設定を考えるより、たぶん早い。

渡すのは、自分が笑った実例を一つ

実務では、「面白く」「コミカルに」は最悪の指示です。コメディの平均が返ってきます。自分が実際に笑った具体例を一つ渡してください。

その人のどんなズレで笑ったのか。言い方なのか、状況とのギャップなのか、繰り返しなのか、真顔でやることなのか。 一つ渡せば、AIは同じ型の場面を量産できます。型の複製は得意な作業です。

そして間は指示できません。改行の位置で決まるので、出てきた文章を自分で切り直すのが早い。 AIに三通り出させて、自分で改行だけ入れ替える。この作業だけは人間に残ります。

素材を大量に出させて、間と取捨だけ自分でやる

無料でAI小説を作る

登録で5,000ポイント付与。

よくある質問

ギャグが滑っている気がします

まず改行を疑ってください。語を変えずに配置だけ直すと効くようになる場合があります。それでも駄目なら、フリが足りていない可能性が高いです。

天丼が上手くいきません

一回目を面白くしようとしていませんか。一回目はただの事実として置くのが正解です。盛ると三回目が効きません。

長編でコメディが持ちません

状況の奇抜さで押していると必ず飽きられます。途中からキャラの一貫性で笑わせる構造に切り替えてください。

AIに書かせると笑えません

構造上そうなります。大量に出させて、笑えるものだけ選ぶ使い方のほうが現実的です。判定は人間にしかできません。

続けて読む