ChatGPTが長いダッシュを多用するのは、書籍、エッセイ、ジャーナリズムなど、句読点を整理する標準的な手段として長いダッシュが使われる、プロが編集した文章で学習したためです。モデルはその習慣を、そもそもこの文字をほとんど入力しない一般的な人間の書き手よりもはるかに一貫して再現します。AI特有の印象を与えるのは、記号そのものではなく、その一貫性の差なのです。
この習慣はどこから来たのか
大規模言語モデルは、他のすべてと同じ方法で句読点を学びます。つまり、学習データからパターンを吸収するのです。そのデータは、書籍、長文ジャーナリズム、エッセイ、ドキュメントといった出版された、プロが編集した文章に大きく偏っています。その世界では、長いダッシュはまったく普通の存在です。校正者は、挿入句を区切ったり、要約を導いたり、文末の節の前に間を作ったりするために頻繁に使います。
一方、日常的なネットの文章はまったく違います。チャット、掲示板の投稿、メールでは、カンマや括弧、ピリオドが使われます。標準的なキーボードには長いダッシュのキーがないため、ほとんどの人は一度も入力したことがありません。
学習データに加えて、もう1つの圧力があります。モデルは、読者が「明確でよく書けている」と評価する文章を生成するように調整されており、長いダッシュはその仕事に非常に適しています。英語の句読点の中で最も柔軟な記号であり、カンマ、コロン、セミコロン、括弧の代わりに使えます。文に複数の記号が使える場面で、長いダッシュを選ぶことは常に無難な選択肢です。流暢で自信に満ちた文章を最適化するシステムは、何度もこの記号にたどり着くことになります。
長いダッシュがAIの兆候になった理由
長いダッシュが疑われるようになったのは、珍しいからではありません。一貫して出現するからです。
長いダッシュを入力するには意識的な手間が必要です。MacではOption + Shift + -、WindowsではAlt + 0151か自動修正ルールが必要です。ほとんどのスマートフォンのキーボードでは長押しの奥に隠れています。つまり、人間が長いダッシュを書く場合、それは通常意識的なスタイルの選択であり、出現は散発的です。長い文書の中に数回、書き手が劇的な間を狙った場所に集中します。
言語モデルにはそのような摩擦がありません。どの文字もコストは同じです。その結果、特徴的な統計的指紋が生まれます。
- 長いダッシュが、まとまって出るのではなく、すべての段落に一定の頻度で出現する。
- 多くの人がカンマを使うような、挿入句を挟む対として頻繁に使われる。
- 短い返信、箇条書きの項目、バグ報告など、本来は使われない文脈にも出現する。
これらのパターンは、どれも間違いではありません。単に人間の文章よりも規則的であり、その規則性こそが読者が気づく部分なのです。
文を壊さずに長いダッシュを削除する方法
よくある間違いは、すべての長いダッシュをハイフンに置き換えることです。ハイフンは役割の異なる別の文字であり、結果はきれいな文章ではなく誤字のように読めます。ダッシュが果たしていた役割に合わせて置き換え先を選びましょう。
挿入句を挟む対の長いダッシュは、通常カンマの対になります。挿入句が本当に余談なら、括弧のほうが適しています。
結論の前の単独の長いダッシュは、コロンの代役です。コロンに置き換えるか、文を終わらせて新しい文を始めます。
文中の単独の長いダッシュは、文に本来必要ないほど強い区切りを表していることがよくあります。どんな代替記号よりも、2つの文に分割するほうがほぼ常に読みやすくなります。
| ダッシュの役割 | 適切な置き換え |
|---|---|
| 軽い挿入句を挟む | カンマ |
| 余談を挟む | 括弧 |
| 要約を導く | コロン |
| 強い区切りを示す | ピリオドで文を分割 |
| 範囲を示す(2020—2024) | 長いダッシュではなくenダッシュ |
長い文書を処理する場合は、長いダッシュを削除ツールを使うと、すべての長いダッシュを選んだ代替文字に置き換え、変更した数をレポートしてくれます。何も表示しない検索・置換を信用するのではなく、自分の読みと数を照合できます。
長いダッシュを残すべきとき
文章から長いダッシュをすべて取り除くのは、やりすぎです。この記号が存在するのは、他の記号にできないことがあるからです。カンマより強く、ピリオドより終止感の少ない間を、セミコロンのような堅苦しさなしに作り出せます。
次の場合は残しましょう。
- 文に本当に強い中断が必要で、カンマでは弱すぎるとき。
- 長いダッシュを使った原文を引用しているとき。引用内の句読点を編集すると、引用そのものが変わってしまいます。
- ハウススタイルで求められているとき。ほとんどの出版社や多くの報道機関では、長いダッシュが自由に使われています。
- 小説や個人的なエッセイを書いているとき。機械的に見えないことよりもリズムが重要な場合です。
現実的な目標は、長いダッシュゼロではありません。自分で選んだからこそ現れ、自分の声を反映した頻度で現れる長いダッシュです。長い記事に1〜2個なら意図的に読めます。毎段落に1個では、デフォルトの設定に読めてしまいます。
長いダッシュはAI文章の証拠ではない
オンラインの多くのアドバイスが間違っているため、これははっきり述べておく必要があります。長いダッシュの存在は、何も証明しません。
人間の文章にも長いダッシュはたくさんあります。Microsoft WordとGoogleドキュメントはどちらも、ハイフン2つを自動的に長いダッシュに変換するため、書き手は文字を選んだ覚えもなく使っています。編集の訓練を受けた人なら本能的に使いますし、必須としている出版物もあります。
句読点からAI生成テキストを検出する信頼できる方法は存在せず、そう主張する商用ツールには誤検出率が高いことが十分に記録されています。特に英語を母語としない人が不釣り合いに影響を受けています。長いダッシュを証拠として扱うことは、それが学生や同僚への非難になったとき、現実の代償を伴います。
書式の分析が正直に伝えられるのは、機械的な事実だけです。この文書に長いダッシュがいくつあるか、曲線引用符がいくつあるか、不可視文字がいくつあるか。それらはカウントであって、判定ではありません。当サイトのChatGPT・AI文章クリーナーはまさにそれらの数値をレポートするだけで、誰が(あるいは何が)文章を書いたかについては一切主張しません。書式ツールができる唯一の妥当なことがらです。
AIの出力に伴う書式上の痕跡の全体像を知りたい場合は、AI生成テキストの兆候ガイドで残りを解説しています。
よくある質問
長いダッシュを使うと、文章がAI生成に見えますか?
それだけでは見えません。長いダッシュは編集済みの英語では標準的で、WordやGoogleドキュメントがハイフン2つから自動生成することもあり、人間の文章にも広く現れます。機械的に読めるのは、文書全体でほぼ段落ごとに1個という、高く均等な頻度の場合です。通常は曲線引用符や絵文字付きの箇条書きなど、他の痕跡も伴います。
長いダッシュは何に置き換えるべきですか?
役割に合わせて置き換え先を選びます。挿入句を挟む対はカンマか括弧に、結論を導く単独のダッシュはコロンに、強い区切りを示すダッシュは2つの文に分割するのが普通です。長いダッシュをハイフンに置き換えるのは避けてください。ハイフンは目的の異なる別の文字です。
ChatGPTはなぜカンマではなく長いダッシュを使うのですか?
長いダッシュは英語で最も柔軟な記号で、カンマ、コロン、セミコロン、括弧の代わりになれます。複数の記号が文法的に許容される場面では常に無難な選択肢となるため、流暢な文章を生成するように調整されたモデルは、不相応なほど頻繁にこれを選びます。
ChatGPTに長いダッシュを使わせないようにできますか?
プロンプトで「長いダッシュは使わず、カンマか文の分割を使ってください」のように直接指示できます。ただし従う精度は不完全で、長い回答では次第に元に戻りがちです。普通に書かせてから後でダッシュを削除するほうが、通常は早く済みます。
長いダッシュとハイフンは同じですか?
違います。ハイフン(-、U+002D)は複合語をつなぎます。enダッシュ(–、U+2013)は2020–2024のような範囲を示します。長いダッシュ(—、U+2014)は文中の句を区切ります。幅の異なる3つの別々の文字であり、互換性はありません。