AIが書いた文章に現れる7つの兆候

測定できるものが4つ、感覚で捉えるしかないものが3つ――そして両者の正直な限界。

最も信頼できる兆候は機械的なものです。一定の頻度で現れる長いダッシュ、曲線引用符、不可視のUnicode文字、絵文字付きの箇条書きが該当します。文体レベルの兆候――遠回しな表現、「XだけでなくY」という構文、不自然に揃った段落の長さ――は弱い手がかりにすぎません。どれも単独では何も証明しません。これらは証拠ではなく、あくまでパターンです。

実際に測定できる4つの機械的な兆候

これらは数えられます。ツールにかければ印象ではなく数値が得られるため、雰囲気頼みの判定よりもはるかに有用です。

1. 一定の頻度で現れる長いダッシュ。 チャットモデルは長いダッシュ(—)を人間よりもはるかに一定の頻度で使います。キーボードショートカットを必要とするため、ほとんどの人は入力方法自体を知らないからです。長い文書に1つか2つなら普通です。おおよそ段落ごとに1つ、均等に散りばめられているのは普通ではありません。この習性が根強い理由は長いダッシュの解説で詳しく扱っています。

2. 曲線引用符と組版上の句読点。 AIの出力には、方向のある引用符(“ ”)、曲線アポストロフィ(’)、3つのピリオドではなく本来の省略記号(…)が含まれがちです。ワープロソフトもこれらを自動で生成するため、自動修正が介入しない文脈――プレーンテキストの入力欄、コードのコメント、CSVファイルなど――でのみ意味を持ちます。

3. 不可視のUnicode文字。 ゼロ幅スペース、ノーブレークスペース、狭いノーブレークスペースは、チャット画面からのコピー&ペーストでしばしば残存します。目では検出できず、手入力でこれらが混入することはほぼないため、機械的な指標としては最も強力です。

4. 絵文字付きの箇条書き。 各項目の先頭に装飾的な絵文字が付いた構造化された回答、本物の見出しではなく太字で作られたセクション見出し、3段階にネストされたリストは、チャットインターフェースが促すハウススタイルであり、ほとんどの人間の書き手は使いません。

よくある特徴1Delve into the multifaceted landscape2It's not just X — it's Y3“Smart quotes” and … ellipses4✅ Emoji-headed bullet lists
AIチャットからのコピー&ペーストで残りやすい4つの機械的なパターン。

3つの文体的な兆候――弱いが、知っておく価値はある

文体レベルのパターンは判断を誤りやすいものです。丁寧な人間の文章にも同じ特徴が多く見られるからです。これらは結論ではなく、詳しく見るためのきっかけとして扱ってください。

5. 曖昧で均等にバランスの取れた構成。 あらゆる問いに妥当な両面があるかのように提示する文、問いを繰り返して始まる段落、何も付け加えずに要約して終わる結び。この傾向は、有用であることと無難であることを同時に求める学習に由来します。

6. 「XだけでなくY」という構文。 「注目に値するのは」「深く掘り下げる」「複雑さを乗り越える」「今日のめまぐるしい世界では」といった表現も同様です。これらは禁句ではなく、普通の英語です。目立つのは、短い文章の中にこれらが異常な頻度で集中することです。

7. 不自然に均一な構造。 ほぼ同じ長さの段落、疑わしいほど箇条書きの数が揃ったセクション、序論をなぞる結論。人間の下書きはもっと凸凹しています。その話題について書きたいことが多ければ、その段落は長くなります。

特に語彙のシグナルは急速に陳腐化します。「AIっぽい単語」のリストが出回るたびに、それは人々の書き方にも次世代モデルの調整にも吸収されていきます。機械的な兆候の方が長持ちするのは、文体ではなくエンコーディングの副産物だからです。

文書を一度にチェックする方法

実際的な手順を、最も手軽なチェックから順に示します。

  1. 不可視文字をスキャンする。 最もシグナルが高く、手間も最小のチェックです。文章を不可視文字スキャナーに貼り付けてください。検出されたゼロ幅スペース、ソフトハイフン、バイトオーダーマーク、方向制御文字がすべて件数付きで表示されます。
  2. 機械的な痕跡をまとめて数える。 AI文章クリーナーは、長いダッシュ、曲線引用符、不可視文字、絵文字を一度にレポートします。1つずつ追いかけるのではなく、複数のシグナルが同時に現れているかを確認できます。
  3. 文体的なパターンを読み取る。 件数を確認した後でのみ行います。数字を先に見ることで、自分を納得させるような結論に流されずに済みます。
  4. 文脈を考慮する。 Wordから貼り付けた文章には、誰が書いたかに関わらず曲線引用符が含まれます。プレーンなテキストエリアに直接入力された文章には含まれません。

重要なのは同時出現です。長いダッシュが1つあるだけでは何の意味もありません。プレーンテキストのフォームに直接入力されたはずの文書に、長いダッシュ曲線引用符2つのゼロ幅スペース絵文字付き箇条書きが揃っているなら、それは本当に珍しい組み合わせです。

どれも証拠にならない理由

上記のすべての兆候には、無辜の説明が存在します。

WordやGoogleドキュメントは、ハイフン2つを長いダッシュに、直線引用符を曲線引用符に自動変換します。現代のWebサイトからコピーすれば不可視文字が混入することもあります。プロの編集者は、まさに機械生成に見えるバランスの取れた曖昧な文体で書きます。英語を母語としない書き手は、より形式的で構造的に整った文体で書くことが多く、商用のAI検出ツールが彼らの文章を著しく高い割合で誤検出するのはそのためです。

明白な循環性もあります。AIの出力をテキストエディタに貼り、クリーンアップを実行すれば、機械的な兆候は約10秒ですべて除去できます。最も測定しやすいシグナルは、最も消去しやすいシグナルでもあるのです。

ですから、正直な結論はこうです。書式分析が教えてくれるのは文書にどんな文字が含まれているかです。誰がそれを入れたかは教えてくれません。私たちのツールがあえて件数だけを報告し、判定を下さないのは、判定とは数字という衣をまとった推測にすぎないからです。誰かが書いたものかどうかを知る必要があるなら、答えはダッシュを数えることではなく、本人と話すこと――草稿の履歴、参照元、自分の主張を説明できるかどうか――から得られます。

よくある質問

AI生成文章の最も信頼できる兆候は何ですか?

ゼロ幅スペースなどの不可視のUnicode文字が最も強力な機械的指標です。通常のタイピングでこれらが生成されることはほぼない一方、チャット画面からのコピー&ペーストではしばしば混入します。ただし、Webサイトからのコピーでも混入し得るため、示せるのは執筆者ではなく貼り付け元の出所にとどまります。

AI検出ツールは実際に機能しますか?

信頼できるほどではありません。人間の文章に誤検出を出し――英語を母語としない書き手が特に影響を受けています――軽い編集で回避もできます。書式分析は具体的な痕跡を数えられますが、私たちのツールを含め、文章だけから執筆者を特定できるツールはありません。

長いダッシュや曲線引用符を使うと、AI使用を疑われますか?

疑われるべきではありませんし、非難の根拠としても不適切です。WordやGoogleドキュメントは通常のタイピングから両方を自動生成します。文書の印象が気になる場合は、句読点をプレーンなASCIIに変換すれば、文章を一文字も変えずに痕跡を除去できます。

AI生成文章からこれらの兆候を除去できますか?

はい、しかもすぐに――それこそが、これらが弱い証拠である理由です。長いダッシュの置換、引用符の正規化、不可視文字の除去は数秒で済みます。これは検出の主張を懐疑的に見るための理由であり、他人の成果を自分のものとして偽るための手法ではありません。

このガイドで紹介しているツール

関連ガイド