マーケティング会社のGraphiteによる新しい研究は、大規模言語モデル(LLM)をより自然に聞こえるようにする試みにもかかわらず、最先端モデルは、その散文を人間の執筆と区別する特定の言語的な「特徴(tells)」に依存し続けていることを示している。
研究者たちは、人間の執筆と比較して、AI生成コンテンツにおいて少なくとも2倍以上の頻度で現れる13,000のフレーズを特定した。エムダッシュ(—)を頻繁に使用するといったよく知られた指標は、Gemini 3.1 Proがそれらをほぼ完全に排除しているように、減少に成功しているが、他の固有のパターンが新たに現れたり、持続したりしている。
Graphiteの分析によると、AnthropicのClaudeモデルは、時間の経過とともに人間の単語分布に近づいていることが分かった。例えば、Claude Opus 5.5は、前身であるOpus 5よりもエムダッシュの使用頻度が99%低い。しかし、Opus 5.5は依然として、人間のサンプルよりも「dependable」という単語を23倍多く使用したり、「this matters」のようなフレーズを多用して重要性を強調したりするなど、特定の癖を見せている。
対照的に、OpenAIのAstraモデルは、人間のような単語分布からさらに遠ざかっているようだ。Astraの執筆は「修正的なフレーミング(corrective framing)」によって特徴付けられる。これは、あるトピックを単に「Xではない」とするのではなく、「Xに頼るのではなく」と表現することを指すが、このパターンは、人間の執筆よりもAstraの散文において100倍以上の頻度で発生している。
研究者たちは、開発者が最も明白な特徴を排除することに成功するにつれて、新しいパターンが現れることを示唆している。GraphiteのチーフAIオフィサーであるGreg Druckは、これらは数十億のパラメータを持つ巨大なモデルであるため、ラボがすべての言語的な特異性を完全に制御することは困難であると述べている。
出典
- Opus 5.5 loves to tell you ‘this matters’ (and other AI writing tells) (TechCrunch AI, 2026-10-01)
- Graphite