近すぎる言い換えは、下書きがどれほど正確で出典に基づいていても、公開されたその日のうちにページを取り下げさせることがあります。問われるのは内容の是非ではなく、文章がプレスリリースや年次報告書、企業の公式サイトにどれほど近いかという点です。それを最初に見つけるのは、たいてい人ではなくボットです。
Earwig's Copyvio Detectorは、新規記事や「Articles for Creation」への編集のほぼすべてに対して自動的に実行され、本文をウェブ上の公開情報と照合し、数秒で類似度スコアを返します。最終的な確認は人が行いますが、自動判定は下書きの内容を誰かが実際に読む前に行われることも珍しくありません。スコアが高ければ、出典の質にかかわらず、それだけで査読は止まってしまいます。
このパターンが特に多く見られるのは、「事実だけを、宣伝的な表現は避けて」といった指示に沿って書かれた下書きです。書き手はこの指示に、原文を書き換えるのではなく手直しすることで応えてしまいます。類義語に置き換える、節の順番を入れ替える、形容詞を削る――こうした修正では語彙は変わっても構造はほとんど変わらず、そして類似度検出の仕組みが見ているのは、まさにその構造なのです。
たとえば、あるプレスリリースにこうあったとします。「2011年に元エンジニア二人が設立したこの企業は、直近の会計年度に4000万ドルの売上高を計上した」。近すぎる言い換えは、骨格をそのまま残します。「2011年に元エンジニア二人によって設立されたこの企業は、直近の会計年度に4000万ドルの売上高を記録した」。本当の書き直しは、文からではなく事実から出発します。「元エンジニア二人が2011年にこの企業を設立した。提出された財務報告書によれば、翌年度の売上高は4000万ドルに達した」。情報は同じでも、構造はまったく異なります。事実から組み立てたのであって、誰かの文章を切り貼りしたのではないからです。
出典が示されていたとしても、原文にきわめて近い表現をそのまま使えば、盗用であると同時に、それとは別に著作権侵害にも当たり得る。根底にある事実がどれほど正確で出典に基づいていようと、それは変わらない。
その結果は、査読者が文体や特筆性について下す判断とは別の経路で進みます。近すぎる言い換えを理由に指摘されたページは、出典もろとも、その日のうちに白紙化されたり版指定削除の対象になったりすることがあります。著作権に関する削除は独自の優先度を持ち、通常の査読の順番をまるごと飛び越えるからです。査読者が挙げうる特筆性への疑問をすべてクリアした下書きであっても、最初から別の書き方をしていれば不要だったはずの書き直しに、なお何週間も費やすことになりかねません。
これを避ける習慣は、語彙の選び方とはあまり関係がありません。出典を一度読み、タブを閉じ、画面にまだ映っている言葉からではなく、事実そのものから文を書き起こすことです。本当に残す価値のある言い回し――特徴的な一節や、経営者による直接の発言――は、地の文に紛れ込ませてあたかも自分の言葉であるかのように装うのではなく、引用符に入れて出典を添えるべきです。
最初からこのやり方で書かれた記事が、二度指摘されることはめったにありません。それは借り物のようにではなく、書かれたもののように読めます。そしてそれこそ、人であれ自動化された仕組みであれ、査読者が最初の確認から見ていたものなのです。