- AI文章偏好冗長正式單字,如significant、methodology
- 常用「不只是A,而是B」等對比句型
- 喜歡三段式列舉形容詞、例子或重點
- 文章結構過度工整,缺少節奏變化
- 長破折號非AI鐵證,ChatGPT使用頻率低於人類
- AI文章標點符號較少,較少引用專家說法
(綜合今日新聞、聯合報等2家媒體報導)
英國《經濟學人》近期大規模比對AI與人類撰寫的英文文章,整理出AI生成文字的5大特徵。研究團隊蒐集AI生成文章及人類撰寫內容,總計比對55940個句子、約120萬個英文單字。為避免結果僅反映《經濟學人》本身的寫作風格,也加入CNN、《紐約時報》及《華盛頓郵報》2018年至2022年的新聞內容,並納入1950年至2022年間出版的暢銷小說進行比較。
分析發現,AI文章有5大常見特徵:偏好冗長正式的單字(如significant、increasingly、consequences),頻繁使用「不只是A,而是B」、「不僅A,也包含B」等對比式句型,喜歡三段式列舉(一次排列3個形容詞、例子或重點),文章結構過度工整(每段長度與句型平均),以及標點與引述方式較單一。
許多人將英文長破折號「—」視為ChatGPT寫作的特徵,但研究推翻這項印象。AI模型使用長破折號的頻率甚至略低於《經濟學人》記者;在所有研究對象中,ChatGPT是最少使用破折號的,而Claude則比人類更常用[1]。此外,AI文章的逗號、分號都比人類少,括號幾乎不用,部分原因在於句子偏長且「and」被過度使用,也較少引用專家說法。
研究團隊指出,隨著模型持續更新,AI生成文字正逐漸接近人類的寫作方式,原本明顯的語言習慣可能在下一個版本中消失,所謂的「AI特徵」並非永久不變。
(新增ETtoday新聞雲、中時電子報、壹蘋新聞網等3家媒體報導)
本次新增報導中,壹蘋新聞網引述美國維拉諾瓦大學最新研究,發現讀者不僅無法分辨短篇故事出自人類或AI,甚至給予AI作品更高評價。該研究以3篇人類作品與3篇ChatGPT 4.0生成的短篇故事進行測試,結果顯示AI故事在品質及吸引力方面得分更高;但無論作品實際出處,只要參與者被告知是「人類創作」,評價也會跟著提高。實驗中,讀者辨識作者身分的準確率未優於隨機猜測。研究指出,AI文字通常較清楚直接,人類作品則更含蓄複雜,一般讀者可能偏好可預測、較不費力的內容[1]。
ETtoday新聞雲與中時電子報的報導則將《經濟學人》原研究的5大特徵濃縮為4點,並新增提及目前市面上常用的AI檢測工具,包括Pangram、CopyLeaks、GPTZero等[3]。
本事件已沉寂,相關脈絡見「相關事件」