AI已經成為許多寫作者的必備工具,但要怎麼識別出AI代筆的文件呢?(使用Gemini協助繪圖)
一個無孔不入的「語言幽靈」正在出版品與網路世界裡肆虐,無論是LinkedIn的簡歷、等著口試的學術論文、甚至是競爭激烈的文學獎作品,背後恐怕多少都有生成式AI的影子。但問題來了:我們到底有沒有好方法一眼看穿,眼前的文本究竟是人類親筆、還是大型語言模型(LLM)的傑作?
《經濟學人》指出, AI作為「代筆寫手」正在快速入侵英語世界,他不但可以駕馭散文、詩歌、新聞報導和企業用語,更能模仿莎士比亞的十四行詩,也能模仿庸俗讀物的口吻;模仿海明威簡潔精煉的散文難不倒他,要是製作辦公室的印表機手冊也沒問題。而且AI的寫作速度快得驚人,以寫作營生者無不感到恐懼,畢竟即使強如海明威也很少一天寫出這麼多字,而且他還需要更多的酒。據統計,超過三分之一的新網站內容,都是出自人工智慧之手。
那要怎麼抓出AI代筆的作品呢?《經濟學人》指出,識別AI文本的方法有好幾種,包括使用經過訓練的檢測演算法,在這個領域領先的Pangram公司宣稱他們的準確率已高達99.98%,問題是這種檢測方式是黑箱演算法,除了有誤報的可能之外,業者往往也不會解釋得出結論的原因;當然也有研究人員試著搜尋可疑詞彙、比對AI修改前後的文章,但他們也沒辦法真正淘洗出人工智慧的寫作特性。
不過上述兩種方法相比,《經濟學人》顯然還是更為偏好後者——比較人類和機器的寫作風格。《經濟學人》為此進行了一項大規模實驗,比對了ChatGPT、Claude、Gemini與Grok等主流AI模型產出的120萬字、5.5 萬個句子,並將其與《紐約時報》、《華盛頓郵報》、美國有線電視新聞網(CNN)及1950年至2022年間出版的熱門小說等人類文本進行交叉比對與統計。
研究發現,人工智慧的文字在用詞、標點、句子和段落結構上,都與人類親自的文字截然不同。但這並不意味著人工智慧的文字風格獨具,或者說他們就是優秀的作家。《經濟學人》認為AI的文字缺乏清晰度和優雅性,而且常常千篇一律,如果一個人想要當個好作家,也應該避免犯下AI寫作的破綻。只可惜這些破綻並非永遠不變——隨著模型版本更新、甚至給予不同的提示詞,AI就會以驚人的速度「再進化」。
無論如何,《經濟學人》這次還是總結出識別AI寫作的三大破綻:
《經濟學人》指出,過去大眾熟悉的AI關鍵字,(像是delve、深入探討之意)在最新版本的模型中已大幅減少,取而代之的是大量使用「多音節詞」、「生僻詞」、「科學術語」的表達方式,比方說significant(顯著的)、increasingly(日益成長)、consequences(後果);它們也會使用更多生僻詞,像是interdependence(相互依存)、reindustrialisation(再工業化);更多科學術語,像是parameter(參數)、methodology(方法論);AI也喜歡名詞化(將動詞轉化為名詞,像是將expand(擴展)轉化為「expansion」(擴張)。
著有《動物農莊》和《一九八四》等小說的喬治·歐威爾(George Orwell)曾提醒過的「炫耀性措辭」(Pretentious Diction),歐威爾批評那些使用複雜的詞彙和術語「包裝簡單陳述」的作家自以為聰明,歐威爾也發現那些誇誇其談的作家,往往認為「拉丁語或希臘文比撒克遜語詞彙更顯高貴」。有趣的是,AI似乎也認同這一點,因為它們產生的文本出現的拉丁語的頻率比人類文本要高的多。
大眾曾以為「長破折號」是AI的招牌標點,不過看到破折號就開槍恐怕也不是好方法。不過這次《經濟學人》的實證統計發現,目前除了Claude依然偏好破折號,ChatGPT的破折號使用率甚至比人類還低。不過《經濟學人》也發現了AI的新破綻:極度不愛用標點符號。由於AI習慣寫長句,大量使用and作為連接詞,導致文章中的逗號、分號與括號數量遠低於人類寫作。此外,由於AI很少主動引用專家原文,這也減少了引號出現的頻率。
好的講者與作家往往擅長「長短句交錯」,並且用簡短有力的一句話來提振節奏;但《經濟學人》指出,AI寫作的段落往往由長句構成,顯得平鋪直續。當AI試圖要讓文章變得生動,它又極度依賴固定的修辭公式,例如「不是X,而是Y」(not X but Y)」、「不僅……而且……」(not only but also)、以及「三段式結構」(rule of three)。
《經濟學人》提醒,如果你想辨識人工智慧寫作,至少以目前來說,應當留意那些平淡乏味、矯揉造作、充斥著拉丁詞彙的文字。不過《經濟學人》也指出,隨著每次更新版本,AI寫作正變得越來越接近人類寫作。佛羅里達州立大學語言學系的Tommie Juzek也指出,大語言模型(LLM)正在加強訓練,並從人類的使用與反饋中學習,吸收人們認為精彩的內容,拋棄那些不夠好的部分。
《經濟學人》還舉了一個AI進化的例子——當初你問舊款模型「AI是不是太愛用破折號?」時,它只會打哈哈回應你「問得好!」;但今天你要是問AI同一個問題,它已經會嚴肅地回答你「破折號最好謹慎使用」。《經濟學人》打趣說這大概不是人類進化的速度,因為只有鬼魂(ghost,英語裡的代筆寫手正是ghost writer)才能變得如此之快。