專欄:你能自學辨識 AI 寫作嗎?也許

2026 年 8 月 27 日

珀斯:人工智能正悄悄改寫寫作。唔單止散文嘅風格改變,連文字嘅基本結構都真係喺變化中。

呢唔係單純嘅新技術。

呢唔係一時嘅潮流。

呢係不可逆轉嘅革命。

呢篇文章嘅開頭好似由AI生成咗?你感覺到邊啲地方話畀你聽呢?

事實上,呢段並非AI生成;我寫佢去模仿合成嘅散文——就係當大型語言模型(LLM)把詞語整理成句子嘅時候嗰種文字。

呢類嘅散文好似現喺到處:喺為咗吸引廣告點擊而整嘅低質網站、喺追求互動嘅社交媒體標題、甚至喺書稿入面。近年罪案小說家Jerry Falade因為佢自己嘅文學代理人稱再亦無法忠實判斷手稿點樣拼合,致使佢失去價值逾兩百萬美元嘅出版合約。哈希出版社(Hachette)亦喺今年三月基於相似懷疑撤回咗恐怖小說《Shy Girl》。

喺生成式AI出現之前,我哋普遍認為文字係人類創作。依家唔再係咁。咁我哋點樣識別AI寫作嘅文本?

冇一個單一嘅清晰指標。相反,存在啲模式:特定嘅詞語、句子結構同表達習慣喺AI生成嘅散文中反覆出現。大型語言模型亦都快速而高效地更新,所以今日能揭示嘅假文本特徵,幾個月之後可能就不再適用。

悄悄地、安靜地,同埋真實地

「悄悄地」呢個詞係一個顯著嘅提示。自從2021年12月以嚟,喺 Google 趨勢嘅搜尋興趣一路上升,呢個指標係衡量搜索量而唔係寫作裡面嘅出現,因此具啲暗示性但唔能作為證據。

喺嗰段時間之內改變嘅係有幾多人成為用LLM協助寫作,而呢啲模型確實比一般人類作家更傾向使用「安靜」同「悄悄地」呢類語氣。

「真正地」呢個詞嘅情況同樣類似,屬於較多嘅經驗性觀察。喺AI輸出入面,我留意到呢個詞被過度使用,連 Claude 亦睇到,遠超過我一個人隨意寫作時嘅使用量。至今,冇人就呢個特定詞做過嚴謹研究。

呢種模式嘅文獻版本係喺自2022年起喺科學寫作中出現嘅詞彙:Delve(深入探究)、meticulous(細緻)、underscore(強調)、boast(自夸)同 intricate(錯綜複雜)。呢啲詞喺掃描嘅 PubMed 摘要中出現嘅頻率,明顯高過以前,研究人員把呢個模式直接連繫到 ChatGPT 風格嘅表述。

呢啲詞語本身唔能單獨作證據。但當「悄悄地」、「真正地」、「深入探究」同「細緻」等詞,喺相同咁樣嘅修辭框架旁出現時,就聽落似係LLM共同嘅家族風格,而唔係某個人獨有嘅聲音。

一套屬於自己嘅寫作風格

「唔係 X,而係 Y」呢種結構,係呢個家族風格嘅另一部分,仲有三段式(rule of three)嘅偏好。

佢都鍾意用一個謙虛嘅說法去開頭,然後即刻把佢提升。例如:「本文就語言提供咗一個有用嘅觀點。佢徹底改變我哋點樣理解寫作呢個概念。」人類寫作者歷來都會用呢種方法,但生成式AI能夠以顯著嘅一致性產出呢個模式。

再嚟就係長破折號(em dash),係最早同最被嘲笑嘅AI徵兆。佢一向都唔係特別穩妥。有人用同一個提示喺六個聊天機器人上跑過,喺573個字入面,ChatGPT 給出八個長破折號,但 Gemini 同 Meta AI 一個都冇。

呢個實證出現嘅教訓係:雖然單一線索未必可信,但線索嘅累積就好重要。

較長嘅文本

另外一個用生成式AI嘅線索就係文本長度。

《大西洋月刊》嘅一名記者描述,喺約翰尼斯堡發生車禍之後,現場嗰個駕駛者嘅驚慌同語無倫次,喺半小時之內就喺以後寫成一段經過打磨嘅長文,用流麗嘅散文呈現。當佢之後聯絡一名以前只用縮略語回覆嘅機械工,對方嘅回覆亦用同一個獨特嘅AI語音風格出現。

人類語言受著工作量同時間成本嘅壓力影響;生成式AI大大減低咗呢啲成本。實際上,一個人可能會發簡訊寫:「抱歉,我遲咗。交通好塞。大概二十分鐘到。」

AI 可以迅速把呢句轉寫成一段解釋突發交通堵塞、表達誠摯嘅遺憾並感謝對方嘅耐心嘅段落。呢段較長嘅版本唔一定有乜錯,只不過喺時間緊迫嘅情況下,佢做嘗試完成比實際情況多出咗好多語言工作。

AI 偵測嘅風險

有啲人認為AI偵測軟件可以識別AI生成嘅文本。不過,呢啲系統遠未完美,亦可能加深現有嘅偏見。

2023年,斯坦福大學嘅一項研究發現,七款受歡迎嘅AI偵測器平均誤將非母語英語寫作嘅文章中有61%標成AI生成,其中一款工具嘅誤判率高達97%。

自嗰時以來,AI 偵測技術有進步,但最近嘅研究顯示情況更為複雜。現時嘅偵測器喺某啲情境下表現更好,但仍然容易被規避,亦可能出現誤報。

同時,問題正轉向打破「偵測」本身:歐盟現正要求所有AI生成內容必須貼上標籤或水印。

大型語言模型會改變我哋寫作嘅方式嗎?

《自然人類行為》(Nature Human Behaviour)嘅一項新研究,分析超過 88 萬篇 Reddit 帖文、新聞文章同學術作品,發現LLM嘅普及與寫作風格嘅變化幅度變小有關。

知道係邊位寫嘅嘢之所以重要,因為語言嘅落地效果會因作者而異。佢哋可信唔可信?知識淵博?好笑?年輕定年長?佢哋係唔係真實?

另一個原因係靈活度。人類喺解決問題同創造力上表現出色,呢啲能力喺個體語言嘅特徵入面反映出嚟:一個意料之外嘅詞、一個獨特嘅比較、某種句式喺唔同作者身上重複出現但唔係大規模地出現;正如合成文本嘅情況。

如果我哋媒體上嘅散文聽落好似係由同一個自動、缺乏創意、乏味同重複嘅模具剪切出嚟,我哋就會失去個性、細膩之處,以及對文本同作者真實性嘅信任。

Celeste Rodriguez Louro 係西澳大學語言實驗室副教授兼主任。呢篇評論 首次發佈於 The Conversation。

穎欣

穎欣

我長期關注香港政治、公共政策與公民社會,希望透過清晰而有脈絡的文字,把複雜議題說得更容易理解。對我而言,新聞不只是記錄當下,更是理解社會如何改變的一種方式。