美研究揭AI故事比人類作品更為吸引 讀者難辨真偽 謊稱真人創作獲更高評價

報導 | by  虛詞編輯部 | 2026-08-12

劍橋大學出版社(CUP)旗下學術期刊《判斷與決策》(Judgment and Decision Making)於今年8月發表一項的最新研究,發現讀者難以分辨小說究竟出自人類抑或AI之手,甚至更傾向認為AI生成的文本具備較高的品質及更引人入勝。其中,當研究人員向受試者謊稱AI文本為人類創作時,作品反而獲得更高的評價。


題為《Bot or not: Can people tell the difference between stories written by a human or by an AI system?》的論文,由美國維拉諾瓦大學(Villanova University)心理與大腦科學系副教授Deena Weisberg與學者Sydney Sears共同發表。研究團隊邀請了1,682名美國成年人參與實驗,並挑選3篇曾發表於文學期刊或短篇小說集的人類原創短篇小說,再利用ChatGPT生成3篇主題相近的作品作為對照。每位受試者只需閱讀其中一篇,並就故事的引人入勝度(absorption)與感知品質(perceived quality)評分。實驗的巧妙之處在於參與者會被告知作品是由人類還是AI創作,但只有一半人接收到正確資訊,另一半則被刻意誤導。


結果顯示,AI生成的故事在品質與引人入勝程度上的得分,均顯著高於人類作家的原創作品。研究亦發現無論故事實際是誰創作,只要向參與者謊稱作品為人類所創作時,普遍的評分會更高。在得知作品確實由ChatGPT生成後,對AI持正面態度的參與者,給出的分數也明顯高於持保留態度的人。


為進一步驗證人類對AI文本的辨識能力,研究團隊隨後進行第二及第三次實驗,分別邀請424及481名參與者同時閱讀2篇主題相同,但分別出自人類與AI之手的故事,要求他們指出哪篇才是人類作品。結果顯示,第二次實驗的正確率僅有39.4%,低於隨機亂猜的機率,第三次則為51.9%。


研究表示,參與者自稱的文學素養與閱讀經驗,與能否成功辨識作者身分毫無關聯;相反那些自認對AI較為熟悉、日常頻繁接觸AI系統的人,更能準確分辨文本是誰創作。Weisberg解釋,熟悉AI運作的人對AI的行文套路較為敏感,容易捕捉到諸如頻繁使用破折號,或愛用「不是X,而是Y」這類典型句式。研究團隊總結:「AI已能生成出質素不亞於人類創作的作品,只是大眾普遍尚未意識到它們具備這種能力⋯⋯目前研究結果顯示,以大型語言模型為基礎的AI程式,已經能夠寫出讓人難以辨識的短篇小說,讀者往往認為這些作品的水準更高、更引人入勝。」


不過,研究團隊坦承是次實驗存在一定局限,指實驗所使用的文本都是篇幅極短、幾分鐘即可讀完的短篇小知,若換成較長的作品,讀者反應或許截然不同,皆因AI在長篇敘事中處理情節鋪排與人物深度的能力,目前仍存疑問。此外,實驗文本全屬現實主義,「當讀者面對其他類型、尤其是符合個人喜好的作品時,觀感可能大不相同。未來研究不妨進一步探討,AI處理愛情小說這類極度依賴人際關係與細膩情感的題材時,會否因缺乏真實生活經驗而顯得吃力,難以寫出具人情味的故事。」


Weisberg在接受訪問時表示:「我們往往假設創意寫作需要人類獨有的情感理解與生活經驗,因而低估了AI的能力。」她指出,研究結果揭示出大眾對由真實人類所寫的敘事懷有一種偏見,即使AI文本在閱讀體驗上更受歡迎,人們仍然傾向給予告知為人類作品的故事更高評價。Weisberg推測,由於AI所寫的往往更為清晰、直接、容易理解,而人類創作的故事通常更為含蓄、複雜,需要讀者自行推敲人物言行背後的意義,「或許人們普遍更喜歡可預測的內容,因為複雜的內容需要讀者使用更多腦力(Brainpower)。」


儘管研究結果似乎在暗示AI有望取代作家,但Weisberg直言:「寫作從來就不只是為了交出一件完成品,它更是一場自我表達、挑戰極限與梳理生命經驗的旅程。哪怕 AI 能寫出再逼近人類的故事,我們自己的故事依然有被講述的價值,人類的創作初衷絕不會因此動搖。」


不過,Weisberg坦言AI生成的作品確實會對創作者造成威脅,「它能更快、更輕鬆生成大量水平不俗之作,因此很有可能會令市場變得魚龍混雜,大量低成本的AI作品可能會擠壓缺乏知名度的新晉作家的生存空間。現時大量由AI生成的科學期刊論文不斷投稿,我的同事需花費更多時間去逐一審核與退稿,我估計文學界目前也正面臨類似困境。」


是次實驗拋出一個極有意思的叩問,我們一聽到這是人類創作的作品,便會下意識傾向給予好評,而非藉由文字、內容本身審視真偽,亦暴露出我們渴求作品有著背後那份專屬人類的聲音、觀點與情感流露。如今AI具備不亞於人類作家的書寫功力,當機器與人類創作的界線逐漸消融,單憑傳統的閱讀直覺,我們已越來越難在字裡行間劃出一道涇渭分明的邊界,但能夠辨別作品的,終究還是人類自己。或許未來要識破機器偽裝,可能需要我們頻繁使用AI,以摸透其行文套路,才能有效辨別作品是否由AI生成。人類書寫的價值依然有價,正如Weisberg所言,要還有人覺得自己的生命經驗值得被梳理、被訴說,人類書寫的行就會繼續,永不會被AI所取代。



延伸閱讀

熱門文章

編輯推介

止水

小說 | by 胡韡心 | 2026-08-07

【字遊行·巴黎】熱

字遊行 | by 郭芊葉 | 2026-08-07

詩三首:〈春雨〉、〈春後〉、〈隔靴搔癢之七年〉

詩歌 | by 飲江,莫凱傑,王兆基 | 2026-08-07

當史詩下凡IMAX:路蘭的《奧德賽》

影評 | by 陳麗芬 | 2026-08-06

談《錯覺與和解》──筆訪嚴瀚欽

專訪 | by 李浩榮 | 2026-08-04

任俠之風:憶施南生

其他 | by 李焯桃 | 2026-08-04

【新書】《賣書者言》編輯序

書序 | by 阿豆 | 2026-08-03

無法跨越的理解

散文 | by 彭慧瑜 | 2026-07-31

仿織

小說 | by 悇愉 | 2026-07-31

詩三首:〈留下來的人〉、〈成名前〉、〈行為藝術〉

詩歌 | by 王培智,黎喜,潘國亨 | 2026-07-31