英國廣播公司(BBC)報導,美國維拉諾瓦大學研究團隊以3篇已出版的人類作品,搭配3篇由ChatGPT 4.0生成的短篇故事,測試18歲至81歲讀者能否辨別作者身分。
研究於本月5日刊登在劍橋大學出版社旗下期刊《判斷與決策》(Judgment and Decision Making)。
第1項實驗找來1682名美國成年人,每人閱讀1篇故事,但研究人員可能如實或故意錯誤告知作品出自人類或AI。
結果顯示,AI生成的故事在品質及吸引力方面都獲得較高分;不過無論作品真正出處為何,只要參與者被告知是「人類創作」,評價也會跟著提高。
換句話說,許多讀者實際上更喜歡AI作品,卻不願承認AI寫得更好,甚至把自己喜愛的AI故事誤認為人類創作。
第2及第3項實驗分別找來424人及481人,每人同時閱讀1篇人類作品和1篇AI故事,再判斷兩者的作者。第
2次實驗僅39.39%答對,第3次則有51.97%答對,整體表現未優於隨機猜測。研究結果顯示,自認較了解AI的人,辨識準確率相對較高;自認熟悉文學的讀者,卻沒有展現相同優勢。
研究資深作者維斯伯格(Deena Skolnick Weisberg)表示,人們普遍認為創作需要情感理解和人生經驗等人類特質,因此容易低估AI的能力。她認為,AI文字通常比較清楚、直接且容易理解,人類作品則可能更加含蓄、複雜;一般讀者或許更偏好可預測、較不費力的內容。
不過,研究結果還不能直接證明AI足以取代作家。
實驗僅比較3篇人類作品與3篇AI作品,受試者也都是美國成年人,測試的是約1000字的英語短篇故事,無法代表不同語言、文化及所有文學類型。研究團隊也承認,仍需以更多元的作品及客觀的專業評估進一步驗證。
這項研究真正揭露的,或許不是作家即將消失,而是「讀者想讀什麼」正在改變。當清楚、直接又容易消化的文字更容易獲得高分,未來作家面對的挑戰,可能不只是與AI競爭寫作能力,也得說服讀者:人類創作中的複雜、曖昧與不完美,仍有無法被評分取代的價值。
點擊閱讀下一則新聞