- 讀者難以區分AI生成與人類創作的故事。
- AI生成的故事通常獲得更高評價,顯示其吸引力和質量。
- 參與者在辨別故事作者時未能正確識別。
- AI在創作領域的影響力日益增強,評價與認證成為重要議題。
一項新研究顯示,讀者在區分人工智能生成的故事與人類創作的故事方面存在困難,且經常對 AI 版本給予更高的評價。該研究由美國維拉諾瓦大學的迪娜·斯科爾尼克·韋斯伯格博士主導,並發表於《判斷與決策》期刊。
研究團隊邀請超過 1600 名參與者對六篇短篇故事進行質量和吸引力的評分,其中三篇由人類創作,三篇由 ChatGPT 生成。參與者被告知每篇故事的作者身份,但這一標籤並不總是準確。
AI故事評價高於人類創作
研究結果顯示,閲讀 AI 生成故事的參與者比閲讀人類故事的參與者給出了更高的評分,認為這些故事更具吸引力和質量。與此同時,無論實際作者是誰,標註為「人類創作」的故事比標註為「AI 創作」的故事得分更高。
韋斯伯格表示,這一結果表明 AI 在生成可讀性強、引人入勝的故事方面已遠超大多數人的預期。然而,她補充説,這並不意味著人類作者已變得無關緊要。
辨別作者身份的挑戰
在後續測試中,參與者被要求從同一主題的兩篇故事中辨別哪篇由人類創作、哪篇由 AI 生成,結果顯示大多數人未能正確識別。值得一提的是,今年早些時候,英聯邦短篇小説獎就遇到了類似問題。網絡讀者指出五篇獲獎作品中有三篇疑似 AI 生成,AI 檢測工具也支持了這一判斷。
然而,該獎項的出版商進行了獨立核查,結果並不明確。這反映出 AI 在創作領域的影響力日益增強,未來如何進行合理的作品評價與認證將成為重要議題。
AI創作對文學評價的挑戰
這項研究揭示了AI在故事創作中的潛力,顯示出其生成的內容不僅具可讀性,還能吸引讀者。隨著AI技術的進步,讀者對於故事的評價標準也可能發生變化,這對文學界和出版業提出了新的挑戰。如何在AI創作與人類創作之間進行合理的區分和評價,將成為未來的重要議題,尤其是在獎項評選和文學認證方面。

