研究顯示讀者難以區分 AI 與人類創作故事 AI 版本評價更高

一項新研究顯示,讀者在區分人工智能生成的故事與人類創作的故事方面存在困難,且經常對 AI 版本給予更高的評價。該研究由美國維拉諾瓦大學的迪娜·斯科爾尼克·韋斯伯格博士主導,並發表於《判斷與決策》期刊。

研究團隊邀請超過 1600 名參與者對六篇短篇故事進行質量和吸引力的評分,其中三篇由人類創作,三篇由 ChatGPT 生成。參與者被告知每篇故事的作者身份,但這一標籤並不總是準確。

AI 生成故事的吸引力超越人類創作

研究結果顯示,閲讀 AI 生成故事的參與者比閲讀人類故事的參與者給出了更高的評分,認為這些故事更具吸引力和質量。與此同時,無論實際作者是誰,標註為「人類創作」的故事比標註為「AI 創作」的故事得分更高。

韋斯伯格表示,這一結果表明 AI 在生成可讀性強、引人入勝的故事方面已遠超大多數人的預期。然而,她補充説,這並不意味著人類作者已變得無關緊要。

在後續測試中,參與者被要求從同一主題的兩篇故事中辨別哪篇由人類創作、哪篇由 AI 生成,結果顯示大多數人未能正確識別。值得一提的是,今年早些時候,英聯邦短篇小説獎就遇到了類似問題。網絡讀者指出五篇獲獎作品中有三篇疑似 AI 生成,AI 檢測工具也支持了這一判斷。

然而,該獎項的出版商進行了獨立核查,結果並不明確。這反映出 AI 在創作領域的影響力日益增強,未來如何進行合理的作品評價與認證將成為重要議題。

Henderson
Henderson

Henderson 是 The Base Principle 的編輯,負責 AI 與工程科技報道的選題與編輯,並監督本站的自動化編譯流程。關注範圍包括大型語言模型、半導體與運算、太空與能源工程。

The Base Principle 是一個繁體中文(香港)科技媒體,專注報道人工智能與工程前沿。我們持續追蹤 OpenAI、Anthropic Claude、Google Gemini、Grok(xAI)、Meta AI、DeepSeek 等主要 AI 模型與公司,並涵蓋電動車與工程技術趨勢,每日精選與分析。

友情網站:手機・開箱・評測 → TechRitualTechNippon 日本語版