一項新研究顯示,讀者在區分人工智能生成的故事與人類創作的故事方面存在困難,且經常對 AI 版本給予更高的評價。該研究由美國維拉諾瓦大學的迪娜·斯科爾尼克·韋斯伯格博士主導,並發表於《判斷與決策》期刊。
研究團隊邀請超過 1600 名參與者對六篇短篇故事進行質量和吸引力的評分,其中三篇由人類創作,三篇由 ChatGPT 生成。參與者被告知每篇故事的作者身份,但這一標籤並不總是準確。
AI 生成故事的吸引力超越人類創作
研究結果顯示,閲讀 AI 生成故事的參與者比閲讀人類故事的參與者給出了更高的評分,認為這些故事更具吸引力和質量。與此同時,無論實際作者是誰,標註為「人類創作」的故事比標註為「AI 創作」的故事得分更高。
韋斯伯格表示,這一結果表明 AI 在生成可讀性強、引人入勝的故事方面已遠超大多數人的預期。然而,她補充説,這並不意味著人類作者已變得無關緊要。
在後續測試中,參與者被要求從同一主題的兩篇故事中辨別哪篇由人類創作、哪篇由 AI 生成,結果顯示大多數人未能正確識別。值得一提的是,今年早些時候,英聯邦短篇小説獎就遇到了類似問題。網絡讀者指出五篇獲獎作品中有三篇疑似 AI 生成,AI 檢測工具也支持了這一判斷。
然而,該獎項的出版商進行了獨立核查,結果並不明確。這反映出 AI 在創作領域的影響力日益增強,未來如何進行合理的作品評價與認證將成為重要議題。
想睇更深入嘅 AI 模型與工程科技報道?
前往 The Base Principle 繁體中文 AI 新聞 →
