在一項開創性的研究中,研究人員發現了人類創造力和人工智慧 (AI) 之間有趣的動態關係。雖然人工智慧聊天機器人,尤其是 ChatGPT4,展現了非凡的創造力,但它們並沒有始終勝過最具創造力的人類參與者。相反,人類展示了更廣泛的創造潛力,這可能與執行功能和認知過程的變化有關。
傳統上,創造力被認爲是一種獨特的人類特徵,植根於複雜的認知過程,例如想像、洞察力以及連接看似不相關的概念的能力。然而,隨著人工智慧技術的不斷進步,越來越明顯的是,機器擁有產生與人類成就相媲美、有時甚至超越人類成就的創造性產出的能力。
研究作者、卑爾根大學副教授西蒙尼·格拉西尼強調了當前人工智能和機器智能時代的變革性質。他強調需要持續研究人們如何看待機器以及機器模仿人類能力的程度。
使用替代用途任務評估創造力
研究人員使用替代用途任務 (AUT) 開展了這項研究,這是一種廣受認可的創造力評估。在這項任務中,人類參與者和人工智能聊天機器人都被要求爲繩子、盒子、鉛筆和蠟燭等常見物品想出獨特而有創意的用途。人類參與者有 30 秒的時間來想出儘可能多的創意,而聊天機器人則被要求每次回答僅使用 1-3 個單詞來想出特定數量的想法。每個聊天機器人都接受了 11 次測試。
這項研究採用了三款人工智能聊天機器人:ChatGPT3、ChatGPT4 和 Copy.Ai,以及從在線平臺 Prolific 招募的 256 名人類參與者。這些人類參與者均爲英語母語人士,平均年齡爲 30.4 歲,年齡範圍爲 19 至 40 歲。
評估創造力的兩種方法
研究人員採用了兩種不同的方法來評估人類和人工智能聊天機器人的創造力。語義距離分數:這種自動化方法通過測量響應與對象的常見或預期用途的差異來衡量響應的原創性。
創造力的主觀評價:六位人類評分員不知道哪些答案是由人工智能生成的,他們根據 5 分制評估了這些想法的創造力。
人工智能聊天機器人在創造力評估方面表現出色
研究結果表明,人工智能聊天機器人(尤其是 ChatGPT3 和 ChatGPT4)的語義距離得分始終高於人類。這表明,與人類參與者相比,它們的回答更具原創性,也更不落窠臼。此外,人類評分員認爲人工智能聊天機器人(尤其是 ChatGPT4)的平均創意水平高於人類參與者。
然而,必須注意的是,儘管人工智能聊天機器人表現異常出色,但它們並不總是勝過最有創造力的人類參與者。在某些情況下,人類參與者中極富創造力的個體能夠與人工智能競爭,產生新穎而富有想象力的迴應。
格拉西尼強調,不要高估人工智能在這一特定創意任務中的成功對涉及創意的複雜現實工作的影響。他設想未來人工智能聊天機器人將協助人類發揮創意作用,而不是完全取代人類。
在人工智能聊天機器人中,ChatGPT4 在主觀評分中脫穎而出,成爲最具創造力的機器人。雖然在使用測量語義距離的算法進行評估時,它的表現並不總是優於其他人工智能模型,但它在人類評分者那裏一直獲得更高的創造力分數。
侷限性和未來方向
這項研究的發現僅限於一種類型的創造性行爲,可能無法廣泛適用於創造力這一複雜現象。此外,由於聊天機器人內部流程的不透明性,在流程層面上比較人類和聊天機器人的創造力仍然具有挑戰性。
格拉西尼指出,聊天機器人可能不會像人類一樣展現創造力,它們可能依賴於記憶中的反應,而不是產生創造性想法的能力。鑑於這些模型的架構,我們仍然不可能完全理解它們的創造過程。
