У революційному дослідженні дослідники виявили інтригуючу динаміку між людською творчістю та штучним інтелектом (ШІ). Хоча чат-боти зі штучним інтелектом, особливо ChatGPT4, продемонстрували виняткову креативність, вони не постійно перевершували найкреативніших людей-учасників. Натомість люди продемонстрували ширший діапазон творчого потенціалу, потенційно пов’язаного з варіаціями виконавчих функцій і когнітивних процесів.
Традиційно креативність вважалася характерною для людини рисою, що ґрунтується на складних когнітивних процесах, таких як уява, проникливість і здатність поєднувати, здавалося б, непов’язані поняття. Однак у міру того як технологія штучного інтелекту продовжує розвиватися, стає все більш очевидним, що машини мають здатність створювати творчі результати, які конкурують, а часом навіть перевершують людські досягнення.
Автор дослідження Сімона Грассіні, доцент Бергенського університету, підкреслила трансформаційний характер нинішньої ери в ШІ та машинному інтелекті. Він наголосив на необхідності постійних досліджень того, як люди сприймають машини та в якій мірі машини можуть імітувати людські здібності.
Оцінювання творчих здібностей із завданням на альтернативне використання
Дослідники провели своє дослідження за допомогою Alternate Uses Task (AUT), широко визнаного методу оцінки креативності. У цьому завданні як люди, так і чат-боти зі штучним інтелектом мали завдання створювати унікальні та креативні способи використання звичайних об’єктів, таких як мотузка, коробка, олівець і свічка. Учасникам-людям дали 30 секунд, щоб створити якомога більше творчих ідей, а чат-ботам було дано вказівку створити певну кількість ідей, використовуючи лише 1-3 слова на відповідь. Кожен чат-бот проходив тестування 11 разів.
У дослідженні брали участь три чат-боти штучного інтелекту: ChatGPT3, ChatGPT4 і Copy.Ai, а також група з 256 людей, набраних з онлайн-платформи Prolific. Люди-учасники, усі носії англійської мови, мали середній вік 30,4 року з діапазоном від 19 до 40 років.
Два підходи до оцінки креативності
Дослідники використовували два різні підходи для оцінки креативності людей і чат-ботів ШІ. Оцінки семантичної дистанції: цей автоматизований метод оцінював оригінальність відповідей, вимірюючи, наскільки вони відрізнялися від звичайного чи очікуваного використання об’єктів.
Суб’єктивні оцінки креативності: шість оцінювачів-людей, не знаючи, які відповіді були згенеровані ШІ, оцінювали креативність ідей за 5-бальною шкалою.
ШІ-чат-боти відмінно оцінюють креативність
Результати дослідження показали, що чат-боти зі штучним інтелектом, зокрема ChatGPT3 і ChatGPT4, постійно досягали вищих показників семантичної відстані порівняно з людьми. Це вказує на те, що вони дали відповіді, які були більш оригінальними та менш звичайними, ніж відповіді людей-учасників. Крім того, люди оцінили чат-ботів штучного інтелекту, зокрема ChatGPT4, як у середньому більш креативних, ніж люди-учасники.
Однак важливо відзначити, що хоча чат-боти зі штучним інтелектом показали виняткову ефективність, вони не завжди перевершували найкреативніших людей-учасників. У деяких випадках висококреативні люди серед людей-учасників змогли конкурувати з ШІ у створенні нових та творчих відповідей.
Грассіні підкреслив, що важливо не переоцінювати наслідки успіху штучного інтелекту в цьому конкретному творчому завданні для складних реальних завдань, які включають творчість. Він уявляв майбутнє, де чат-боти ШІ допомагатимуть людям у їхніх творчих ролях, а не замінять їх повністю.
Серед чат-ботів штучного інтелекту ChatGPT4 виділявся як найкреативніший у суб’єктивних оцінках. Хоча він не завжди перевершував інші моделі штучного інтелекту при оцінці за допомогою алгоритму для вимірювання семантичної відстані, він постійно отримував вищі бали креативності від оцінювачів.
Обмеження та майбутні напрямки
Висновки дослідження обмежуються одним типом творчої поведінки і можуть не бути широко застосовними до творчості як складного явища. Крім того, порівняння творчих здібностей людей і чат-ботів на рівні процесів залишається складним через непрозору природу внутрішніх процесів чат-ботів.
Грассіні зазначив, що чат-боти можуть не проявляти креативність так, як це роблять люди, потенційно покладаючись на запам’ятовані відповіді, а не на здатність генерувати творчі ідеї. Враховуючи архітектуру цих моделей, неможливо повністю зрозуміти їхні творчі процеси.
