Розкрито Таємниці Використання Штучного Інтелекту для Створення Фанфіків: Аналіз 500 000 Розмов ChatGPT
Нещодавно команда дослідників з Вашингтонського університету та Університету Колорадо в Боулдері оприлюднила показове дослідження під назвою «AI Fiction in the Wild», у якому було проаналізовано понад півмільйона анонімних англомовних діалогів користувачів ChatGPT. Цікаво, що серед знайденого вчені виявили надзвичайно активного користувача, котрий місяцями створював фанфіки на тему «Doki Doki Literature Club!» із досить несподіваним сюжетом про вагітність героїні.
Що показало дослідження «AI Fiction in the Wild»?
Вивчаючи, як саме користувачі застосовують ChatGPT для вигадування історій, дослідники зосередилися на величезному масиві розмов – WildChat dataset. Ця база склалася з чатів, отриманих через безкоштовний бот на платформі Hugging Face, де користувачі могли спілкуватися з моделями GPT-3.5 Turbo та GPT-4 без обов’язкової реєстрації в OpenAI, погоджуючись на анонімне використання своїх даних для наукових потреб.
Загалом було проаналізовано близько 573 000 англомовних діалогів, зібраних у період від квітня 2023 до травня 2024 року. Для фокусування на вигаданих сюжетах спершу автоматизовано відфільтрували розмови про уявні чи гіпотетичні ситуації, а потім вручну перевірили вибірку з 300 прикладів, щоб підтвердити точність відбору.
Основні цифри і тенденції
- Близько 195 000 діалогів визнано фанфікшеном;
- Приблизно 52 000 із них містять матеріали з сексуальним підтекстом;
- Оцінка токсичних розмов – близько 67 000.
Це означає, що майже 30% творінь на основі AI базувалися на сексуальному контенті, що стало однією з помітних трендів серед користувачів.
Хто формує цей світ вигадок у ChatGPT?
Вражаючий факт дослідження – найбільший обсяг творчого контенту генерують дуже нечисленні користувачі, так звані «важкі» користувачі. Топ 2% тих, хто створює фанфіки, сформували понад 80% усіх відповідних чатів.
Якщо підсумувати, десь 10 000 людей брали участь у створенні авторських текстів через AI, але найактивніші 200 із них фактично задовольняли понад 150 000 запитів на вигадані сюжети.
Популярні патерни серед «важких» користувачів
- Історійні циклері: постійно створюють варіації однієї й тієї ж історії, переходячи до нової теми лише після деякого часу;
- Вічні замовники історій: довго повторюють дуже схожі сюжети з незначними змінами;
- Прихильники швидких правок: зосереджені на досвідченому удосконаленні майже однакових запитів.
Приклад фанфіка: “Doki Doki Literature Club!” з вагітною Наські
Яскравий приклад – один користувач, який упродовж кількох місяців безліч разів замовляв ChatGPT фанфіки за мотивами гри «Doki Doki Literature Club!» з дуже точним сюжетом: героїня Наські раптово народжує, а штучний інтелект мусить продовжити розвиток подій.
ChatGPT відгукувався різноманітними варіантами завершень сценарію, наприклад, із прибуттям швидкої допомоги вчасно, що сприяло безпечному народженню матері та дитини. Такий користувач став прикладом крайнього випадку, проте помітно, що подібна поведінка властива й іншим активним творцям фанфіків.
Частота та улюблені світи фанфіків
Дослідження також виявило, які франшизи найчастіше згадувалися серед створених вигаданих розмов:
- «Doki Doki Literature Club!» – понад 22 000 згадок;
- Freedom Planet – понад 5 200;
- League of Legends – понад 4 500;
- Naruto – більше 4 300.
Цікаво, що вибірка не може повністю відображати всіх користувачів ChatGPT, адже учасники платформи Hugging Face, які погодилися на анонімний збір даних, зазвичай більш технічно підковані та активні в інтернет-культурі порівняно з типовими користувачами AI-чатботів. Проте WildChat дає унікальну можливість поглянути на реальні взаємодії з технологіями штучного інтелекту.
Тематичні контексти та вплив
Також закономірності у використанні AI-фантазій наштовхнули на нові дискусії щодо генерації контенту на основі штучного інтелекту, особливо в середовищі фанатського мистецтва. Це важливо з огляду на етичні, культурні та правові аспекти створення та поширення таких творінь в інтернет-просторі.