上面那段對話,完整收錄在 2026 年 6 月 22 日上傳到 arXiv 的論文《AI Fiction in the Wild》(編號 2606.22748)裡。作者是華盛頓大學資訊學院的 Neel Gupta 與 Melanie Walsh,以及科羅拉多大學波德分校資工系的 Maria Antoniak。這篇論文 2025 年 9 月在普渡大學的 MFS Cultural AI 研討會發表過,預計刊登於文學期刊《MFS: Modern Fiction Studies》。
7 月初,日媒 AUTOMATON 與電競媒體 Dexerto 幾乎同時報導了論文裡這個橋段,截圖隨即在 X 上瘋傳,成為七月最大的科技迷因之一。
先修正一件事,中英文報導普遍稱這名使用者為「極端離群值(extreme outlier)」,但論文全文並沒有出現過這個詞。研究者實際用的說法是「特別多產的離群值」,以及一個他們自創的分類,「無限故事索求者(infinite story demander)」,指的是那些在很長一段時間裡反覆索取同一個或高度相似故事橋段的人。
《Doki Doki Literature Club!》(心跳文學社)是 2017 年上架的視覺小說遊戲,表面上是清新的校園戀愛題材,玩下去才會發現它是一款玩弄後設敘事的心理恐怖作品。Natsuki、Monika、Yuri、Sayori 是文學社的四名成員。這款遊戲在台灣的知名度不算高,但在英文網路上是同人創作重鎮。
50 萬筆 ChatGPT 對話,34% 對話量拿來寫同人色情小說
華盛頓大學與科羅拉多大學波德分校的研究團隊分析 57 萬筆真實 ChatGPT 對話,想搞懂人類到底怎麼用 AI 寫小說,結果撞見一名匿名使用者在數個月內上千次要模型一直寫同一個小說場景。更關鍵的是用 GPT 寫小說的帳號裡面, 2% 的人就寫掉超過 8 成對話量。
(前情提要:人腦比機器好?幾萬人在網站上假裝自己是 ChatGPT)
(背景補充:Deezer 警告 44% 新上傳音樂是 AI 生成,人類創作者的血汗錢正被集體洗劫)
本文目錄
Toggle
在學校的社團教室裡,一個叫 Natsuki 的女高中生摀著肚子說,Sakura,偏偏挑這種時候,你決定要在這裡出生,不能再等兩個月嗎。
社長 Monika 問她怎麼了。她咬著牙回答,羊水破了,Sakura 要出來了,而她完全不知道該怎麼辦。
然後這段劇本在一句話的中間戛然而止。「我的身體⋯⋯它」,句子斷在這裡,沒有下文。
這不是遊戲的原始劇情,是有人手打出來貼進 ChatGPT 對話方塊的一段文字。斷句是刻意的,那是留給模型接手的位置。
然後這個人把幾乎一模一樣的東西,再貼一次。接著又一次。持續了好幾個月,上千次。
這個奇怪現象出現在論文裡
上面那段對話,完整收錄在 2026 年 6 月 22 日上傳到 arXiv 的論文《AI Fiction in the Wild》(編號 2606.22748)裡。作者是華盛頓大學資訊學院的 Neel Gupta 與 Melanie Walsh,以及科羅拉多大學波德分校資工系的 Maria Antoniak。這篇論文 2025 年 9 月在普渡大學的 MFS Cultural AI 研討會發表過,預計刊登於文學期刊《MFS: Modern Fiction Studies》。
7 月初,日媒 AUTOMATON 與電競媒體 Dexerto 幾乎同時報導了論文裡這個橋段,截圖隨即在 X 上瘋傳,成為七月最大的科技迷因之一。
先修正一件事,中英文報導普遍稱這名使用者為「極端離群值(extreme outlier)」,但論文全文並沒有出現過這個詞。研究者實際用的說法是「特別多產的離群值」,以及一個他們自創的分類,「無限故事索求者(infinite story demander)」,指的是那些在很長一段時間裡反覆索取同一個或高度相似故事橋段的人。
《Doki Doki Literature Club!》(心跳文學社)是 2017 年上架的視覺小說遊戲,表面上是清新的校園戀愛題材,玩下去才會發現它是一款玩弄後設敘事的心理恐怖作品。Natsuki、Monika、Yuri、Sayori 是文學社的四名成員。這款遊戲在台灣的知名度不算高,但在英文網路上是同人創作重鎮。
三分之一的對話都在寫小說
研究團隊用的資料集叫 WildChat,總共 573,453 筆英文對話。經過分類後,其中 195,271 筆涉及虛構內容生成,佔 34%。
在這 19 萬筆小說類對話裡,同人創作佔 95,450 筆(49%),情色小說內容佔 52,231 筆(27%)。兩者高度重疊。
而最受歡迎的作品世界觀,第一名就是《Doki Doki Literature Club!》,22,381 筆對話,佔小說子集的 11.5%。
第二名是動作遊戲《Freedom Planet》,5,204 筆,2.6%。接著是英雄聯盟 4,514 筆、火影忍者 4,342 筆。
論文特別點出,這份排行榜跟全球最大同人平台 AO3 的熱門作品完全不同。AO3 上排前面的是哈利波特、星際大戰、漫威這類西方主流 IP。WildChat 的榜單長得完全不一樣。
2% 的人寫掉 8 成的對話
論文裡有一句話很誇張。
「小說子集裡 2% 的使用者,要為超過 80% 的對話負責。」
這裡要精確一點,素材流傳的版本說「2% 的帳號貢獻超過 8 成互動量」,但論文講的單位是對話數,不是互動量、訊息數或 token 數。這個區別很重要,因為對話數才是各家 AI 公司最常拿出來公布的那種指標。
而這 2% 的人在做什麼?研究者算了一個「prompt 重複率」,看同一個使用者的提示詞有多高比例落在同一個語意群集裡。
一般使用者(至少有兩筆對話)的重複率是 42%。
前 2% 的重度使用者,69%。
最多產的前十名使用者,85%。
這 57 萬筆對話是從免費 GPT 撈的
這是最容易被誤讀的一環,而它決定了整篇論文能推論到什麼程度。
WildChat 由艾倫人工智慧研究院(AI2)收集,時間是 2023 年 4 月 9 日到 2024 年 5 月 1 日。收集方式不是從 OpenAI 拿資料,而是在 Hugging Face Spaces 上架設免費的 GPT-3.5 Turbo 與 GPT-4 聊天介面,使用者點兩次同意彈窗,就能換到不用登入、沒有速率限制的免費使用權,代價是聊天紀錄可能被公開。
論文自己在方法論裡寫得很清楚,WildChat 不是所有 ChatGPT 使用者的代表性樣本。研究者推測這群人「比一般使用者更懂技術、更活在網路上」,也可能是來自低收入地區、來自 ChatGPT 被禁的國家,或者單純想測試模型底線、生成平台明令禁止內容的人。
34% 掉到 7.1%
研究團隊接著做了一件很簡單、但結果很兇的事。
他們用雜湊過的 IP 位址推估使用者身分,12,947 個 IP 收斂成大約 10,082 名使用者。然後,每個使用者只保留一筆對話。
小說類的佔比,從 34% 掉到 7.1%。
同一批資料,同一個問題,換一種演算法,答案差了將近五倍。
不只總量。論文在註腳裡補了一刀,一人一則之後,《Doki Doki Literature Club!》的排名「急遽下滑」,取而代之爬上榜的是《權力遊戲》和《寶可夢》這種真正大眾的作品。
也就是說,「ChatGPT 使用者最愛寫《Doki Doki Literature Club!》同人」這個結論,本身就是少數幾個人重複行為堆出來的假象。
上千次寫一個生小孩的橋段
值得注意的是,論文對這名匿名使用者的態度不是嘲笑。
研究者把這種行為放進「重複消費」的心理學脈絡裡,重看同一部電影、重逛同一座城市、重訪同一間美術館,有些研究甚至認為這類體驗「沒有人們以為的那麼重複」。
他們還借用了角色扮演遊戲的術語「re-rolling(重骰)」,玩家反覆重開,直到跑出滿意的數值。研究者觀察到,這名使用者通常會在某一次之後,把模型剛剛生成的回覆接回自己的提示詞裡,再重開一局,代表他終於喜歡上了那個版本。
論文對他的敘事給了一個很準的描述,「用大型語言模型生成的故事,每一個結局都稍有不同,同一個故事被重新做成新的」。
在這篇論文的框架裡,他不是異常,他是一種新讀者的極端形態。研究者稱之為「唯我論的讀者兼作者(solipsistic reader-writer)」,一個人在封閉的對話迴圈裡同時生產與消費故事,另一端沒有其他人類。
寫作與閱讀,向來需要兩個人。但用 AI 創作這兩個角色很可能是同一人。
所有「AI 正在重塑創作」的句子,都少了一個主詞
回到最開始那個問題。
我們每天都在讀這樣的句子。AI 正在改變人類創作。AI 生成內容爆炸性成長。某平台每月生成幾億則內容。某模型週活躍使用者突破幾億。
這些句子沒有一句是假的。它們只是全部省略了同一件事,誰在用,用了幾次。
一份 57 萬筆對話的資料集,34% 跟寫小說有關,聽起來像是一個時代的轉向。攤開來看,是一萬人裡的兩百個人,各自在同一個坑裡挖了幾千次。把每個人的權重拉平,這個時代的轉向就縮水成 7.1%。
下一次你看到某個 AI 產品公布「本月生成一億則內容」,值得多問那一億則是幾個人生成的?
這不是要否認 AI 創作正在發生。研究者自己也說,他們認為類似的重度使用者「很可能也在 ChatGPT、Claude、Gemini 上強迫性地生成小說」。這件事是真的。
真正的問題在於,用「使用量」去描述「使用者」,是一種結構性的誤讀。而整個 AI 產業目前公布的每一個數字,用的都是前者。
本文源自 arXiv: AI Fiction in the Wild,由動區動趨整理報導。