5千筆ChatGPT對話:前10%用戶發六成提問

研究機構Epoch AI在10月1日上線了一個名為ChatGPT usage explorer的資料瀏覽器。資料來自民調機構YouGov,該機構從美國樣本庫中隨機挑選5000名ChatGPT使用者,請他們匯出並分享自己的對話紀錄,時間涵蓋ChatGPT於2022年11月上線到2025年12月,總計約66萬則對話、830萬則訊息。資料匯出作業發生在2026年1月到8月之間。

與以往的調查相比,這批資料的不同之處在於它來自真實的使用紀錄,不靠受訪者回憶,也不靠OpenAI自行公布的統計。代價是看不到內容:YouGov在交給Epoch之前已刪除所有訊息正文,Epoch的研究人員沒有讀過任何一則對話,因此這個瀏覽器無法依主題或用途分類,只能看到頻率、長度、時間等中繼資料。

用得越來越頻繁

幾組數字都指向同一個方向。每位活躍使用者每月發出的訊息數,中位數從2023年1月的14則升到2025年12月的36則,平均數則從31則升到158則。

使用天數的分布變化更明顯。2023年12月到2025年12月期間:

  • 一個月只用1天的使用者,比例從32.6%降到22.1%;
  • 一個月用11到20天的,從8.1%升到17.0%;
  • 一個月用滿21天以上的,從2.6%升到10.5%,等於翻了將近兩番。

單次對話的中位數長度一直維持在2則提示詞,變化不大;平均長度則從3.7則拉高到5.8則。活躍使用者每月開啟的對話數,中位數從3個變成5個。

頭部使用者占了大半

Epoch給出的另一個數字是:最活躍的10%使用者,發出了63%的提示詞。

用總量粗略估算一下:830萬則訊息裡包含模型的回覆,假設使用者提問與模型回覆大致一問一答、各占一半,那麼使用者發出的提示詞約為415萬則。頭部500人占其中63%,約260萬則,平均每人約5200則,三年下來平均每天將近5則;其餘4500人合計約155萬則,平均每人約340則,大約每三天一則。這只是估算,Epoch並未公布提示詞的精確總數。

平均數與中位數之間拉開的差距,說的其實是同一件事:158則的月平均值,主要是由少數重度使用者撐起來的。

樣本的偏差

Epoch在說明裡把局限寫得很清楚。最大的一項是倖存者偏差:樣本只包含到2026年仍在使用ChatGPT的人,2022到2025年間試用過又放棄的使用者並未納入。前面那些「用得越來越頻繁」的曲線,至少有一部分是篩選出來的結果。

人口結構也和整體有落差。樣本裡大學畢業生占55%,美國成年人整體則是40%;西班牙語裔占8%,整體是19%。年齡層也比ChatGPT整體使用者群偏高:30歲以下占樣本的14%,整體是29%;65歲以上占樣本的18%,整體是10%。

還有幾項目前沒有答案。中繼資料裡記錄了每則回覆由哪個模型產生、呼叫了哪些工具,但正文並未公布模型的使用占比;參與者是否領取報酬,說明裡沒有寫,目前也無法查證。OpenAI至今沒有針對這份資料公開回應。依性別、年齡、收入、教育程度、就業狀態與訂閱類型拆分的數據,Epoch已放進可下載的資料集裡。

參考來源:Epoch AI官方發布頁、CocoLoop、YouGov樣本說明;數據經Epoch的方法說明核對樣本量、訊息總數與人口結構比例。