
三分一新網頁有 AI 痕跡?35% 背後其實係兩份研究、兩套估法
數字反映 AI 已大規模介入網上寫作,但未量到內容好壞同實際影響
35% 係點計出嚟
Pew Research 喺 Common Crawl 抽咗 2021 年 1 月至 2026 年 7 月共 49 批網頁,每批隨機揀 10,000 個英文頁面,合共 49 萬頁。單睇 2026 年 7 月嗰批,全部網頁有約 10% 帶明顯 AI 寫作痕跡。報道講嘅 35%,就係再篩走舊內容,只計有發表日期、兼且日期遲過 ChatGPT 於 2022 年 11 月 30 日公開推出嘅頁面。
呢個分母好重要。每批 Common Crawl 樣本只有約 10% 至 15% 網頁,可以由 HTML 搵到發表日期,而有日期嘅內容本身亦唔係網上內容嘅隨機縮影。新聞網站、blog 同產品文章通常日期清楚,工具頁、討論區、舊資料庫或者持續更新嘅頁面就未必有。所以 35% 應該理解成「有日期嘅 ChatGPT 後英文頁面之中,detector 判斷有明顯 AI 參與嘅比例」,範圍窄過「三分一互聯網由 AI 寫」。

圖片:Pew Research Center
Detector 量到痕跡,唔會知道作者撳過咩掣
Pew 用開放權重嘅 Open Pangram editlens_Llama-3.2-3B,模型會畀每頁一個 0 至 1 分數,0 代表傾向全人手寫,1 代表傾向全 AI 生成;今次將 0.2 或以上列為有「實質」AI 寫作或編輯痕跡。換句話講,35% 已經包埋人先寫底稿、再交畀 AI 大幅改寫嘅內容,唔等於當中每一頁都由 chatbot 一手包辦。
研究團隊另抽 62,370 頁,用 Pangram 3.3 商用模型重跑,兩款模型有 96% 個案分類一致,不過 Cohen’s kappa 係 0.61,反映扣除偶然一致後仍有一批分歧。Open Pangram 喺 ChatGPT 面世前嘅頁面亦錄得約 1% 命中,Pew 認為當中應該有假陽性。連 Pangram 自己都寫明,開放模型適合研究用途,唔建議攞嚟執行學校或公司嘅 AI 使用政策。用佢睇大趨勢有參考價值,拎單一頁面去判人有冇用 AI 就冇咁穩陣。

圖片:Pew Research Center
另一份研究都係 35%,方法完全唔同
有趣嘅位係,Imperial College London、Internet Archive 同 Stanford 研究人員今年 4 月發表嘅 arXiv preprint,同樣估到 2025 年中約 35% 新網站有 AI 生成或輔助文字。嗰份研究用 Wayback Machine,由 2022 年 8 月追到 2025 年 5 月,每月目標抽 10,000 條首次收錄嘅 URL,每個 host 最多留一頁,再抽出每頁最長、至少 100 字嘅英文段落分析。團隊比較四款 detector 後揀咗 Pangram v3。
兩個 35% 接近,算係幾有力嘅交叉訊號,因為 Common Crawl 同 Wayback Machine 用嘅抽樣方法唔同。不過兩者始終都只見到 crawler 收得到嘅公開英文頁面,登入牆、付費內容、app 內文章同未俾 archive 收錄嘅網站都可能缺席;逐網站平均抽樣亦唔等於按瀏覽量加權。研究估到網頁供應有幾多 AI 痕跡,冇估到普通人每日實際睇到幾多。 Pew 呢份係資料分析文章;另一份暫時仍係 preprint,未見同儕審查。另一份研究亦披露 Pangram 提供 API research grant,睇結果時要將呢層關係計埋。

圖片:Pew Research Center
內容係咪真係差咗,證據未去到咁遠
Wayback Machine 嗰份研究搵到,AI 痕跡增加同語意多樣性下降、正面語氣增加有統計關連;AI 類網頁之間談論嘅意思較接近,語調亦較常偏向正面。不過研究冇搵到足夠統計證據,證明事實錯誤增加、文章變長但資訊密度下降、外部連結減少,或者文風整體變得更一致。月度數據嘅相關性亦未足以證明 AI 直接造成轉變,網站類型同發文潮流都可能一齊影響結果。
研究另問過 853 名美國成人,多數人相信 AI 會帶來上述各種負面影響,但實際數據只支持其中兩項。呢個調查只反映美國受訪者觀感,唔可以直接套落其他市場。至於 Pew 發現破折號、Oxford comma、三項式列表同某類句式愈來愈常見,呢啲最多係大型文本集合入面嘅線索;人類一樣會咁寫,單靠幾個用字捉 AI,好易連正常作者都一齊捉錯。
搜尋資料,要由來源鏈判斷
生成式 AI 將大量寫作成本壓低之後,搜尋結果見到十篇講法相近嘅文章,未必代表有十個獨立來源支持件事;佢哋可能改寫同一份新聞稿、同一篇報道,甚至互相引用。查規格、健康、法律、投資或者歷史資料時,較穩陣嘅做法係追到官方文件、原始數據或具名專家,再核對發表日期、作者、修訂紀錄同引用連結。Detector 分數可以提示你再查,唔適合代替呢條來源鏈。
Pew 呢個 35% 最實在嘅訊息,係 AI 參與英文網上寫作已經去到大型抽樣清楚可見嘅規模。至於搜尋品質、錯誤資訊同大家實際接觸量有冇同步轉差,今次兩套研究都未量得完整;下一步要睇按流量加權、涵蓋更多語言,兼且長期追蹤同一批網站嘅數據。
參考來源
- TechCrunch — A third of webpages published since ChatGPT’s launch show signs of AI authorship, study finds — original report
- How Much of the Internet Is Written With AI? — Pew Research 官方研究文章,交代 10%、35% 同各頂級網域結果
- Methodology: How Much of the Internet Is Written With AI? — 官方方法頁,確認 49 萬頁樣本、日期限制、偵測門檻同模型比對結果
- The Impact of AI-Generated Text on the Internet — 另一份得出約 35% 結果嘅 preprint,提供 Wayback Machine 方法同內容影響分析
- The Impact of AI-Generated Text on the Internet — project page — 研究團隊整理嘅完整結果、六項假設、調查資料同 Pangram 資助披露
- Introducing Open Pangram — 模型開發商交代 EditLens 原理、測試表現同不適合用作個人執法判斷嘅限制
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







