AI 搜尋食走流量,Wikipedia 要點守住網上知識底座?
Tech News

AI 搜尋食走流量,Wikipedia 要點守住網上知識底座?

圖片:via TechNews 科技新報 — https://technews.tw/2026/07/11/wikipedia-fights-for-survival/
TechLab 編輯部(譯)·

流量跌、bot 成本升,開放知識而家要重新計數

AI 答案背後,仲係嗰本百科

TechNews 科技新報報道,Wikipedia 踏入 25 年遇上幾條壓力線:美國政治圈攻擊佢有偏見、AI 公司大量取用內容、部分政府對義工同開放知識組織施壓。呢件事唔係「Wikipedia 就快玩完」咁簡單。Wikipedia 今日仍然有人用,但好多用法已經搬咗去 AI 介面。 你睇到嘅答案可能有 Wikipedia 嘅骨,但你未必再入去睇條目、註腳同修訂紀錄。

Wikimedia Diff 圖表,展示 2021 年起各語言 Wikipedia 真人 pageview 走勢

圖片:Wikimedia Diff / Wikimedia Foundation

流量跌,唔代表價值跌

Wikimedia Foundation 喺 2025 年 10 月講過,佢哋重新分辨 bot 同真人流量之後,見到 Wikipedia 真人 pageview 較 2024 年同期少咗約 8%。同一批資料亦指向一個好現實嘅變化:搜尋引擎直接畀 AI 摘要,年輕用戶又多咗喺短片平台搵資料,入口唔再淨係 wikipedia.org。另一邊,2026 年 arXiv 一篇研究估算,Google AI Overviews 出現之後,受影響英文 Wikipedia 條目每日流量低咗約 15%。呢啲數字未必係最終判決,但方向好清楚:答案介面食走咗原文點擊。

Wikimedia 多媒體頻寬需求走勢圖,顯示 2024 年後基礎負載上升

圖片:Wikimedia Diff / Wikimedia Foundation

開放內容都要 server 錢

少咗人入站只係 AI 對 Wikipedia 嘅壓力入面一部分。Wikimedia 喺 2025 年 4 月公開講,Wikimedia Commons 多媒體下載頻寬自 2024 年初起多咗 50%;佢哋解釋,增長主要係自動 crawler 掃內容餵 AI 模型,唔關真人突然狂下載圖同片事。麻煩位係,bot 只佔約 35% pageview,但就食咗 65% 最貴、要打到核心 data center 嘅流量;到 2026 年 3 月,Wikimedia 話已經封鎖或限速約 30% 唔守規矩嘅自動請求。開放授權保證內容可以再用,但 server、頻寬、工程人手都要錢。

Wikipedia 開始同大平台重新計數

所以 Wikimedia Enterprise 呢條線變得重要。2026 年 1 月 Wikipedia 25 週年時,Wikimedia Enterprise 公開 Amazon、Meta、Microsoft、Mistral AI 同 Perplexity 成為夥伴,加埋原本已有 Google 等客戶,畀大型重用者用高吞吐 API、snapshot 同 realtime update 取資料。呢個做法冇把 Wikipedia 變 paywall;免費網頁、資料 dump 同 API 仍然喺度。分別係,當商業 AI 產品大規模靠佢做底層資料,就唔應該再扮普通瀏覽器掃全站,然後將成本丟返畀捐款者同義工社群。

政治壓力係另一條線,但唔好攪混

政治攻擊同威權壓力要分開睇,來源同範圍都要講清楚。Wikimedia 官方資料顯示,2026 年 7 月 8 日中國再次否決 Wikimedia Foundation 成為 WIPO 永久觀察員,基金會話呢係第六次;佢哋亦有 Human Rights Team 支援因為善意編輯而遇到威脅、騷擾或監控嘅義工。呢啲同 AI 流量係兩件事,但放埋一齊睇,就見到 Wikipedia 今日要處理嘅已經超出百科網站營運,牽涉平台政策、版權規則、網上安全同國際政治拉扯。

用 AI 查資料,唔好停喺第一句答案

對一般用戶同學生嚟講,最實際做法係可以用 AI 起步,但唔好將單一 chatbot 當終點。問完 ChatGPT 或 Perplexity,至少要撳入來源睇原文日期、作者、註腳同上下文;如果答案引用 Wikipedia,就入返條目睇 reference、history 同 talk page,尤其係醫療、法律、金融、政治人物資料,唔好淨係抄摘要。Pew Research Center 2025 年研究見到,有 AI summary 嘅 Google 搜尋,用戶撳傳統結果得 8%,冇 AI summary 時係 15%,而直接撳 summary 入面來源只得 1%。AI 可以做起點,唔好做終點。

創作者同開發者要改習慣

內容創作者可以用 AI 答案搵線索,但數字、引述、公司講法、發布日期都要返官方公告、論文、監管文件或原始訪問確認。開發者如果要做 RAG、搜尋工具或 fact-check pipeline,就應該優先用 Wikimedia dump、API 或 Enterprise 呢啲清楚渠道,保留 page ID、revision、license 同 attribution,唔好用冇標識嘅 crawler 掃完就算。Wikipedia 值錢嘅地方,落喺背後有人改錯、補註腳、爭論共識嘅流程;AI 想用呢套知識,就要保留返足夠路徑畀人查返源頭。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook