#內容審核
13 篇文章
TechLab 所有關於「內容審核」嘅文章、評測同教學,由最新排起。
Tech News四個平台圍堵 AI 垃圾:封推薦、減曝光同斷廣告錢,邊招最有效?
Snapchat、LinkedIn、Substack 同 YouTube 都開始壓低低質 AI 內容,不過四間公司落手位置完全唔同:有啲郁推薦,有啲郁收入,亦有啲交個判斷畀用戶。措施有用,但偵測結果同「垃圾」之間仲有一段距離。
Tech NewsReddit Rules Hub 用 LLM 判規則意圖,易用但要防誤判
Reddit 推出 Rules Hub,交由 LLM 理解每個社群規則想管啲咩,再自動移除、送入審核 queue 或只留紀錄。設定係簡單過寫 regex,不過規則寫得含糊,AI 執法邊界一樣會含糊;版主能否查到原因、修正誤判同處理申訴,先決定呢套工具係慳時間定添麻煩。
Tech NewsMistral 推 3B 圖文審核模型:政策即寫即用,自行部署仍要人睇實
Shieldstral 1.0 3B 可以一套模型審核文字、圖片同圖文內容,政策用自然語言即時指定,亦可放喺自己部 server 跑。彈性確實高,不過官方測試未證明佢識廣東話同香港語境,速度、誤判同對抗規避能力亦要逐樣驗清楚。
Tech NewsTelegram 因一宗違規內容短暫下架:App Store 審核點解咁大殺傷力
Telegram 一度喺多個地區嘅 App Store 消失,清走違規內容後數小時內恢復。事件顯示 Apple 管唔到 app 入面每個群組,出事時只能向成個 app 落手;不過所謂植入內容勒索,暫時只有 Telegram 創辦人一方講法。
Tech NewsTelegram 已恢復上架:改舊訊息點樣變成 App Store 下架武器
Telegram 一度喺全球 App Store 消失,數小時後已經恢復。Apple 確認下架同違規內容有關;創辦人 Durov 就指,有人改動舊訊息避開群組成員視線,再直接向 Apple 舉報。兩邊講法揭開咗用戶內容 app 一個幾棘手嘅漏洞。
3C 產品Telegram 短暫落架揭出舉報漏洞:舊訊息點樣變成攻擊入口
Telegram 因群組出現兒童性侵害素材,一度俾 Apple 從 App Store 落架。事件好快解決,但舊訊息編輯、平台外舉報同先落架後聯絡嘅做法夾埋,示範咗內容審核工具點樣可以俾人反過來利用。
Tech NewsAI 幫你寫又幫你捉 AI 文:Superhuman 買 GPTZero 想攬住成條寫作鏈
Superhuman 同意收購 GPTZero,金額冇披露。表面睇好矛盾:Grammarly 一邊推 AI 寫作,一邊買 AI detector;背後盤算係將電郵、功課、CV、報告入面嘅「誰寫、點寫、啱唔啱」都納入同一套工具。
Tech NewsGrok 成人內容流量曝光:xAI 點解愈行愈露骨,風險又有幾大
Engadget 引述 The Information 報道,Grok 逾半流量據報同 NSFW 用途有關,仲有人用 coding model 平價繞路。呢件事要睇嘅位,係成人互動點樣變成 AI chatbot 嘅增長來源,同時拖高 deepfake、CSAM 同企業採用風險。
Tech NewsMeta 禁眼鏡偷拍騷擾片,Instagram 審核點解會愈做愈難
Instagram 開始移除用 Meta 眼鏡偷拍兼騷擾途人嘅影片,相關帳戶亦可能停用。不過條片經剪輯或者跨平台重傳後,原本嘅來源線索可以消失,騷擾語境又未必寫喺畫面上,Meta 呢次禁片遠未解決智能眼鏡帶嚟嘅審核難題。
Tech NewsInstagram 開始封用 Meta 智能眼鏡偷拍滋擾嘅帳戶,普通拍片唔等於中招
Instagram 開始處理一批用 Meta 智能眼鏡暗中拍攝陌生人、再靠整蠱或搭訕內容搵流量嘅帳戶。重點放喺滋擾同佔人便宜,正常用眼鏡拍片唔會自動封號;不過 Meta 仲未公開點樣偵測、幾多次違規先封帳戶,同埋申訴點處理。
Tech NewsRoblox Build 用一句 prompt 喺手機砌遊戲,零 coding 入場仍有代價
Roblox 推出手機優先嘅 Build,聲稱用一句 prompt 就可以生成、修改、試玩同發佈基本遊戲。門檻的確低咗,但 public alpha 尚未有獨立實測,生成質素、內容審核、版權責任同大量低質作品湧入,全部仍有待驗證。
Tech NewsX 用 Grok 捉偷內容再改派收益,原創有錢收但誤判點申訴仍講唔清
X 話新版 Grok 捉重複內容嘅能力高過舊版三倍,仲會將相關收益改派畀最早上載者。方向合理,不過平台冇公開判斷準則、準確率同個案申訴安排;改圖、評論式轉載同合理使用會點處理,暫時仍有一大截空白。
Tech NewsMeta 放寬審核後仇恨留言急升,問題唔止係美國政治
CCDH 分析近 800 萬則 Facebook 留言,指 Meta 2025 年放寬主動審核後,針對美國政治人物嘅攻擊留言大升。Meta 話全平台違規內容盛行率冇惡化,但兩邊量度嘅其實係兩件事。