TAG
#內容審查
4 篇文章
TechLab 所有關於「內容審查」嘅文章、評測同教學,由最新排起。
Tech NewsTelegram 突然喺 App Store 消失:一則惡意舉報真係足以下架大型 app?
Telegram 一度喺多個地區嘅 App Store 消失,刪走違規內容兼封鎖涉事帳戶後已恢復。CEO Pavel Durov 指事件源自刻意植入兒童性虐待內容嘅勒索攻擊,不過呢部分未有獨立證據;事件亦反映 Apple 處理大型 UGC app 時,開發者可以幾突然失去分發渠道。
1 個月前
Tech News極端組織輪流試唔同 AI,劍橋研究揭示單一平台封鎖點解追唔上
劍橋 CASP 訪問 27 名前 Boko Haram 成員,發現部分人有組織咁用多款生成式 AI 處理情報、後勤同暴力相關問題。研究未能證明 AI 令攻擊能力大幅提升,不過揭示咗一個實際缺口:危險用家可以喺模型、帳戶同平台之間轉移,單靠逐次拒答未必擋得住。
2 個月前
Tech NewsTaboola 用 LLM 審廣告:由 demo 上線,差在模型外面嗰五層工程
Taboola 公開 LLM 廣告審查系統 Argus 嘅設計:模型只負責推理,外圍再加多階段審查、RAG、工具、模型路由同 prompt 測試。公司聲稱處理時間由 12 小時縮到幾分鐘,不過未有完整錯誤率同跨語言數據,暫時更值得睇嘅係佢點控制上線風險。
2 個月前
Tech NewsAnthropic 高薪請核武生化專家,Claude 安全網點解仲要真人把關
Anthropic 一口氣招聘核武、生化、爆炸品同網絡犯罪專才,年薪最高達 28.5 萬美元。職位名稱聽落搶眼,實際工作重點係審查模型互動、分流可疑個案同改善自動攔截系統,反映前沿 AI 安全已經由模型拒答,走到持續監察同真人執法判斷。
2 個月前