TAG

#內容審查

4 篇文章

TechLab 所有關於「內容審查」嘅文章、評測同教學,由最新排起。

Telegram 突然喺 App Store 消失:一則惡意舉報真係足以下架大型 app?Tech News

Telegram 突然喺 App Store 消失:一則惡意舉報真係足以下架大型 app?

Telegram 一度喺多個地區嘅 App Store 消失,刪走違規內容兼封鎖涉事帳戶後已恢復。CEO Pavel Durov 指事件源自刻意植入兒童性虐待內容嘅勒索攻擊,不過呢部分未有獨立證據;事件亦反映 Apple 處理大型 UGC app 時,開發者可以幾突然失去分發渠道。

1 個月前
極端組織輪流試唔同 AI,劍橋研究揭示單一平台封鎖點解追唔上Tech News

極端組織輪流試唔同 AI,劍橋研究揭示單一平台封鎖點解追唔上

劍橋 CASP 訪問 27 名前 Boko Haram 成員,發現部分人有組織咁用多款生成式 AI 處理情報、後勤同暴力相關問題。研究未能證明 AI 令攻擊能力大幅提升,不過揭示咗一個實際缺口:危險用家可以喺模型、帳戶同平台之間轉移,單靠逐次拒答未必擋得住。

2 個月前
Taboola 用 LLM 審廣告:由 demo 上線,差在模型外面嗰五層工程Tech News

Taboola 用 LLM 審廣告:由 demo 上線,差在模型外面嗰五層工程

Taboola 公開 LLM 廣告審查系統 Argus 嘅設計:模型只負責推理,外圍再加多階段審查、RAG、工具、模型路由同 prompt 測試。公司聲稱處理時間由 12 小時縮到幾分鐘,不過未有完整錯誤率同跨語言數據,暫時更值得睇嘅係佢點控制上線風險。

2 個月前
Anthropic 高薪請核武生化專家,Claude 安全網點解仲要真人把關Tech News

Anthropic 高薪請核武生化專家,Claude 安全網點解仲要真人把關

Anthropic 一口氣招聘核武、生化、爆炸品同網絡犯罪專才,年薪最高達 28.5 萬美元。職位名稱聽落搶眼,實際工作重點係審查模型互動、分流可疑個案同改善自動攔截系統,反映前沿 AI 安全已經由模型拒答,走到持續監察同真人執法判斷。

2 個月前