#人工智能
100 篇文章
TechLab 所有關於「人工智能」嘅文章、評測同教學,由最新排起。
Tech NewsAnthropic 高薪請人教 Claude 設計晶片,AI agent 已摸到 EDA 核心
Anthropic 開出最高 85 萬美元年薪,請晶片專家訓練 Claude 處理 RTL、驗證同實體設計。個職位未足以證明 Claude 自家晶片就嚟量產,卻清楚反映 AI agent 已經由軟件開發踩入 EDA 工程鏈,工程師嘅技能組合亦開始轉。
Tech NewsOpenAI 放慢 Astra 開發:coding agent 攻防能力愈強,發布限制愈難定
OpenAI 話 Astra 嘅初步評估強到未能排除 Critical 網絡安全能力,所以收緊內部測試同放慢部分開發。呢句唔代表模型已證實跨過門檻,不過 coding agent 愈識長時間自主搵漏洞,安全限制、專業用途同發布速度之間確實愈難平衡。
3C 產品ChatGPT 免費版下周開放無限文字對話,但用嘅只係 GPT‑5.6 Luna
OpenAI 會畀 Free 同 Go 用戶無限用 GPT‑5.6 Luna 傾文字,不過檔案、圖片同其他工具照有限額,Think 模式亦冇承諾無限。Plus 就改用較強嘅 Sol,付費方案之間嘅分別亦變得幾微妙。
Tech NewsKimi K3「逃出 sandbox」真相:外網設定錯誤揭出 agent 權限風險
Kimi K3 喺安全評測期間成功連上 GitHub,直接攞到題目答案。「逃出 sandbox」聽落好戲劇化,實情係測試環境冇封好外連。呢宗事故冇涉及 zero-day,不過對公司用 coding agent 仍然係一個幾實際嘅警號。
Tech NewsGoogle 開源 WeatherNext 2:15 日颱風預報要點睇?
Google 開放 WeatherNext 2 同熱帶氣旋專用模型,聲稱可以一次預測路徑、強度同形成機會,最遠去到 15 日。不過呢個數字代表概率情景,距離「提早 15 日準確預警」仲好遠;至於對香港有幾大參考價值,就要等西北太平洋嘅實際表現有更多驗證先知。
Tech NewsChatGPT 免費版下周無限純文字對話:Luna、Think 同工具限額逐樣拆
OpenAI 會向 Free 同 Go 用家開放無限純文字對話,預設模型轉做 GPT‑5.6 Luna,亦會加入 Think 按鈕。不過檔案、圖片、語音同其他工具仍然有限額,Think 可用幾多次亦未完全講清楚;香港推出時間同樣未有官方確認。
3C 產品Kimi K3 開放權重但難稱本機 AI:一般開發者點樣先用得着
Moonshot AI 公開 Kimi K3 全套權重,模型表現亦貼近頂級封閉模型。不過成套檔案約 1.56TB,正式部署要多張數據中心 GPU。對一般開發者嚟講,API 仍然最易用;開放權重真正吸引之處,係企業可以控制部署環境、模型版本同資料流向。
Tech News香港關鍵基建新例生效:OT 系統最難補嘅洞,AI 暫時幫到幾多?
香港關鍵基建電腦系統新例已經生效,能源、運輸、銀行同醫療等指定營運者要交保安計劃、定期評估風險同按時通報事故。Fortinet 全球調查就揭出另一個現實:唔少機構連自己有幾多 OT 資產都未睇得清,AI 再叻都補唔到呢個基本缺口。
Tech NewsReddit Rules Hub 用 LLM 判規則意圖,易用但要防誤判
Reddit 推出 Rules Hub,交由 LLM 理解每個社群規則想管啲咩,再自動移除、送入審核 queue 或只留紀錄。設定係簡單過寫 regex,不過規則寫得含糊,AI 執法邊界一樣會含糊;版主能否查到原因、修正誤判同處理申訴,先決定呢套工具係慳時間定添麻煩。
Tech NewsMistral 推 3B 圖文審核模型:政策即寫即用,自行部署仍要人睇實
Shieldstral 1.0 3B 可以一套模型審核文字、圖片同圖文內容,政策用自然語言即時指定,亦可放喺自己部 server 跑。彈性確實高,不過官方測試未證明佢識廣東話同香港語境,速度、誤判同對抗規避能力亦要逐樣驗清楚。
Tech NewsGoogle Earth 假衛星圖玩一日即撤:Nano Banana 2 點解踩中資訊安全紅線
Nano Banana 2 一度可以直接改造 Google Earth 真實地貌,幾句 prompt 就整到災難、衝突等假衛星圖。功能推出翌日已俾 Google 撤回,事件亦揭出 SynthID 有用但唔足以單獨判斷圖片真偽。
Tech NewsQwen3.8-Max 正式版開放:平價挑戰 Claude,開發者值得試幾深?
阿里把 Qwen3.8-Max 由 Preview 推到正式版,主打 coding、agent 任務同一百萬 token context。API 價錢相當進取,亦可以接入 Claude Code,不過「媲美 Anthropic」暫時主要靠廠方數字,正式採用前仲有穩定性同資料安排要查清楚。
3C 產品Gemini Android 測試手機建立 AI agent,五款模板先行試水溫
Google 似乎想將建立 AI agent 搬入 Gemini Android app,初期可能用五款生活、學習同工作模板降低門檻。不過資料只來自 APK 拆包,免費帳戶資格、廣東話支援同代理可執行幾多操作,全部仍未確認。
Tech NewsAstra 交出十項數學研究成果,AI 科研協作去到邊?
OpenAI 話未公開嘅 Astra 推進咗十項數學同理論電腦科學研究,仲交出論文同 Lean 證明。成果份量唔細,不過十項都係官方揀出嚟嘅成功個案,外界暫時重跑唔到模型,真正命中率同研究成本仍然係問號。
Tech NewsOpenAI Astra 推進十項數學難題,AI 開始試做長時間原創研究
OpenAI 公開內部模型 Astra 推進十項數學同理論電腦科學難題,亦放出論文、推理整理同 Lean 證明檔。真正值得睇嘅位,係模型識得長時間試路、撞板再重組思路;不過機器驗證、專家閱讀同正式同行評審,仍然係三個唔同層次。
Tech NewsAI 搵漏洞快過微軟修補:Project Glasswing 點解會令安全更新愈來愈大
Anthropic 嘅 Mythos 大幅加快漏洞搜尋,但搵到問題只係第一步。微軟內部資料顯示,SharePoint 等產品一度積壓大量待修補漏洞;隨住每月更新愈來愈大,企業 IT 要重新安排測試、部署同停機節奏。
3C 產品Kimi K3 公開 2.8T 權重都難放入屋:MoE 慳運算,冇幫你縮細模型
Kimi K3 公開權重後,模型檔案任人下載,不過 2.8T 參數仍然令一般電腦食唔消。MoE 只係減少每次推理嘅運算量,完整權重照樣要擺入儲存同記憶體。一般開發者實際會用 API,成本、資料處理條款同 coding agent 效率先值得細睇。
Tech News賓州學校收風後被指沉默:最少 59 名女生受害,AI 不雅照暴露通報缺口
賓州一間私立學校俾受影響學生同家長控告,原告指校方收到 AI 不雅照線報後幾個月冇通知女生,涉事男生其間繼續製圖。校方要求撤案,但呢場官司帶出一個更實際嘅問題:院校收到風之後,究竟要幾快查、通知邊個,同點樣制止影像流傳?
Tech NewsAI 陪你傾足一星期:建立信任同叫人照做竟然贏過受訓真人
一項 USENIX Security 2026 研究發現,LLM agent 喺一星期 WhatsApp 盲測入面,建立信任同說服參加者安裝 app 嘅表現都贏過受訓真人。研究規模雖然細,亦冇涉及真金白銀,但已經帶出一個實際警號:對方傾得自然、記得你講過咩,唔再係可信證明。
Tech NewsAI 由識傾變成識郁:Gemini Robotics 2 控全身兼識叫機械人幫手
Google DeepMind 推出 Gemini Robotics 2,控制範圍由枱面操作擴至人形機械人全身,仲加入長任務規畫、多機協作同本機運算。不過官方數據顯示精細手部動作仍然好飄,公開使用資格同硬件要求亦未明朗。
Tech NewsGemini Robotics 2 由腳到手指都識控制:機械人離返工仲有幾遠?
Google DeepMind 用 Gemini Robotics 2 控制人形機械人由行路、彎身到執嘢,仲加入長任務規劃同多機協作。不過官方示範做到一次,同機械人可以喺工場穩定做足成日,中間仍然隔住可靠性、安全認證同部署成本幾道關。
3C 產品AI 情緣騙案點解開始贏真人?研究揭示舊式辨認警號已經唔夠用
AI 寫出嚟嘅情緣騙案對話,文法可以自然、識得記住舊事,仲會長時間扮關心。最新研究發現,受試者較信任 AI 對話者,亦較願意按要求下載 app。不過實驗只有 22 人,46% 絕對唔係付款成功率。
Tech NewsOpenAI 免費開放 GPT‑5.6 畀學者:首批 1 萬人,香港資格未明
OpenAI 今個夏天會先畀 1 萬名研究者免費用 GPT‑5.6、Codex 同 deep research,2027 年內再擴至 10 萬人。不過計畫只限指定研究型院校,香港亦未喺官方支援地區名單,申請資格仍然未明。
Tech NewsAI 用 60 小時搵出 HAWK 弱點,NIST 後量子簽署候選方案退賽
Anthropic 嘅 Mythos Preview 用約 60 小時搵到 HAWK 格結構內一個關鍵對稱,令破解成本大跌。HAWK 團隊確認問題後退出 NIST 評審;完整 AES、手機同網站加密暫時冇受影響。