#本機 AI
59 篇文章
TechLab 所有關於「本機 AI」嘅文章、評測同教學,由最新排起。
3C 產品Raspberry Pi 5 跑 Gemma 4 E2B:8GB RAM 做到文件摘要,速度代價要接受
Gemma 4 E2B 細到可以喺 Raspberry Pi 5 離線運行,XDA 測得約 5.8–6.5 token/s,夠做文件摘要、家居資料整理同簡單 coding helper。不過「E2B」唔代表模型只佔 2GB,RAM、儲存、context 同散熱都要計清楚。
3C 產品一部 Strix Halo mini PC 包辦本機 AI:Lemonade 11 有幾實用?
Lemonade 11 將本機模型 server 擴成多模態 AI 中樞,文字、圖片、語音、3D 同模型分流都可以喺同一部 Strix Halo 主機處理。真正吸引嘅位係 OpenAI-compatible API,舊有 app 同自動化串接唔使大改;不過硬件投入、功能成熟度同私隱設定仍要逐樣計清楚。
3C 產品Mac Studio 傳今秋換 M5 Ultra:高階買家應唔應該等到 10 月?
消息指 Apple 最快今秋更新 Mac Studio,帶來 M5 Max 同 M5 Ultra。不過未公開效能、記憶體供應同售價仍然有好多變數。現款 M4 Max 適合急住開工嘅剪片同開發用戶;打算用大容量 RAM 跑本機 AI,等新機會穩陣得多。
3C 產品OpenClaw 塞入 mini PC 就取代到雲端?本機 AI 仲有幾道硬件關要過
Beelink SER10 MAX 預載 OpenClaw,睇落似開機就有私人 AI agent。不過 Tom’s Hardware 嘅測試顯示,64GB RAM、模型量化、記憶體頻寬同工具設定,樣樣都會拖慢體驗;資料留喺本機亦唔代表可以忽略權限同惡意 Skill 風險。
3C 產品RTX 3060 12GB 復產:2026 年買平價本機 AI 卡,舊 Ampere 仲抵唔抵?
五年前嘅 RTX 3060 12GB 重新生產,賣點由打機變成本機 AI。佢確實裝得落唔少量化 LLM、Stable Diffusion workflow 同 CUDA 工具,不過舊架構、速度、耗電同欠缺新功能都係代價。香港新貨身份未明,現階段買二手較合理。
3C 產品舊 SSD 加外置盒值唔值得玩?由備份、4K 剪片到本機 LLM 揀啱速度
升級電腦剩低嘅 HDD 或 SSD,加個外置盒就可以重新上場。不過接口寫住 10、20 甚至 80Gbps,唔代表實際傳檔有同樣速度。由普通備份、4K 剪片到本機 LLM,揀盒之前要先睇硬碟、電腦接口同散熱。
Tech NewsAMD 推 ROCm.AI,用自然語言幫開發者裝、跑同執 AI workload
AMD 想用 ROCm.AI 將安裝、部署、除錯同效能調校交畀 coding agent 處理,再配合 Ryzen AI Halo 畀開發者喺本機跑大型模型。方向幾實際,不過部分工具仲係預覽甚至規劃階段,距離完全免設定仲有一段路。
3C 產品Intel N100/N150 迷你電腦點樣變成本機 AI 閉路電視主機
平價 Intel 迷你電腦本身有 Quick Sync 同可跑 OpenVINO 嘅 iGPU,用 Frigate 就可以本機錄影兼辨認人、車等物件。N100/N150 未必全面贏過 Coral,但對幾支鏡頭嘅住宅、舖頭同小型辦公室,少買一件加速器確實吸引。
3C 產品二手 Tesla V100 平價加 16GB VRAM:本機 LLM 慳錢背後六個伏位
一張平價二手 Tesla V100,配合 RTX 4080 跑出 32 tokens/s,睇落幾吸引。不過 32GB 只係兩張卡合計,重有 SXM2 轉接、散熱、driver、耗電同重啟異常要處理,價錢亦唔可以直接照搬美國市場。
Tech News美企聯署力保 open-weight AI:限制一收緊,私有部署同成本都會受牽連
NVIDIA、Microsoft、Meta 等公司聯署,叫美國政府唔好太早限制 open-weight AI。表面係開放路線之爭,實際牽涉 GPU、雲端同企業 AI 生意;一旦模型發布或出口收緊,開發者嘅微調、私有部署同議價空間都可能縮水。
Tech News高階 Mac 可能要等到 M7:想買 MacBook Pro 使唔使忍到 2027?
The Verge 引述 Bloomberg 報道指 Apple 可能只出 base M6,Pro/Max 要等 M7 先返嚟。對剪片、coding、local AI workflow 嘅買家,重點落喺現有 M5 Pro/Max 夠唔夠用到下一輪大升級。
3C 產品斷網照樣開工:由筆記、文件到本機 AI,離線方案有幾可靠
XDA 作者用 Obsidian、Paperless-ngx、BentoPDF 同 Ollama 組成離線工具組合,方向幾實際,不過每款工具嘅「離線」意思都唔同。由檔案有冇下載、本機服務識唔識啟動,到同步衝突同登入授權,全部都要喺斷網前處理。
Tech NewsAMD Gorgon Halo 塞入 192GB RAM,本機跑 300B 模型有幾實際?
AMD 用 Gorgon Halo 將統一記憶體推高至 192GB,瞄準本機大型模型、coding agent 同企業自動化。不過 300B 只代表經 4-bit 量化後有機會載入,實際速度、長 context、ROCm 支援同供應情況,全部仍有數要計。
Tech NewsAMD 192GB Gorgon Halo 搬 AI agent 上桌面,300B 跑得到未必跑得順
AMD 用最高 192GB unified memory,令 Ryzen AI Max PRO 400 可以裝入 4-bit 量化嘅 300B 模型。不過官方暫時冇交出呢個情境嘅生成速度,ROCm 喺 Windows 亦仲有限制。真正啱用嘅,會係長時間跑模型、處理敏感資料同想控制 token 開支嘅團隊。
3C 產品Open CoDesign 可取代 Claude Design、Figma Make 同 Replit 嗎?免費背後仲有幾多成本
XDA 作者用 Open CoDesign 減少多個 AI 設計訂閱,但免費只限軟件本身,模型 token、現有訂閱、本機硬件同設定時間仍然要計。佢適合由設計原型直接交畀前端開發,但未能完整頂替 Figma 協作同 Replit 部署。
3C 產品本機 LLM 真係慳錢又保密?16GB RAM 只夠入門,雲端模型仲未退場
XDA 作者將 LLM 裝落自己部 Windows PC,最後變成每日主力工具。不過佢用緊 RTX 5070 加 32GB RAM,體驗唔代表一般 notebook。本機模型勝在離線、資料唔使交去第三方同冇用量限制,但模型質素、速度同硬件成本仍然要逐樣計。
Tech NewsMac 而家買定等?M6、OLED 觸控大改款嘅換機時間線
有消息指 Apple 會由今年秋季起更新多款 Mac,不過首部 M6 MacBook Pro 可能只係常規升級;OLED、觸控螢幕同新機身要再等一輪。急住換機可以照買現有 M5,做本機 AI 就要優先諗 RAM 同散熱。
3C 產品Apple 傳兩年內更新全線 Mac:而家買定等秋季 M6、OLED MacBook Pro?
Bloomberg 指 Apple 正籌備兩年 Mac 更新大計,秋季先有 M6 入門 MacBook Pro 同新 iMac,OLED 觸控 MacBook Pro 或要等到年底。傳聞涵蓋成條產品線,但唔同買家嘅答案差好遠。
Tech NewsCisco Antares 本機掃程式碼夠實用?細模型可縮窄範圍,漏洞判斷仍要靠人
Cisco 推出專攻漏洞定位嘅 Antares 細模型,可以留喺公司內網搜尋大型程式碼庫,減少敏感原始碼外流同雲端推理開支。不過官方 benchmark 顯示,現階段漏報同錯報都相當明顯,較適合幫資安人員排查可疑檔案,未夠資格獨力把守 CI/CD。
3C 產品Ollama 配 LM Studio:點解本機 AI 裝兩個 app 會順手啲
本機 AI 工具功能重疊得愈來愈多,但介面、整合方式同設定難度仍然差好遠。Ollama 適合做其他工具背後嘅模型服務,LM Studio 就方便搵模型、聊天同調校;揀之前仲要睇清 RAM、VRAM、私隱邊界同中文表現。
3C 產品本機 Qwen 卡住先叫 Claude Fable 5:慳 API 錢但私隱代價唔細
XDA 作者畀本機 Qwen 2.5 Coder 自己判斷幾時向 Claude Fable 5 求救,普通改碼留喺電腦,複雜問題先付 API 錢。不過真正難處係點定義「卡住」、截住失控呼叫,同埋避免私人程式碼跟錯誤資料一齊送上雲端。
3C 產品筆記留喺自己部機:本機 LLM 知識庫夠私隱,但未夠 NotebookLM 易用
將會議紀錄、客戶資料同私人筆記交畀雲端 AI,方便得嚟始終要計資料風險。本機 LLM 加 RAG 可以將檔案留喺自己部電腦,但由安裝、揀模型到中文搜尋都要自己調校,體驗同 NotebookLM 仲有一段距離。
Tech NewsRTX Spark 未到先開預覽,Windows on Arm 嘅 CUDA 生態要提早補課
NVIDIA 趕喺 RTX Spark 硬件推出前,先放出開發者 driver 同 CUDA Toolkit 13.4 預覽版。開發者可以用現有 Windows on Arm 裝置準備 Arm64/Arm64EC app,但 PyTorch、記憶體傳輸同除錯工具仍有已知問題,距離完整穩定嘅本機 AI workflow 仲有一段路。
3C 產品Docker Model Runner 可唔可以取代 Ollama?轉唔轉要睇開發流程
Docker Model Runner 已經做到拉模型、GPU 加速、OpenAI/Ollama-compatible API,仲可以直接接入 Compose。不過對用開 Ollama 嘅人,功能齊唔代表值得搬;值唔值得轉,主要睇模型格式、平台支援同現有開發流程。