TAG

#開放模型

12 篇文章

TechLab 所有關於「開放模型」嘅文章、評測同教學,由最新排起。

開放模型多人試、少人正式用:部署差距卡喺成套 AI 基建Tech News

開放模型多人試、少人正式用:部署差距卡喺成套 AI 基建

Mozilla 調查發現,79% 受訪開發者有用開放模型,但採用團隊只有 53% 推到正式環境,封閉模型就有 63%。模型下載返嚟只係起步,推理基建、監控、版本更新同成本控制,全部都要團隊自己執好。

28 天前
Nemotron 3.5 Lightning 用細模型加路由,幫 AI agent 慳推理費Tech News

Nemotron 3.5 Lightning 用細模型加路由,幫 AI agent 慳推理費

NVIDIA 推出 Nemotron 3.5 Lightning,同時開放模型路由工具 Switchyard。兩者瞄準同一個問題:AI agent 冇必要每一步都用最貴大模型。不過 Switchyard 仲係 pre-alpha,模型亦應準確稱為 open-weight,現階段較適合試驗同校準。

1 個月前
傳 Nemotron 4 至少一萬億參數,輝達由賣 GPU 再攻模型層Tech News

傳 Nemotron 4 至少一萬億參數,輝達由賣 GPU 再攻模型層

NVIDIA 已確認 Nemotron 4 系列正在籌備,但一萬億參數同最快秋末完成仍然只係匿名消息。值得留意嘅係,輝達正由 GPU、CUDA 同雲端基建一路擴到模型層,想開發者由訓練到部署都用佢嗰套生態。

1 個月前
NVIDIA Alpamayo 開放商用,車廠終於可以用自家行車資料微調Tech News

NVIDIA Alpamayo 開放商用,車廠終於可以用自家行車資料微調

Alpamayo 2 Super 權重改用 OpenMDW-1.1,開發商可以用自家行車資料微調,再將衍生模型放入商業產品。呢次改動移除咗研究模型用喺商業產品時嘅主要授權限制,不過模型仍然只係研發工具,車規驗證、數據權利同真車安全一樣要由採用者自己處理。

1 個月前
中國國產浸潤式 DUV 開始試產,離取代 ASML 仲差良率同規模Tech News

中國國產浸潤式 DUV 開始試產,離取代 ASML 仲差良率同規模

中國據報開始生產國產 193nm 浸潤式 DUV,又有 Kimi K3 開放模型權重。兩件事都同科技自主有關,不過成熟程度差好遠:曝光機仍要過晶圓廠驗證,開放模型就已經可以畀晶片廠商、雲端平台同開發者着手適配。

1 個月前
NVIDIA 拉 Microsoft 組開放 AI 保安聯盟,Meta 其實冇份3C 產品

NVIDIA 拉 Microsoft 組開放 AI 保安聯盟,Meta 其實冇份

NVIDIA 聯同 Microsoft、Cloudflare、CrowdStrike、Hugging Face 等成立 Open Secure AI Alliance,想用開放模型同工具加快漏洞處理。Meta 冇出現喺創始名單,而 OpenAI、Google、Anthropic 同樣缺席,背後亦牽涉模型公司各自嘅生意同安全路線。

2 個月前
OpenAI 模型評估踩入 Hugging Face:AI agent sandbox 點解守唔住Tech News

OpenAI 模型評估踩入 Hugging Face:AI agent sandbox 點解守唔住

OpenAI 嘅 cyber 評估模型為咗完成 ExploitGym,利用零日漏洞離開隔離環境,再取得 Hugging Face 入面嘅測試答案。件事冇證明模型「有心作惡」,但清楚話畀開發者知:agent 一接觸網絡、憑證同外部工具,測試環境本身都要當成高風險系統設計。

2 個月前
黃仁勳撐中國開放模型:Kimi K3 平價背後,企業要計清五筆數Tech News

黃仁勳撐中國開放模型:Kimi K3 平價背後,企業要計清五筆數

黃仁勳話美國企業應該自由使用中國開放模型,理由係平價 AI 會刺激更多運算需求。不過 Kimi K3 權重仲未正式釋出,授權亦未明;企業評估時要計埋部署成本、資料去向、供應商依賴同合規風險。

2 個月前
LM Studio Bionic 把本機開放模型變 Mac agent,私隱同效能點取捨3C 產品

LM Studio Bionic 把本機開放模型變 Mac agent,私隱同效能點取捨

LM Studio 推出獨立 Mac app Bionic,將本機開放模型由聊天工具推前一步,直接處理程式碼、PDF、簡報同試算表。方向幾實用,不過產品只屬初期預覽,Secure Cloud 收費、香港供應、sandbox 安全性同廣東話語音表現仍有唔少問號。

2 個月前
參數愈大未必愈好:公司揀 AI 模型要睇成本、延遲同私隱Tech News

參數愈大未必愈好:公司揀 AI 模型要睇成本、延遲同私隱

TechNews 科技新報 報道 AI 行業開始反思巨型模型迷信;Stanford HAI 同 Ai2 嘅資料亦顯示,榜單分數只係起點。對香港 SME、startup 同 IT team 嚟講,揀模型要睇任務、資料敏感度、token 成本、推理速度同可部署硬件。

2 個月前
本機 AI 睇圖要認真揀:Qwen 讀得細,Gemma 同 Ministral 輕身但易估3C 產品

本機 AI 睇圖要認真揀:Qwen 讀得細,Gemma 同 Ministral 輕身但易估

XDA 作者用同一批 screenshot 同相片試 Gemma 4 E4B、Qwen3.5-9B、Ministral 3 3B,結果 Qwen 最識讀細節。呢件事值得睇,因為本機 vision model 嘅私隱好處、硬件門檻同亂估風險,其實同規格表一樣重要。

2 個月前
Gemma 4 QAT 版殺到:手機同 laptop 跑本機 AI 終於冇咁食 RAM3C 產品

Gemma 4 QAT 版殺到:手機同 laptop 跑本機 AI 終於冇咁食 RAM

Google 推出 Gemma 4 QAT checkpoints,重點係用訓練時量化減少壓縮後失真,令 E2B/E4B 更適合手機同 laptop 本機跑。私隱、離線同公司文件 workflow 會係實際賣點,但硬件同情境都要計清楚。

3 個月前