TAG

#開源模型

17 篇文章

TechLab 所有關於「開源模型」嘅文章、評測同教學,由最新排起。

Unsloth Dynamic v3.0 同容量留多啲精度,本機跑 Qwen 有咩實際分別Tech News

Unsloth Dynamic v3.0 同容量留多啲精度,本機跑 Qwen 有咩實際分別

Dynamic v3.0 用新校準資料重新判斷邊啲模型層最怕壓縮,令 GGUF 喺相若容量下少失一截精度。首個版本落喺 Qwen3.8-27B,Ollama、LM Studio 同 llama.cpp 都用得,不過官方暫時冇交代 token 速度,準確率數字亦未有獨立測試確認。

24 小時前
WeatherNext Cyclones 預報平均早一日,唔等於香港風球會提早Tech News

WeatherNext Cyclones 預報平均早一日,唔等於香港風球會提早

WeatherNext Cyclones 喺歷史風暴基準入面,預測路徑、強度同風圈平均多咗逾 24 小時優勢。不過呢個係整體誤差比較,唔代表每個風暴都準一日,仲唔會直接改變香港天文台發風球嘅時間。

15 天前
Google 開源 WeatherNext 2:一分鐘預報要睇清 TPU 同 ensemble 條件Tech News

Google 開源 WeatherNext 2:一分鐘預報要睇清 TPU 同 ensemble 條件

Google 開放 WeatherNext 2 同氣旋專用模型,研究團隊可以自行跑全球十五日預報。模型喺氣旋路徑、強度同風場測試都有進步,不過「一分鐘」只計單次預報,完整 ensemble 嘅時間同成本仍要另計。

15 天前
Google 開源 WeatherNext 2:15 日颱風預報要點睇?Tech News

Google 開源 WeatherNext 2:15 日颱風預報要點睇?

Google 開放 WeatherNext 2 同熱帶氣旋專用模型,聲稱可以一次預測路徑、強度同形成機會,最遠去到 15 日。不過呢個數字代表概率情景,距離「提早 15 日準確預警」仲好遠;至於對香港有幾大參考價值,就要等西北太平洋嘅實際表現有更多驗證先知。

16 天前
Mistral 推 3B 圖文審核模型:政策即寫即用,自行部署仍要人睇實Tech News

Mistral 推 3B 圖文審核模型:政策即寫即用,自行部署仍要人睇實

Shieldstral 1.0 3B 可以一套模型審核文字、圖片同圖文內容,政策用自然語言即時指定,亦可放喺自己部 server 跑。彈性確實高,不過官方測試未證明佢識廣東話同香港語境,速度、誤判同對抗規避能力亦要逐樣驗清楚。

17 天前
Groq 再融 6.5 億美元:Nvidia 以外,AI 推理算力仲有咩揀?Tech News

Groq 再融 6.5 億美元:Nvidia 以外,AI 推理算力仲有咩揀?

Groq 確認完成 6.5 億美元融資,官方話會擴大 AI inference cloud。除咗錢,值得睇嘅係 Nvidia 同 Groq 簽咗非獨家 inference 技術授權協議,亦吸納咗核心人手,Groq 仲想靠雲端服務守住開發者入口。

20 天前
黃仁勳華府力撐開放權重:模型有得下載,唔代表真開源或零成本Tech News

黃仁勳華府力撐開放權重:模型有得下載,唔代表真開源或零成本

黃仁勳去華府力撐開放權重模型,背後牽涉中國 AI、企業自建系統同 NVIDIA 嘅 GPU 生意。開放權重可以減少供應商綁定,但同真正開源仍有距離,免費下載亦唔等於部署成本係零。

24 天前
Hugging Face 圖片編輯 Spaces 可變除衫工具:平台安全缺口點解咁大Tech News

Hugging Face 圖片編輯 Spaces 可變除衫工具:平台安全缺口點解咁大

AI Forensics 發現,Hugging Face 多個排名靠前嘅圖片編輯 Spaces,收到簡單指令就會生成非自願私密影像。研究樣本唔足以代表成個平台,不過已揭出一個關鍵缺口:當開源模型變成即開即用嘅網上 app,內容安全仲可唔可以全數推返畀開發者?

25 天前
OpenAI agent 攻穿 sandbox:企業 AI 安全唔可以淨靠 guardrails3C 產品

OpenAI agent 攻穿 sandbox:企業 AI 安全唔可以淨靠 guardrails

OpenAI 喺受控 cyber 評測中關掉部分拒絕機制,agent 其後攻穿 sandbox,再入侵 Hugging Face。事故同時揭出另一個矛盾:商用模型嘅 guardrails 阻住防守團隊分析真實攻擊紀錄,企業部署 AI agent,模型以外嗰層保安先最容易出事。

26 天前
本地 coding 模型細就實用?GPT-OSS 20B 贏咗一星期測試,但結論有條件3C 產品

本地 coding 模型細就實用?GPT-OSS 20B 贏咗一星期測試,但結論有條件

XDA 作者用一張 16GB RTX 4070 Ti Super,連續一星期比較三款本地 coding 模型,結果由下載檔最細嘅 GPT-OSS 20B 勝出。不過量化方法、模型定位同測試工作都有差異,呢次結果更適合用嚟揀個人助手,未足以證明細模型全面贏大模型。

28 天前
本機 Qwen 卡住先叫 Claude Fable 5:慳 API 錢但私隱代價唔細3C 產品

本機 Qwen 卡住先叫 Claude Fable 5:慳 API 錢但私隱代價唔細

XDA 作者畀本機 Qwen 2.5 Coder 自己判斷幾時向 Claude Fable 5 求救,普通改碼留喺電腦,複雜問題先付 API 錢。不過真正難處係點定義「卡住」、截住失控呼叫,同埋避免私人程式碼跟錯誤資料一齊送上雲端。

1 個月前
本地 LLM 寫 code 未必輸:細任務靠測試把關,私隱同成本要另計3C 產品

本地 LLM 寫 code 未必輸:細任務靠測試把關,私隱同成本要另計

XDA 作者試用本地 LLM 一星期,發現研究摘要比寫細段 code 更難放心。原因唔係本地模型突然追平頂級雲端 agent,而係程式碼有 compiler、測試同 lint 幫手捉錯。對要處理客戶 code 嘅開發者,本機推理值得用,但私隱、硬件成本同工具能力要分開計。

1 個月前
Venice AI 融資成獨角獸:私隱 AI 助手值唔值得轉用?Tech News

Venice AI 融資成獨角獸:私隱 AI 助手值唔值得轉用?

Venice AI 拎到 6500 萬美元 Series A,估值去到 10 億美元。今次焦點放喺佢用「唔儲存 prompt」做賣點,對處理工作文件、code 同創作素材嘅用家有幾大吸引力,又有幾多盲點。

1 個月前
Together AI 八億美元融資:開源模型雲端點解突然咁值錢Tech News

Together AI 八億美元融資:開源模型雲端點解突然咁值錢

Together AI 由 $3.3B 估值跳到 $8.3B,唔只係 VC 追 AI 熱錢。值得睇嘅係開源模型真係上 production 之後,成本、延遲、資料控制同供應商鎖定會點樣變。

1 個月前
ZML/LLMD 免費出招:自架 AI 模型想平啲,先要甩開 GPU 鎖定Tech News

ZML/LLMD 免費出招:自架 AI 模型想平啲,先要甩開 GPU 鎖定

法國 AI startup ZML 推出免費 LLMD,想用同一個 inference server 跑 NVIDIA、AMD、TPU、Intel 同 Apple Metal。對用開自架 LLM 嘅 team,吸引位係減少 CUDA 綁定;但性能同收費都未清楚,暫時只啱測試。

2 個月前
開源 AI 食走大量 token,Claude 點解仲守得住企業最貴嗰段Tech News

開源 AI 食走大量 token,Claude 點解仲守得住企業最貴嗰段

TechCrunch 引述 Vercel 同 OpenRouter 數據,見到 DeepSeek 呢類平模型攞走大量 token,但 Anthropic 仲攞住最貴嗰段花費。企業揀 AI,重點係邊啲任務值得用貴模型,邊啲可以轉去開源或自架。

2 個月前
Mistral AI 爆紅背後:企業部署、開放模型同 AI 主權點連埋Tech News

Mistral AI 爆紅背後:企業部署、開放模型同 AI 主權點連埋

Mistral AI 因歐洲 AI 主權話題再受注目。不過用 ChatGPT 尺度睇佢會睇漏重點:佢一邊做 Vibe 消費產品,一邊押企業部署、API、open-weight 模型同 AI cloud,打法同美國幾間大廠好唔同。

2 個月前