TAG

#AI 模型

44 篇文章

TechLab 所有關於「AI 模型」嘅文章、評測同教學,由最新排起。

Anthropic 傳挑戰史上最大 IPO,Claude 用戶要睇巨額新錢會燒去邊Tech News

Anthropic 傳挑戰史上最大 IPO,Claude 用戶要睇巨額新錢會燒去邊

Anthropic 傳出想用破紀錄規模上市,數字夠搶眼,不過官方仍未公布股數、定價或者集資額。對 Claude、Claude Code 同 API 用戶嚟講,重點係新錢能否換到充足算力、穩定服務同更快產品更新,仲有上市後嘅盈利壓力會點影響收費。

22 天前
Grok 4.6 瞄準長時間 coding agent:平過 GPT、Claude,但跑分未贏晒Tech News

Grok 4.6 瞄準長時間 coding agent:平過 GPT、Claude,但跑分未贏晒

Grok 4.6 推出後,最值得開發者睇嘅係長時間 agent 工作能力同進取 API 定價。佢部分 coding 跑分追到 GPT-5.6 Sol 同 Claude Fable 5 附近,不過未有全面優勢,500K context 遇上大型 codebase 亦有取捨。

30 天前
DeepSeek 每項任務 3 美仙有幾平?API 平價背後仲有四筆數要計Tech News

DeepSeek 每項任務 3 美仙有幾平?API 平價背後仲有四筆數要計

DeepSeek V4 Flash 喺 Artificial Analysis 測試入面,以約 3 美仙完成一項加權任務,智能分數又追到部分美國模型。不過呢個數字有指定測試範圍,真正用落 coding、文件處理同自動化,仲要計失敗重試、驗證、資料處理位置同 API 穩定度。

1 個月前
AI 模型蒸餾點令 coding model 塞得入 laptop?同量化差喺邊3C 產品

AI 模型蒸餾點令 coding model 塞得入 laptop?同量化差喺邊

模型蒸餾會用大型 teacher 嘅輸出訓練細型 student,量化就壓低權重精度,兩招其實可以疊住用。對本機 coding model 嚟講,呢套組合直接影響速度、答案質素、RAM 需求,同埋公司程式碼使唔使離開部機。

1 個月前
ChatGPT 免費文字聊天放寬無限:GPT-5.6 Luna 同工具照有限額Tech News

ChatGPT 免費文字聊天放寬無限:GPT-5.6 Luna 同工具照有限額

OpenAI 會將 ChatGPT 免費版同 Go 嘅預設模型換成 GPT-5.6 Luna,下周再放寬一般文字聊天次數。個「無限」有清楚邊界:檔案、圖片同其他工具照舊有限額,Think 按鈕亦只係畀 Luna 多啲時間處理難題。

1 個月前
ChatGPT 免費版下周無限純文字對話:Luna、Think 同工具限額逐樣拆Tech News

ChatGPT 免費版下周無限純文字對話:Luna、Think 同工具限額逐樣拆

OpenAI 會向 Free 同 Go 用家開放無限純文字對話,預設模型轉做 GPT‑5.6 Luna,亦會加入 Think 按鈕。不過檔案、圖片、語音同其他工具仍然有限額,Think 可用幾多次亦未完全講清楚;香港推出時間同樣未有官方確認。

1 個月前
NVIDIA Alpamayo 開放商用,車廠終於可以用自家行車資料微調Tech News

NVIDIA Alpamayo 開放商用,車廠終於可以用自家行車資料微調

Alpamayo 2 Super 權重改用 OpenMDW-1.1,開發商可以用自家行車資料微調,再將衍生模型放入商業產品。呢次改動移除咗研究模型用喺商業產品時嘅主要授權限制,不過模型仍然只係研發工具,車規驗證、數據權利同真車安全一樣要由採用者自己處理。

1 個月前
美國想封中國開放權重 AI,DeepSeek、Qwen 會消失?先要睇清四條路Tech News

美國想封中國開放權重 AI,DeepSeek、Qwen 會消失?先要睇清四條路

華府傳出研究限制中國開放權重 AI,但模型唔會因一道命令就喺網上消失。真正影響要睇限制落喺官方 API、美國第三方平台、模型下載,定係企業使用層面;香港開發者亦可能因平台選擇收窄而間接受影響。

1 個月前
祖克柏反對封殺中國 AI 模型:開發團隊要為服務中斷留後路Tech News

祖克柏反對封殺中國 AI 模型:開發團隊要為服務中斷留後路

美國政界研究限制中國 AI 模型,祖克柏同黃仁勳先後反對;Meta、Nvidia 等公司亦聯署促請政府避免過早限制開放權重。禁令暫時未落實,但經 OpenRouter、雲端 API 或開放權重模型做產品嘅團隊,已經要計供應商下架、成本轉變同資料合規風險。

1 個月前
Google AI 人才再流走,Gemini 同 Claude 下一仗睇 codingTech News

Google AI 人才再流走,Gemini 同 Claude 下一仗睇 coding

TechCrunch 引述 Bloomberg 報道,Jonas Adler 同 Alexander Pritzel 會離開 Google 轉投 Anthropic。呢件事唔係淨係人事新聞,重點係 Claude Code、Gemini API 同企業 AI 工具之後點樣搶開發者。

2 個月前
Kimi K3「開放下載」要等等:2.8T 權重、授權同自架門檻逐樣拆Tech News

Kimi K3「開放下載」要等等:2.8T 權重、授權同自架門檻逐樣拆

Kimi K3 有 2.8T 總參數同 100 萬 token context,API、Kimi Code 亦已經用得。不過截至香港時間 7 月 27 日下午,官方權重頁同 license 仍未出現;一般開發者現階段最實際都係經雲端試用。

2 個月前
Anthropic 指 Alibaba 大規模蒸餾 Claude,爭嘅係 coding agent 能力Tech News

Anthropic 指 Alibaba 大規模蒸餾 Claude,爭嘅係 coding agent 能力

Anthropic 喺 6 月 10 日信件指,Alibaba/Qwen 相關人員用近 25,000 個假帳戶同 Claude 做 2,880 萬次互動,目標係 agentic reasoning 同寫 code。件事未有公開審理,但已經反映 AI coding agent 點解成為模型公司重點保護嘅能力。

2 個月前
Claude Opus 5 半價追貼 Fable 5:coding agent 點揀先抵3C 產品

Claude Opus 5 半價追貼 Fable 5:coding agent 點揀先抵

Anthropic 推出 Claude Opus 5,官方 benchmark 話部分 coding、電腦操作同企業工作表現追貼甚至壓過 Fable 5,token 單價就平一半。不過 agent 最後張單仲受 effort、思考 token、工具調用同輸出長度影響,換模型前要計完整工作成本。

2 個月前
Nvidia 聯署撐 open weights:美國若收緊中國模型,開發者要準備咩3C 產品

Nvidia 聯署撐 open weights:美國若收緊中國模型,開發者要準備咩

Nvidia、Microsoft、Meta 等 25 間公司聯署,叫美國政府唔好太早限制 open-weight AI。封信冇提中國,但發表前幾日,華府先傳出重新研究限制中國模型。用緊 DeepSeek、Kimi、Qwen 或衍生模型嘅團隊,依家值得先整理供應鏈同後備方案。

2 個月前
Claude Opus 5 用半價 API 逼近 Fable 5,Claude Code 日常點揀3C 產品

Claude Opus 5 用半價 API 逼近 Fable 5,Claude Code 日常點揀

Anthropic 推出 Claude Opus 5,API token 價同 Opus 4.8 一樣,只有 Fable 5 一半。官方數據話新模型喺 coding、電腦操作同知識工作追貼甚至贏過 Fable,不過首批獨立測試顯示,code review 準確度、漏錯同耗用 token 之間仍有取捨。

2 個月前
Kimi K3 俾人指靠蒸餾 Claude 變強,專家話證據講唔通Tech News

Kimi K3 俾人指靠蒸餾 Claude 變強,專家話證據講唔通

美國官員指控 Moonshot 用 Claude Fable 5 蒸餾 Kimi K3,但冇公開證據。研究員認為,蒸餾最多幫到後訓練,解釋唔晒 K3 嘅架構、規模同 agent 能力。開發者真正要計嘅,仲有速度、實際 token 用量同部署成本。

2 個月前
Claude Mythos 5 只限指定美國機構重開:AI API 而家要計政策風險Tech News

Claude Mythos 5 只限指定美國機構重開:AI API 而家要計政策風險

Anthropic 嘅 Mythos 5 俾美國政府有限度放行,只限指定美國 critical infrastructure 同 cyber defenders。用 Claude API 或雲端 Claude 嘅團隊,要當模型 access 都係供應風險。

2 個月前
Gemini 新 Flash 點揀?3.6 做複雜 agent,3.5 Lite 跑大量工作Tech News

Gemini 新 Flash 點揀?3.6 做複雜 agent,3.5 Lite 跑大量工作

Google 推出 Gemini 3.6 Flash 同 3.5 Flash-Lite,兩款都已經可以放入正式環境。前者集中處理 coding、多步 agent 同多模態工作,後者就以低價、高吞吐量搶大量文件整理同分類任務。揀之前除咗睇每百萬 token 收費,仲要計埋每單工作實際行幾多輪。

2 個月前
美國擬查中國 AI 模型蒸餾:技術學習點解會變成竊取指控同制裁風險Tech News

美國擬查中國 AI 模型蒸餾:技術學習點解會變成竊取指控同制裁風險

美國財長貝森特話會調查中國 AI 模型有冇抽取美國模型能力,查到涉及竊取就可能制裁。不過蒸餾本身係正常訓練方法,美方亦未公開所謂「水印」證據。對開發者嚟講,實際風險落喺 API、付款、雲端供應同模型分發會唔會受限制。

2 個月前
平價中國 AI 真係幫 Nvidia?Kimi K3 點解愈平愈食算力Tech News

平價中國 AI 真係幫 Nvidia?Kimi K3 點解愈平愈食算力

黃仁勳話 Kimi、DeepSeek 呢類平價中國 AI 會擴大市場,最終推高算力需求。Kimi K3 上線後迅速逼爆服務容量,方向上似乎講得通;不過模型需求升,唔等於 Nvidia 一定食晒啲 GPU 訂單。

2 個月前
Gemini 3.6 Flash 快咗又平咗,開發者應點揀 3.5 Flash-Lite?3C 產品

Gemini 3.6 Flash 快咗又平咗,開發者應點揀 3.5 Flash-Lite?

Google 一口氣推出 Gemini 3.6 Flash、3.5 Flash-Lite 同 Flash Cyber。對開發者最實際嘅變化,係 agent 工作快咗、輸出 token 平咗;不過兩款通用模型嘅用途同遷移要求差幾遠,Cyber 亦未有公開 API。

2 個月前
中國傳研收緊 AI 出口:開放權重、自建模型同先進晶片供應會點變3C 產品

中國傳研收緊 AI 出口:開放權重、自建模型同先進晶片供應會點變

中國據報研究限制 AI 模型權重、訓練數據同晶片設計流向海外。方案一旦實行,DeepSeek、Moonshot 呢類模型未必再任人下載自建,海外用家可能要改用雲端 API;晶片公司若少咗 TSMC 呢個選項,算力供應亦會再受壓。不過官方未公布條文,香港點計暫時都未有答案。

2 個月前
Gemini 3.6 Flash 推出:輸出價平 17%,同時慳 17% token3C 產品

Gemini 3.6 Flash 推出:輸出價平 17%,同時慳 17% token

Google 推出 Gemini 3.6 Flash,輸出 token 單價由每百萬 US$9 減至 US$7.5,指定測試用量亦少 17%。兩樣加埋,長時間運作嘅 coding agent 同電腦操作任務,有望慳更多成本,亦少兜幾轉。

2 個月前
中國據報研究收緊 AI 模型出口,香港自建同微調部署有咩風險Tech News

中國據報研究收緊 AI 模型出口,香港自建同微調部署有咩風險

中國據報正研究限制先進 AI 模型權重、訓練數據同半導體技術輸出,但暫時冇正式條文,香港會點計亦未確認。用緊 Qwen、GLM 嘅團隊未使即刻轉模型,不過要開始盤點權重來源、更新依賴同 API 後備方案。

2 個月前