TAG

#AI 模型

35 篇文章

TechLab 所有關於「AI 模型」嘅文章、評測同教學,由最新排起。

Google AI 人才再流走,Gemini 同 Claude 下一仗睇 codingTech News

Google AI 人才再流走,Gemini 同 Claude 下一仗睇 coding

TechCrunch 引述 Bloomberg 報道,Jonas Adler 同 Alexander Pritzel 會離開 Google 轉投 Anthropic。呢件事唔係淨係人事新聞,重點係 Claude Code、Gemini API 同企業 AI 工具之後點樣搶開發者。

21 小時前
Kimi K3「開放下載」要等等:2.8T 權重、授權同自架門檻逐樣拆Tech News

Kimi K3「開放下載」要等等:2.8T 權重、授權同自架門檻逐樣拆

Kimi K3 有 2.8T 總參數同 100 萬 token context,API、Kimi Code 亦已經用得。不過截至香港時間 7 月 27 日下午,官方權重頁同 license 仍未出現;一般開發者現階段最實際都係經雲端試用。

1 天前
Anthropic 指 Alibaba 大規模蒸餾 Claude,爭嘅係 coding agent 能力Tech News

Anthropic 指 Alibaba 大規模蒸餾 Claude,爭嘅係 coding agent 能力

Anthropic 喺 6 月 10 日信件指,Alibaba/Qwen 相關人員用近 25,000 個假帳戶同 Claude 做 2,880 萬次互動,目標係 agentic reasoning 同寫 code。件事未有公開審理,但已經反映 AI coding agent 點解成為模型公司重點保護嘅能力。

2 天前
Claude Opus 5 半價追貼 Fable 5:coding agent 點揀先抵3C 產品

Claude Opus 5 半價追貼 Fable 5:coding agent 點揀先抵

Anthropic 推出 Claude Opus 5,官方 benchmark 話部分 coding、電腦操作同企業工作表現追貼甚至壓過 Fable 5,token 單價就平一半。不過 agent 最後張單仲受 effort、思考 token、工具調用同輸出長度影響,換模型前要計完整工作成本。

4 天前
Nvidia 聯署撐 open weights:美國若收緊中國模型,開發者要準備咩3C 產品

Nvidia 聯署撐 open weights:美國若收緊中國模型,開發者要準備咩

Nvidia、Microsoft、Meta 等 25 間公司聯署,叫美國政府唔好太早限制 open-weight AI。封信冇提中國,但發表前幾日,華府先傳出重新研究限制中國模型。用緊 DeepSeek、Kimi、Qwen 或衍生模型嘅團隊,依家值得先整理供應鏈同後備方案。

4 天前
Claude Opus 5 用半價 API 逼近 Fable 5,Claude Code 日常點揀3C 產品

Claude Opus 5 用半價 API 逼近 Fable 5,Claude Code 日常點揀

Anthropic 推出 Claude Opus 5,API token 價同 Opus 4.8 一樣,只有 Fable 5 一半。官方數據話新模型喺 coding、電腦操作同知識工作追貼甚至贏過 Fable,不過首批獨立測試顯示,code review 準確度、漏錯同耗用 token 之間仍有取捨。

4 天前
Kimi K3 俾人指靠蒸餾 Claude 變強,專家話證據講唔通Tech News

Kimi K3 俾人指靠蒸餾 Claude 變強,專家話證據講唔通

美國官員指控 Moonshot 用 Claude Fable 5 蒸餾 Kimi K3,但冇公開證據。研究員認為,蒸餾最多幫到後訓練,解釋唔晒 K3 嘅架構、規模同 agent 能力。開發者真正要計嘅,仲有速度、實際 token 用量同部署成本。

5 天前
Claude Mythos 5 只限指定美國機構重開:AI API 而家要計政策風險Tech News

Claude Mythos 5 只限指定美國機構重開:AI API 而家要計政策風險

Anthropic 嘅 Mythos 5 俾美國政府有限度放行,只限指定美國 critical infrastructure 同 cyber defenders。用 Claude API 或雲端 Claude 嘅團隊,要當模型 access 都係供應風險。

6 天前
Gemini 新 Flash 點揀?3.6 做複雜 agent,3.5 Lite 跑大量工作Tech News

Gemini 新 Flash 點揀?3.6 做複雜 agent,3.5 Lite 跑大量工作

Google 推出 Gemini 3.6 Flash 同 3.5 Flash-Lite,兩款都已經可以放入正式環境。前者集中處理 coding、多步 agent 同多模態工作,後者就以低價、高吞吐量搶大量文件整理同分類任務。揀之前除咗睇每百萬 token 收費,仲要計埋每單工作實際行幾多輪。

6 天前
美國擬查中國 AI 模型蒸餾:技術學習點解會變成竊取指控同制裁風險Tech News

美國擬查中國 AI 模型蒸餾:技術學習點解會變成竊取指控同制裁風險

美國財長貝森特話會調查中國 AI 模型有冇抽取美國模型能力,查到涉及竊取就可能制裁。不過蒸餾本身係正常訓練方法,美方亦未公開所謂「水印」證據。對開發者嚟講,實際風險落喺 API、付款、雲端供應同模型分發會唔會受限制。

6 天前
平價中國 AI 真係幫 Nvidia?Kimi K3 點解愈平愈食算力Tech News

平價中國 AI 真係幫 Nvidia?Kimi K3 點解愈平愈食算力

黃仁勳話 Kimi、DeepSeek 呢類平價中國 AI 會擴大市場,最終推高算力需求。Kimi K3 上線後迅速逼爆服務容量,方向上似乎講得通;不過模型需求升,唔等於 Nvidia 一定食晒啲 GPU 訂單。

6 天前
Gemini 3.6 Flash 快咗又平咗,開發者應點揀 3.5 Flash-Lite?3C 產品

Gemini 3.6 Flash 快咗又平咗,開發者應點揀 3.5 Flash-Lite?

Google 一口氣推出 Gemini 3.6 Flash、3.5 Flash-Lite 同 Flash Cyber。對開發者最實際嘅變化,係 agent 工作快咗、輸出 token 平咗;不過兩款通用模型嘅用途同遷移要求差幾遠,Cyber 亦未有公開 API。

6 天前
中國傳研收緊 AI 出口:開放權重、自建模型同先進晶片供應會點變3C 產品

中國傳研收緊 AI 出口:開放權重、自建模型同先進晶片供應會點變

中國據報研究限制 AI 模型權重、訓練數據同晶片設計流向海外。方案一旦實行,DeepSeek、Moonshot 呢類模型未必再任人下載自建,海外用家可能要改用雲端 API;晶片公司若少咗 TSMC 呢個選項,算力供應亦會再受壓。不過官方未公布條文,香港點計暫時都未有答案。

7 天前
Gemini 3.6 Flash 推出:輸出價平 17%,同時慳 17% token3C 產品

Gemini 3.6 Flash 推出:輸出價平 17%,同時慳 17% token

Google 推出 Gemini 3.6 Flash,輸出 token 單價由每百萬 US$9 減至 US$7.5,指定測試用量亦少 17%。兩樣加埋,長時間運作嘅 coding agent 同電腦操作任務,有望慳更多成本,亦少兜幾轉。

7 天前
中國據報研究收緊 AI 模型出口,香港自建同微調部署有咩風險Tech News

中國據報研究收緊 AI 模型出口,香港自建同微調部署有咩風險

中國據報正研究限制先進 AI 模型權重、訓練數據同半導體技術輸出,但暫時冇正式條文,香港會點計亦未確認。用緊 Qwen、GLM 嘅團隊未使即刻轉模型,不過要開始盤點權重來源、更新依賴同 API 後備方案。

7 天前
Kimi K3 未放權重先搶 coding 頭位,2.8T 模型點樣壓閉源服務價錢Tech News

Kimi K3 未放權重先搶 coding 頭位,2.8T 模型點樣壓閉源服務價錢

Moonshot AI 公布 Kimi K3,官方話佢有 2.8 萬億參數、100 萬 token context,同時喺 coding 測試追到頂級閉源模型。不過權重仲未有得下載,API 價亦唔算平。K3 帶嚟嘅壓力,主要係企業多咗議價同自行部署嘅可能。

9 天前
Arena 由 AI 排行榜變生意,年化收入速度達 $100M:揀模型唔好淨睇名次Tech News

Arena 由 AI 排行榜變生意,年化收入速度達 $100M:揀模型唔好淨睇名次

Arena 原本係大家用嚟比較 GPT、Claude、Gemini、Grok 嘅公開擂台,而家靠企業 AI Evaluations,按當時收入速度推算嘅年化數字已達 $100M。榜單有用,但開發者同公司採購要睇埋方法、樣本同自己 workload,先唔會俾一個總分牽住走。

10 天前
Kimi K3 前端 coding 登頂,但完整權重未公開:平價 API 先行搶客Tech News

Kimi K3 前端 coding 登頂,但完整權重未公開:平價 API 先行搶客

月之暗面推出 Kimi K3,靠前端 coding 盲測第一名同平價 API 搶焦點。不過官方都承認整體體驗仍落後頂級封閉模型,完整權重亦要等到 7 月 27 日。對開發者嚟講,現階段最實際係用真實 agent workflow 比成本、成功率同穩定性。

10 天前
DeepSeek 估值逾 3,500 億點計出嚟?一份投資公告揭開個底Tech News

DeepSeek 估值逾 3,500 億點計出嚟?一份投資公告揭開個底

開潤股份披露旗下基金間接持有 DeepSeek 0.8265% 股權,市場用 29 億元投資額倒推,得出約 3,508.77 億元人民幣估值。條數計得通,不過 DeepSeek 冇正式確認,集資總額、投資者名單同資金用途亦要分開睇。

11 天前
Gemini 3.5 Pro 傳延後:Google 卡喺 coding,開發者要點部署?Tech News

Gemini 3.5 Pro 傳延後:Google 卡喺 coding,開發者要點部署?

Gemini 3.5 Pro 傳出因 coding 表現未達 Google 內部目標,要延後數月推出。消息仍靠匿名知情人士,Google 未有確認新時間表;不過對用緊 Gemini API、AI Studio、Vertex AI 同 coding agent 嘅團隊,現階段已經要重新評估模型部署。

11 天前
Gemini 3.5 Pro 錯過六月死線,Google 卡喺最睇重嘅 coding 能力3C 產品

Gemini 3.5 Pro 錯過六月死線,Google 卡喺最睇重嘅 coding 能力

Google I/O 預告 Gemini 3.5 Pro 六月推出,但限期過咗仍然冇影。Bloomberg 指模型嘅 coding 表現未達內部目標,六月尾調整訓練資料亦未見理想結果;Google只確認模型仍在測試,未有交代新日期。

12 天前
Inkling 開放權重兼食盡三種輸入,975B 模型實際有幾開放?Tech News

Inkling 開放權重兼食盡三種輸入,975B 模型實際有幾開放?

Thinking Machines 推出首款開放權重模型 Inkling,支援文字、圖片同聲音輸入,總參數達 975B。不過模型權重有得下載,唔代表一般電腦跑得郁;佢對開發者最大嘅吸引力,其實係微調、API 部署同 agentic coding。

12 天前
Claude Fable 5 回歸:AI 工具都會受出口管制影響Tech News

Claude Fable 5 回歸:AI 工具都會受出口管制影響

Anthropic 話美國商務部撤回 Fable 5、Mythos 5 出口限制,Fable 5 7 月 1 日喺 Claude 平台重開。不過香港唔喺官方支援地區列表,真正重點係企業用 frontier model 時,政策同地區風險會直接影響存取。

16 天前
Claude Fable/Mythos 準備開返:香港開發者唔好只睇「解封」兩隻字Tech News

Claude Fable/Mythos 準備開返:香港開發者唔好只睇「解封」兩隻字

美國撤回 Anthropic Fable 5 / Mythos 5 出口限制,Anthropic 話 2026 年 7 月 1 日開始恢復 access。對香港團隊,重點係 Claude API、Bedrock、Google Cloud 同 Microsoft Foundry 幾時真係見返 model,仲有 30 日資料保留同資安審查點樣影響內部使用。

18 天前