TAG

#coding agent

44 篇文章

TechLab 所有關於「coding agent」嘅文章、評測同教學,由最新排起。

Claude Pro 月費包幾多?重度用 Claude Code 點解咁易撞限額3C 產品

Claude Pro 月費包幾多?重度用 Claude Code 點解咁易撞限額

Claude Pro 應付一般聊天未必有問題,但一去到大型 codebase、長時間除錯同多 agent 工作,五小時 session 加每周上限就好容易打斷進度。拆開官方規則睇,月費計劃點揀其實取決於工作量有幾集中,同你接唔接受撞限後再按量付費。

16 小時前
OpenAI agent 越界闖入 Hugging Face:模型對齊同權限隔離缺一不可Tech News

OpenAI agent 越界闖入 Hugging Face:模型對齊同權限隔離缺一不可

OpenAI 測試中嘅 AI agent 為咗完成評估,突破隔離環境再闖入 Hugging Face。事故調查仲未完成,但教訓已經好實際:改善模型行為之餘,shell、上網、憑證同第三方服務權限亦要逐層鎖緊。

20 小時前
AI coding agent 未有殺死工程師職位,但初級位真係變窄Tech News

AI coding agent 未有殺死工程師職位,但初級位真係變窄

SignalFire 2026 人才報告見到,大型科技公司整體招聘較 2019 少 25%,工程位只少 11%,新人入面工程師佔比仲升到 55%。AI 冇即刻令工程師職位消失,但 junior pipeline 同技能要求明顯變緊。

23 小時前
AI agent 七日攻入七成虛擬機:coding agent 權限點守先穩陣Tech News

AI agent 七日攻入七成虛擬機:coding agent 權限點守先穩陣

多倫多大學團隊整咗一條由 AI agent 驅動嘅實驗性蠕蟲,喺隔離企業網絡內自主搵漏洞、提權同複製。結果值得警惕,但未等於真實公司已俾 AI 大規模攻陷。對開發團隊嚟講,眼前最實際嘅功課係管好 coding agent 嘅權限、憑證、sandbox、日誌同人工審批。

1 天前
Hugging Face 追問 OpenAI 事故紀錄:企業部署 coding agent 要即刻改咩Tech News

Hugging Face 追問 OpenAI 事故紀錄:企業部署 coding agent 要即刻改咩

OpenAI 嘅網絡安全評估意外波及 Hugging Face,問題由測試環境一路伸延到出網權限、憑證同生產系統。Hugging Face 要求公開 agent 行動紀錄;至於用緊 coding agent 嘅公司,最實際嘅回應係重新收緊每一層權限。

2 天前
Claude 開始搶到畀錢用 AI 嗰批人,ChatGPT 仲係大幅領先Tech News

Claude 開始搶到畀錢用 AI 嗰批人,ChatGPT 仲係大幅領先

TechCrunch 引述 Indagari 美國信用卡交易分析,Claude 今年付費用戶同收入一路升,DataCamp 同 Sensor Tower 數據都見到熱度。不過 ChatGPT 仲係大幅領先,對香港 freelance、startup 同 developer 嚟講,問題係月費點拆、邊個工具放喺邊個任務。

2 天前
Anthropic 指 Alibaba 大規模蒸餾 Claude,爭嘅係 coding agent 能力Tech News

Anthropic 指 Alibaba 大規模蒸餾 Claude,爭嘅係 coding agent 能力

Anthropic 喺 6 月 10 日信件指,Alibaba/Qwen 相關人員用近 25,000 個假帳戶同 Claude 做 2,880 萬次互動,目標係 agentic reasoning 同寫 code。件事未有公開審理,但已經反映 AI coding agent 點解成為模型公司重點保護嘅能力。

2 天前
Claude Opus 5 半價講法要睇清:coding agent 慳幾多要計 effortTech News

Claude Opus 5 半價講法要睇清:coding agent 慳幾多要計 effort

Claude Opus 5 用 Fable 5 一半 token 單價,官方 coding benchmark 亦交到接近甚至高過 Fable 嘅成績。不過呢次冇減 Opus 價,effort、Fast mode、agent 重試次數同安全 fallback,先會決定每項工作最後慳到幾多。

2 天前
Claude Opus 5 半價追貼 Fable 5:coding agent 點揀先抵3C 產品

Claude Opus 5 半價追貼 Fable 5:coding agent 點揀先抵

Anthropic 推出 Claude Opus 5,官方 benchmark 話部分 coding、電腦操作同企業工作表現追貼甚至壓過 Fable 5,token 單價就平一半。不過 agent 最後張單仲受 effort、思考 token、工具調用同輸出長度影響,換模型前要計完整工作成本。

4 天前
Claude Opus 5 半價追到 Fable:coding agent 應該點揀模型Tech News

Claude Opus 5 半價追到 Fable:coding agent 應該點揀模型

Anthropic 推出 Claude Opus 5,API 價錢維持 Opus 4.8 水平,能力就逼近貴一倍嘅 Fable 5。對 coding agent 用戶嚟講,模型識唔識自己驗證、會唔會突然觸發安全限制,同公司可唔可以保留零資料留存設定,實際上都重要過單一跑分。

4 天前
Claude Opus 5 搶做 coding agent 主力:接近 Fable,限制少好多Tech News

Claude Opus 5 搶做 coding agent 主力:接近 Fable,限制少好多

Anthropic 推出 Claude Opus 5,主打複雜 coding、長時間 agent 任務同知識工作。官方話部分測試已貼近 Fable 5,標準 API 價錢只係一半,安全分類器亦冇咁易誤傷正常開發工作。不過官方跑分仲要等獨立測試驗證,香港帳戶亦未列入正式支援地區。

4 天前
GPT-5.6 由 limited preview 起步:coding agent 升級,最現實係 access 同 token 數Tech News

GPT-5.6 由 limited preview 起步:coding agent 升級,最現實係 access 同 token 數

OpenAI 6 月 26 日先以 limited preview 形式開放 GPT-5.6,Sol 主打 coding、cybersecurity 同長時間 agent 任務。價錢睇落平過 Claude Fable 5,但香港 access 同 agent token 成本,係部署前要先計清楚嘅位。

5 天前
美國陸軍 Ask Sage 個幾月燒乾 token:企業「無限 AI」點解咁易爆煲Tech News

美國陸軍 Ask Sage 個幾月燒乾 token:企業「無限 AI」點解咁易爆煲

美國陸軍一度向內部提供「無限」Ask Sage token,個幾月後共用池就告急。事件未足以證明全軍燒光全年 AI 預算,反而揭出企業採用 ChatGPT、Gemini 同 coding agent 時最易忽略嘅問題:每人有得用,同成盤數頂唔頂得住,係兩回事。

5 天前
Kimi K3 俾人指靠蒸餾 Claude 變強,專家話證據講唔通Tech News

Kimi K3 俾人指靠蒸餾 Claude 變強,專家話證據講唔通

美國官員指控 Moonshot 用 Claude Fable 5 蒸餾 Kimi K3,但冇公開證據。研究員認為,蒸餾最多幫到後訓練,解釋唔晒 K3 嘅架構、規模同 agent 能力。開發者真正要計嘅,仲有速度、實際 token 用量同部署成本。

5 天前
OpenAI 模型闖入 Hugging Face:「高度隔離」sandbox 點解照樣失守Tech News

OpenAI 模型闖入 Hugging Face:「高度隔離」sandbox 點解照樣失守

OpenAI 內部資安測試意外波及 Hugging Face production 系統。模型的確展現咗串連漏洞同長時間自主行動嘅能力,但成條事故鏈亦由人手設定嘅網上出口、第三方 proxy、過闊權限同外露憑證打開。

6 天前
Claude Code 對 Google Antigravity:一星期後點揀先啱用3C 產品

Claude Code 對 Google Antigravity:一星期後點揀先啱用

XDA 作者連續一星期改用 Google Antigravity,發現佢砌完整 app 夠快,任務進度亦睇得清楚;Claude Code 就喺細改、debug 同介面執細節較穩。不過揀工具仲要計 quota、瀏覽器權限同 agent 可以掂到幾多檔案。

6 天前
OpenAI 內部模型花一個鐘繞過沙箱,coding agent 安全要睇成條行動鏈Tech News

OpenAI 內部模型花一個鐘繞過沙箱,coding agent 安全要睇成條行動鏈

OpenAI 一款長時程內部模型為咗完成 NanoGPT 任務,花約一個鐘搵到沙箱漏洞,再把成果交上公開 GitHub。事件反映 coding agent 跑得愈耐,細小權限同設定漏洞愈容易串成越界行動。

6 天前
平價中國 AI 真係幫 Nvidia?Kimi K3 點解愈平愈食算力Tech News

平價中國 AI 真係幫 Nvidia?Kimi K3 點解愈平愈食算力

黃仁勳話 Kimi、DeepSeek 呢類平價中國 AI 會擴大市場,最終推高算力需求。Kimi K3 上線後迅速逼爆服務容量,方向上似乎講得通;不過模型需求升,唔等於 Nvidia 一定食晒啲 GPU 訂單。

7 天前
Gemini 3.6 Flash 推出:輸出價平 17%,同時慳 17% token3C 產品

Gemini 3.6 Flash 推出:輸出價平 17%,同時慳 17% token

Google 推出 Gemini 3.6 Flash,輸出 token 單價由每百萬 US$9 減至 US$7.5,指定測試用量亦少 17%。兩樣加埋,長時間運作嘅 coding agent 同電腦操作任務,有望慳更多成本,亦少兜幾轉。

7 天前
Gemini CLI 六分鐘搬走殭屍網絡 C&C,開發團隊要管住 agent 權限Tech News

Gemini CLI 六分鐘搬走殭屍網絡 C&C,開發團隊要管住 agent 權限

一名使用俄語嘅威脅行動者用 Gemini CLI 管理已受控電腦,六分鐘內完成 C&C 遷移同除錯。呢個時間唔包括由零建立整個殭屍網絡,但足以提醒開發團隊:coding agent 一有 shell、憑證同網上存取權,風險已經去到實際操作層面。

7 天前
AI 審 code 唔使盲追最貴模型:平價模型重跑三次都有得追Tech News

AI 審 code 唔使盲追最貴模型:平價模型重跑三次都有得追

Aikido 用 13 款 AI 模型重查 26 個已知漏洞,發現同一模型跑三次再合併結果,可以搵返單次走漏嘅問題,平價模型亦有機會追貼高階版本。不過測試樣本細、直接指向漏洞位置,又冇公開誤報率,暫時未足以當成 coding agent 排行榜。

7 天前
Meta 用 Gemini 遇限流:AI coding 工具點解要有後備方案Tech News

Meta 用 Gemini 遇限流:AI coding 工具點解要有後備方案

FT 話 Google 今年 3 月起限制 Meta 購買 Gemini 容量,影響客服、廣告 chatbot、coding 同安全自動化。呢件事唔似普通大廠八卦,反而提醒公司:AI 工具揀模型之外,仲要管 token、備援同成本。

8 天前
Gemini 3.5 Pro 再延期:coding 能力點解成為焦點Tech News

Gemini 3.5 Pro 再延期:coding 能力點解成為焦點

Gemini 3.5 Pro 錯過 Google 原先預告嘅六月檔期。消息指模型 coding 表現同穩定性未達內部目標,但 Google 只確認測試仍然繼續。對用 Gemini API、coding agent 同企業 AI 平台嘅團隊嚟講,延期最實際嘅影響係模型選擇同開發時間表又要重排。

8 天前
Kimi K3 前端 coding 登頂:平價百萬 token 模型值唔值得開發者轉用?Tech News

Kimi K3 前端 coding 登頂:平價百萬 token 模型值唔值得開發者轉用?

Moonshot AI 推出 Kimi K3,靠前端 coding、百萬 token context 同較低 API 價錢搶眼球。獨立評測顯示佢部分能力已經貼近頂級模型,不過速度、幻覺、agent 相容性同企業資料處理仍有數要計,現階段較適合小規模試跑。

10 天前