#coding agent
44 篇文章
TechLab 所有關於「coding agent」嘅文章、評測同教學,由最新排起。
3C 產品Claude Pro 月費包幾多?重度用 Claude Code 點解咁易撞限額
Claude Pro 應付一般聊天未必有問題,但一去到大型 codebase、長時間除錯同多 agent 工作,五小時 session 加每周上限就好容易打斷進度。拆開官方規則睇,月費計劃點揀其實取決於工作量有幾集中,同你接唔接受撞限後再按量付費。
Tech NewsOpenAI agent 越界闖入 Hugging Face:模型對齊同權限隔離缺一不可
OpenAI 測試中嘅 AI agent 為咗完成評估,突破隔離環境再闖入 Hugging Face。事故調查仲未完成,但教訓已經好實際:改善模型行為之餘,shell、上網、憑證同第三方服務權限亦要逐層鎖緊。
Tech NewsAI coding agent 未有殺死工程師職位,但初級位真係變窄
SignalFire 2026 人才報告見到,大型科技公司整體招聘較 2019 少 25%,工程位只少 11%,新人入面工程師佔比仲升到 55%。AI 冇即刻令工程師職位消失,但 junior pipeline 同技能要求明顯變緊。
Tech NewsAI agent 七日攻入七成虛擬機:coding agent 權限點守先穩陣
多倫多大學團隊整咗一條由 AI agent 驅動嘅實驗性蠕蟲,喺隔離企業網絡內自主搵漏洞、提權同複製。結果值得警惕,但未等於真實公司已俾 AI 大規模攻陷。對開發團隊嚟講,眼前最實際嘅功課係管好 coding agent 嘅權限、憑證、sandbox、日誌同人工審批。
Tech NewsHugging Face 追問 OpenAI 事故紀錄:企業部署 coding agent 要即刻改咩
OpenAI 嘅網絡安全評估意外波及 Hugging Face,問題由測試環境一路伸延到出網權限、憑證同生產系統。Hugging Face 要求公開 agent 行動紀錄;至於用緊 coding agent 嘅公司,最實際嘅回應係重新收緊每一層權限。
Tech NewsClaude 開始搶到畀錢用 AI 嗰批人,ChatGPT 仲係大幅領先
TechCrunch 引述 Indagari 美國信用卡交易分析,Claude 今年付費用戶同收入一路升,DataCamp 同 Sensor Tower 數據都見到熱度。不過 ChatGPT 仲係大幅領先,對香港 freelance、startup 同 developer 嚟講,問題係月費點拆、邊個工具放喺邊個任務。
Tech NewsAnthropic 指 Alibaba 大規模蒸餾 Claude,爭嘅係 coding agent 能力
Anthropic 喺 6 月 10 日信件指,Alibaba/Qwen 相關人員用近 25,000 個假帳戶同 Claude 做 2,880 萬次互動,目標係 agentic reasoning 同寫 code。件事未有公開審理,但已經反映 AI coding agent 點解成為模型公司重點保護嘅能力。
Tech NewsClaude Opus 5 半價講法要睇清:coding agent 慳幾多要計 effort
Claude Opus 5 用 Fable 5 一半 token 單價,官方 coding benchmark 亦交到接近甚至高過 Fable 嘅成績。不過呢次冇減 Opus 價,effort、Fast mode、agent 重試次數同安全 fallback,先會決定每項工作最後慳到幾多。
3C 產品Claude Opus 5 半價追貼 Fable 5:coding agent 點揀先抵
Anthropic 推出 Claude Opus 5,官方 benchmark 話部分 coding、電腦操作同企業工作表現追貼甚至壓過 Fable 5,token 單價就平一半。不過 agent 最後張單仲受 effort、思考 token、工具調用同輸出長度影響,換模型前要計完整工作成本。
Tech NewsClaude Opus 5 半價追到 Fable:coding agent 應該點揀模型
Anthropic 推出 Claude Opus 5,API 價錢維持 Opus 4.8 水平,能力就逼近貴一倍嘅 Fable 5。對 coding agent 用戶嚟講,模型識唔識自己驗證、會唔會突然觸發安全限制,同公司可唔可以保留零資料留存設定,實際上都重要過單一跑分。
Tech NewsClaude Opus 5 搶做 coding agent 主力:接近 Fable,限制少好多
Anthropic 推出 Claude Opus 5,主打複雜 coding、長時間 agent 任務同知識工作。官方話部分測試已貼近 Fable 5,標準 API 價錢只係一半,安全分類器亦冇咁易誤傷正常開發工作。不過官方跑分仲要等獨立測試驗證,香港帳戶亦未列入正式支援地區。
Tech NewsGPT-5.6 由 limited preview 起步:coding agent 升級,最現實係 access 同 token 數
OpenAI 6 月 26 日先以 limited preview 形式開放 GPT-5.6,Sol 主打 coding、cybersecurity 同長時間 agent 任務。價錢睇落平過 Claude Fable 5,但香港 access 同 agent token 成本,係部署前要先計清楚嘅位。
Tech News美國陸軍 Ask Sage 個幾月燒乾 token:企業「無限 AI」點解咁易爆煲
美國陸軍一度向內部提供「無限」Ask Sage token,個幾月後共用池就告急。事件未足以證明全軍燒光全年 AI 預算,反而揭出企業採用 ChatGPT、Gemini 同 coding agent 時最易忽略嘅問題:每人有得用,同成盤數頂唔頂得住,係兩回事。
Tech NewsKimi K3 俾人指靠蒸餾 Claude 變強,專家話證據講唔通
美國官員指控 Moonshot 用 Claude Fable 5 蒸餾 Kimi K3,但冇公開證據。研究員認為,蒸餾最多幫到後訓練,解釋唔晒 K3 嘅架構、規模同 agent 能力。開發者真正要計嘅,仲有速度、實際 token 用量同部署成本。
Tech NewsOpenAI 模型闖入 Hugging Face:「高度隔離」sandbox 點解照樣失守
OpenAI 內部資安測試意外波及 Hugging Face production 系統。模型的確展現咗串連漏洞同長時間自主行動嘅能力,但成條事故鏈亦由人手設定嘅網上出口、第三方 proxy、過闊權限同外露憑證打開。
3C 產品Claude Code 對 Google Antigravity:一星期後點揀先啱用
XDA 作者連續一星期改用 Google Antigravity,發現佢砌完整 app 夠快,任務進度亦睇得清楚;Claude Code 就喺細改、debug 同介面執細節較穩。不過揀工具仲要計 quota、瀏覽器權限同 agent 可以掂到幾多檔案。
Tech NewsOpenAI 內部模型花一個鐘繞過沙箱,coding agent 安全要睇成條行動鏈
OpenAI 一款長時程內部模型為咗完成 NanoGPT 任務,花約一個鐘搵到沙箱漏洞,再把成果交上公開 GitHub。事件反映 coding agent 跑得愈耐,細小權限同設定漏洞愈容易串成越界行動。
Tech News平價中國 AI 真係幫 Nvidia?Kimi K3 點解愈平愈食算力
黃仁勳話 Kimi、DeepSeek 呢類平價中國 AI 會擴大市場,最終推高算力需求。Kimi K3 上線後迅速逼爆服務容量,方向上似乎講得通;不過模型需求升,唔等於 Nvidia 一定食晒啲 GPU 訂單。
3C 產品Gemini 3.6 Flash 推出:輸出價平 17%,同時慳 17% token
Google 推出 Gemini 3.6 Flash,輸出 token 單價由每百萬 US$9 減至 US$7.5,指定測試用量亦少 17%。兩樣加埋,長時間運作嘅 coding agent 同電腦操作任務,有望慳更多成本,亦少兜幾轉。
Tech NewsGemini CLI 六分鐘搬走殭屍網絡 C&C,開發團隊要管住 agent 權限
一名使用俄語嘅威脅行動者用 Gemini CLI 管理已受控電腦,六分鐘內完成 C&C 遷移同除錯。呢個時間唔包括由零建立整個殭屍網絡,但足以提醒開發團隊:coding agent 一有 shell、憑證同網上存取權,風險已經去到實際操作層面。
Tech NewsAI 審 code 唔使盲追最貴模型:平價模型重跑三次都有得追
Aikido 用 13 款 AI 模型重查 26 個已知漏洞,發現同一模型跑三次再合併結果,可以搵返單次走漏嘅問題,平價模型亦有機會追貼高階版本。不過測試樣本細、直接指向漏洞位置,又冇公開誤報率,暫時未足以當成 coding agent 排行榜。
Tech NewsMeta 用 Gemini 遇限流:AI coding 工具點解要有後備方案
FT 話 Google 今年 3 月起限制 Meta 購買 Gemini 容量,影響客服、廣告 chatbot、coding 同安全自動化。呢件事唔似普通大廠八卦,反而提醒公司:AI 工具揀模型之外,仲要管 token、備援同成本。
Tech NewsGemini 3.5 Pro 再延期:coding 能力點解成為焦點
Gemini 3.5 Pro 錯過 Google 原先預告嘅六月檔期。消息指模型 coding 表現同穩定性未達內部目標,但 Google 只確認測試仍然繼續。對用 Gemini API、coding agent 同企業 AI 平台嘅團隊嚟講,延期最實際嘅影響係模型選擇同開發時間表又要重排。
Tech NewsKimi K3 前端 coding 登頂:平價百萬 token 模型值唔值得開發者轉用?
Moonshot AI 推出 Kimi K3,靠前端 coding、百萬 token context 同較低 API 價錢搶眼球。獨立評測顯示佢部分能力已經貼近頂級模型,不過速度、幻覺、agent 相容性同企業資料處理仍有數要計,現階段較適合小規模試跑。