
OpenAI 首粒 Jalapeño 晶片曝光:ChatGPT 成本戰入到硬件層
年底開始放入 data center,完整規格同實際慳幾多仍然未出
先講清楚:Jalapeño 做咩
OpenAI 同 Broadcom 喺 2026 年 6 月 24 日公開 Jalapeño,OpenAI 叫佢做第一粒 Intelligence Processor。聽落似改名玩 marketing,但核心其實好直接:呢粒 ASIC 係為 LLM inference 做,處理 ChatGPT 回答、Codex 跑任務、API 回應呢類已訓練模型嘅日常工作。OpenAI 官方話工程樣本已經喺 lab 跑 ML workload,仲提到 GPT-5.3-Codex-Spark;不過完整技術報告要遲啲先有,暫時冇核心數、memory 配置、製程、實際吞吐量呢啲硬數字。

圖片:OpenAI
點解先做 inference
訓練模型係一次好重手嘅投資,但 inference 係每日每秒都要埋嘅單。ChatGPT、API、AI coding tool、agent 任務愈多人用,OpenAI 就愈要喺 latency、穩定性同電費之間計數。GPU 通用性強,但用嚟長期跑同一批模型 workload,總有好多位可以按 OpenAI 自己嘅 kernel、memory movement、networking 同排程去調校。Jalapeño 嘅價值就喺呢度:規格表好睇只係其次,真正要交功課係每次回答嘅成本同延遲有冇壓低。
Broadcom 幫佢避開單一路線
OpenAI 嘅公布提到,OpenAI 做核心設計,Broadcom 負責 silicon implementation、Tomahawk networking 呢類大規模連接能力,Celestica 幫手做 board、rack 同 system integration;Reuters 仲話設計送咗去 TSMC 生產,server system 同晶片初期只供 OpenAI 自用。呢個組合其實好清楚:OpenAI 想自己揸住模型到硬件嘅節奏,但唔想由零開始砌一隊完整晶片團隊。
Jalapeño 短期取代唔到 Nvidia
最易講到誇張嘅位係 Nvidia。Broadcom CEO Hock Tan 對 Reuters 話,Jalapeño 表現同 Nvidia Blackwell、Google TPU 相若;OpenAI 官方就話 early testing 顯示每瓦表現好過 state-of-the-art。不過呢啲都係供應商同客戶自己講,未有第三方 benchmark。比較實際嘅睇法係:OpenAI 會先喺 inference 慳錢同攞供應彈性,訓練 frontier model 仍然好大機會繼續靠 Nvidia、AMD、雲端 partner 同其他加速器混住用。
對 ChatGPT 同 API 用家有咩影響
短期唔好期望 ChatGPT Plus 即刻減價。就算每瓦表現真係好過而家嘅 GPU 方案,OpenAI 都可能先將節省返嚟嘅算力用喺長啲嘅 context、快啲嘅 agent、多步 coding 任務同企業容量保證。對開發者講,最值得睇嘅位好實際:API latency、rate limit、尖峰時間穩定性同 token 價格會唔會慢慢變。Reuters 話呢套 server system 初期只供 OpenAI,所以外面公司暫時唔會直接採購 Jalapeño。
AI 服務競爭伸到硬件同電力
OpenAI 喺 2025 年 10 月同 Broadcom 講過 10GW 自訂加速器計劃,部署目標由 2026 下半年開始,去到 2029 年底完成。今次 Jalapeño 係呢份計劃第一個公開實物訊號。Google 有 TPU,Amazon 有 Trainium / Inferentia,Microsoft 有 Maia,Meta 都做緊自家加速器;OpenAI 入局之後,AI 平台競爭會由模型質素、app 功能,伸到晶片、networking、排程同電力。用家未必見到呢層,但你感受到嘅回應速度同收費,最終都會受呢層影響。
下一步睇咩
而家最要等三樣嘢:第一,OpenAI 嗰份技術報告有冇公開到可對照嘅 performance per watt、latency 同成本數字;第二,2026 年底初期部署嘅規模有幾大,頂唔頂到大量 ChatGPT / Codex 查詢;第三,效率收益會唔會反映到 API 價格同企業方案。Jalapeño 對普通用戶未必有即時驚喜,但對成個 AI 服務成本結構,呢粒晶片值得睇實。
參考來源
- Engadget — Jalapeño is the first AI chip from OpenAI and Broadcom — original report
- OpenAI and Broadcom unveil LLM-optimized inference chip — OpenAI 官方公布;用嚟核對定位、早期測試、伙伴分工同部署時間
- OpenAI and Broadcom Unveil LLM-Optimized Intelligence Processor — Broadcom 官方 press release;核對 Broadcom、Celestica、Tomahawk networking 同工程樣本資料
- OpenAI unveils custom chip it designed with Broadcom to boost its AI infrastructure (Reuters via WTAQ) — Reuters 轉載;補充 Hock Tan 對 Blackwell / TPU 嘅講法、TSMC 生產同只供 OpenAI 自用
- OpenAI fires up "Jalapeño," its first homegrown AI chip — 補充初期商用時間、2027 年 volume 同 Nvidia / Cerebras 背景
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







