OpenAI 首款自研推理晶片 Jalapeño 曝光:由 OpenAI 與 Broadcom 共同設計、台積電生產,鎖定 LLM 推論場景;基準測試顯示在每瓦吞吐量與端到端延遲上優於 NVIDIA Blackwell 系列(GB200/GB300),預計 2026 年底小規模部署、2027 年擴大。
NVIDIA 產品線與價格動態:
- 推出 Jetson Orin Nano 2(邊緣 AI 電腦),78 TOPS、8GB 記憶體,推論效能翻倍且功耗降 40%。
- 通知部分大客戶:AI 伺服器價格將上調逾 15%,主因記憶體晶片成本飆升,涵蓋 Vera Rubin 與 Grace Blackwell 等旗艦平台。
- 市場傳出 NVIDIA 以約 129 億美元收購 Hugging Face(開源模型生態),若成案將大幅鞏固其「算力+模型底座」話語權。
Apple M6 / M5 Ultra 發表:宣稱 AI 算力與效能大幅躍升;M5 Ultra 最高支援到 512GB 記憶體、16TB 儲存,高階 Mac Studio 定價上看 24,699 美元(512GB 記憶體版本)。
記憶體與被動元件漲價:AI 伺服器需求強勁帶動 LPDDR6 量產(長鑫科技宣布量產,小米 18 Fold 首發),同時 MLCC 自 8 月起漲價約 30%,高階 AI 伺服器交期拉長至 20 週以上,缺料可能延續到 2027–2028。
太空資料中心:Starcloud 完成 2.5 億美元 A 輪,估值 23 億美元;其 Starcloud-1 已在低軌道運行 NVIDIA H100,屬「軌上 AI 計算」的前沿案例。
LLM 新聞
AirLLM 讓 4GB 顯卡也能跑 70B 模型,中小企業自建推論伺服器的門檻明顯下降。
Google Gemma 4 12B 被強調為筆電本地可跑的多模態開源模型,只需 16GB RAM 即可流暢運行,並原生支援文字/圖像/音訊。
Meta 開源 30B 稠密模型 Muse Glimmer(Apache 2.0),量化後可在 24GB 顯卡運行,速度達 64–124 tok/s,生態工具鏈支援完整。