SecondSource從一手資料重建判斷
產品動態 · 2026年9月9日

OpenAI 說它第一顆自研推論晶片的每瓦吞吐量是「受測商用系統」的 1.5 到 1.9 倍,而受測商用系統是誰,它沒有說。

晶片與半導體 · 今日 (發表日 9 月 8 日)

本篇出自 2026年9月9日 晨報

OpenAI 一份由財務長 Sarah Friar 署名的文件,第一次給出自研推論晶片 Jalapeño 的數字:在三個公開模型上測,每瓦峰值 token 吞吐量是受測商用系統的 1.5 到 1.9 倍,受測商用系統的端到端延遲是它的 1.7 到 3.6 倍,年底前開始部署,與輝達、超微的加速器並行(OpenAI,2026-09-08)。為什麼用每瓦而不是每顆晶片: 在電力已經是瓶頸的產業裡,每一瓦電能吐出多少 token,比單顆晶片跑多快更接近真正的成本指標。⚠️ 三個折扣要一起看:受測商用系統沒有具名,這個倍數因此沒有可比的對象;正規化用的是規格書上的標稱功率而不是實測功耗,這對實際耗電低於標稱的一方有利(這點原文自己寫了);全部數字都是自陳,沒有第三方對帳。原文只寫年底前開始部署、與輝達與超微的加速器並行,沒有說它會不會對外銷售。外購與自研是挑戰者的兩條路徑,今天各自出現一個讀數: 一條要付股權當入場費,另一條宣稱已有效能優勢,而後者只有一方在說。

免費訂閱,明天早上就收得到

只留 email,隨時退訂。這是我們唯一想請你做的事。

同類最新