大神觀點
本篇出自 2026年7月16日 晨報
他公開估算 Inkling 最後一哩強化學習的規模:約一千張 GB300、跑約一週、約 $5M——並自標這是「初步猜測」(估算)。這個數字的價值在量級不在精確:業界從不公開「訓一顆前沿級模型的最後一哩要花多少」,若量級沒錯,這一段的成本是個位數百萬美元、遠低於預訓練——門檻在配方與資料,不在算力。單源、自標猜測,勿當事實引用;任何官方揭露出現,先拿來檢驗這個錨。
只留 email,隨時退訂。這是我們唯一想請你做的事。
Nathan Lambert 對 Opus 5 追平旗艦給出機制解釋:他認為關鍵是「更快的迭代速度+規模化強化學習(RL)」,而旗艦模型「反而還太大、還沒法同樣做 RL」。若這個解…
Dwarkesh Patel 是獨立科技訪談者與作者,其 AI 產業深度論述常被業界轉引。他 6 月的文章主張:每個要教給模型的技能,背後對應至少數百位人類專家寫示範與評分標準;專…
Thompson 是科技戰略電子報 Stratechery 的作者、產業判讀最受引用的分析者之一。在華府與華爾街同聲恐慌的一週,他的判斷反著走:中國開源模型的威脅並不新;前沿實驗室…
Mollick 是賓州大學 Wharton 商學院教授,企業界讀者最多的 AI 實用主義評論者。他以第一手實測給出 2026 下半年的判讀:要拿 AI 做真工作,實務選項只有 Ch…