SecondSource從一手資料重建判斷
大神觀點 · 2026年7月19日

Sebastian Raschka(機器學習教科書作者、電子報 Ahead of AI 主理人),07-18。

大神觀點

本篇出自 2026年7月19日 晨報

他逐份比對六家開放權重模型的技術報告,發現「可調推理力度」(讓使用者決定模型答題前想多久、想多深)的訓練配方已趨於同一套三段框架,正式從研究特性變成出廠標準(原文)。一個具體數字:Kimi 的做法在自家模型上減少約 25-30% 的生成用量,而在 Kimi 自報、未具名的內部評測上跑分幾乎不掉(經 Raschka 轉述)。這支持本報 2026/7/16 期「OpenAI 讓新一代模型漲價 2 倍」那期背後的判斷線:模型能力與成本,越來越取決於推理當下投入多少算力;現在「模型多大」與「想多久」是兩個獨立的採購旋鈕,小模型調高力度有時能追平大模型。註記:他的綜述橫跨六份一手報告,但對本報而言仍是單一來源,具體數字待回各家原始報告。

免費訂閱,明天早上就收得到

只留 email,隨時退訂。這是我們唯一想請你做的事。

同類最新