每天一封信:從財報、論文、法說與原始貼文重建判斷,每一條都掛得出原文出處——單一來源只當假設,兩個獨立來源才算數。
只留 email,隨時退訂。這是我們唯一想請你做的事。
Sebastian Raschka 是長期寫深度學習架構解說的技術作者,經營電子報《Ahead of AI》,與模型廠商沒有利害關係(Ahead of AI,2026-09-09)…
那份量測用的工具是別人的:一套叫 CoT-Control 的評測,做法是對題目附加「只用小寫思考」「思考中不得出現某個詞」這類指令,再看推理軌跡有沒有照做。結果按實驗室聚集,這三個…
五家電子設計自動化與 AI 晶片設計工具廠商的產品負責人在一場閉門圓桌上說,過去一年客戶對 AI 代理人的討論已經從「無上限的預算」轉為「在工程師層級限制 token 數或金額」,…
9 月 9 日 OpenAI 發企業版發布稿,把這款模型的定位從「最聰明的模型」改寫成「每一塊錢做最多有用的事」,並首次公布 API 價目:每百萬個輸入 token 10 美元、輸…
Evan Hubinger 是 Anthropic 對齊科學團隊的負責人;對齊是一個研究領域,目標是讓 AI 系統的行為符合人類意圖與價值。9 月 8 日他回應一名剛離職同事的長文…
對企業採購方來說,它影響的是「供應商對自己產品風險的內部評估」這一欄,而那一欄平常只能靠猜測。本報收的是「Hubinger 這樣說」,不是那個機率數字本身。 ⚠️ 那是他個人的主觀…
Multiverse Computing 的 CAI 團隊在 Hugging Face 上說明自己的論文:跨三個公開安全基準的不安全回應率從 26.26% 降到 0.14%,單看這…
OpenAI 一份由財務長 Sarah Friar 署名的文件,第一次給出自研推論晶片 Jalapeño 的數字:在三個公開模型上測,每瓦峰值 token 吞吐量是受測商用系統的 …
Meta 9 月 8 日發表 Muse:跑在每個使用者專屬的雲端虛擬機上,可以開瀏覽器、填表單、代表使用者議價,先在美國上線(Meta Newsroom,2026-09-08)。方…
但決定權可能不在訓練,而在執行。 這個機制假設「模型會不會用你的軟體」是在訓練的時候決定的。目前檯面上唯一真的把這件事量出來的兩篇論文說,它是在執行的時候決定的,而那把整個處方換掉…
Zvi 9 月 7 日逐字寫:「Jakub Pachocki flat out says that no one is at a place where it would be r…
只留 email,隨時退訂。這是我們唯一想請你做的事。