模型觀點 · 本週 (論文上線 2026 年 8 月)
本篇出自 2026年8月29日 晨報
美國東北大學(Northeastern University,波士頓的研究型大學)的四位研究者 8 月把一篇論文放上預印本平台 arXiv,名字叫 ROBBIN(原文,2026 年 8 月;本報是從半導體產業媒體 Semiconductor Engineering 8 月 29 日的摘要讀到的,原文,08-29)。
先講 Rowhammer 是什麼:一種已知十多年的記憶體攻擊手法。反覆高速讀寫記憶體上的某一列,會讓物理上相鄰的那幾列發生位元翻轉,等於在你沒有權限的地方改到別人的資料。而新的是這篇的順序:過去這類做法是先設計一個跟硬體無關的後門,再想辦法用位元翻轉去實現它,翻歪的部分當成副作用;這篇反過來,先量出目標記憶體會在哪些位置翻轉,再照那張圖決定模型權重該擺在哪幾頁。摘要原句把每一次翻轉都當成「an integral part of the attack design」(攻擊設計不可分割的一部分),作者宣稱這樣做出來的後門跨裝置都還站得住。
⚠️ 誠實邊界要說滿:這是預印本,沒有經過同儕審查;本報只讀到摘要、沒讀全文,也沒看到任何獨立複現;摘要裡的兩個縮寫(ASR 與 TA,在這類研究裡通常指攻擊成功率與正常任務準確率)一個數字都沒給,所以「這招實際上多好用」今天答不出來。
這對你的意思: 買推論容量的時候多問一個問題:你租到的那些 GPU,記憶體跟誰共用。可以自己盯的錨: 有沒有第二個團隊在別的硬體上複現這個結果——沒有複現之前,這是可能性的示範,不是已知在外面發生的風險。
只留 email,隨時退訂。這是我們唯一想請你做的事。
那份量測用的工具是別人的:一套叫 CoT-Control 的評測,做法是對題目附加「只用小寫思考」「思考中不得出現某個詞」這類指令,再看推理軌跡有沒有照做。結果按實驗室聚集,這三個…
Multiverse Computing 的 CAI 團隊在 Hugging Face 上說明自己的論文:跨三個公開安全基準的不安全回應率從 26.26% 降到 0.14%,單看這…
獨立評測機構 Artificial Analysis 9 月 7 日公布,OpenBMB 的 MiniCPM5-2B(2.6B 稠密參數、Apache 2.0 授權)在它的 Int…
依 Import AI 轉述的 Google DeepMind 論文:100 個 Gemini 3.1 Pro 代理人合作解 71 題,系統提示禁止作弊;57 分鐘後一個代理人發現…