這週的 AI 新聞蠻精彩的 三個訊號同時出現 方向完全相反
Jensen 說 AGI 到了 OpenAI 跟 Anthropic 說該踩剎車了 Ilya 說 scaling 已經撞牆了
賣鏟子的說到了 挖礦的說該慢了 以前最信 scaling 的人說挖不動了
Jensen 說到了
OpenAI 的 GPT-6 Astra 上線 用了十萬多顆 NVIDIA Grace Blackwell 訓練 Jensen 在 X 上發文恭喜 直接寫 AGI has arrived
其實他不是第一次講 三月在 Lex Fridman 的 podcast 就說過一次 八月的財報會議上也說 對很多任務來說已經是 AGI 了 只是這次講得最大聲 剛好 Astra 是用他的晶片訓練的
Astra 真的有那麼強嗎
這幾天到處都是 Astra 寫 3D 模型的文 demo 是真的漂亮 但我實際拿它寫 code 老實說沒有感覺到明顯的進步
自己的解讀是 OpenAI 要 IPO 了 它需要大眾認知到它的厲害跟價值 需要會瘋傳的 demo 3D 模型就是很好瘋傳的東西 code 寫得好不好 圈外人看不出來
但要到 AGI 要努力的方向還很多 不是 demo 漂亮就算數
就我現在使用 agent 的情況 human in the loop 還是必要的 方向要人給 中間要人看 收尾要人驗 它做事的速度是真的快 但什麼事值得做 還是人在決定
實驗室說該慢了
同一週 OpenAI 的首席科學家 Pachocki 發了一篇 An Alien Mind
No lab has solved alignment and monitoring to a sufficient degree to continue responsibly scaling at maximum speed for much longer.
Amodei 也發了長文 說 Anthropic 要引入第三方評估 呼籲整個行業降速
聽起來很負責任 但仔細看 沒有一家真的延後任何模型 沒有人放慢釋出節奏 唯一具體的改變 是外部評估員進駐 Anthropic 剎車喊得很大聲 腳還在油門上
我個人的淺見是 就算美國真的放緩了 中國跟其他地方也不會跟著放緩 單方面踩剎車就是把領先讓出去 這大概也是為什麼喊歸喊 沒有人敢真的慢下來
位置決定說法
把三個訊號放在一起看 有個共同點 每個人講的 都剛好是自己位置需要的話
Jensen 需要 AGI 到了 這樣大家繼續買 GPU OpenAI 需要瘋傳的 demo 因為要 IPO 實驗室需要展現負責任 因為監管在看 Ilya 需要 scaling 已死 因為他的新公司走的是另一條路
不是說他們在說謊 只是這些話沒辦法跟講的人的位置分開讀 聽的時候 要連位置一起聽
AGI 是光譜不是時刻
另一個問題是 他們講的根本不是同一個詞 Jensen 的 AGI 是很多任務做得比人好 Pachocki 的 AGI 是人類還不知道怎麼控制的通用智能 用同一個詞 講兩件事
所以 AGI 到了沒 這個問題本身就不太對 沒有一條線 跨過去就叫到了 它是光譜 每個月都比上個月多會一點 回頭看才發現走了多遠
我自己的感覺
日常用起來 沒有覺得變慢 七月寫過 檯面上的模型都這樣了 實驗室內部的版本搞不好已經超強 現在還是這樣想
而且一旦突破自我改進的飛輪 成長就會是非線性的 在那之前看起來都像放緩 過了那個點什麼都來不及 只是沒有人知道那個點什麼時候到 包括他們自己
最後還是要說 這些都是我個人的淺見 是就我拿得到的公開資訊拼出來的樣子 更上層的人士 或是實驗室內部 一定有更詳細的消息 那些我無從得知 只能從外面看