匿名模型現身 Arena
週末 Arena 出現標記為 1.5 Flash 但行為異常的模型,處理複雜請求時有長思考。其能精準生成數千行 PS5 向量繪圖代碼,與原版精度不符,暗示為更強的新模型偽裝而成。
解析 Google 疑似在 LMSYS Arena 秘密測試的 Gemini 4 模型,其優異效能、超長上下文規格與極低定價傳聞,反映出 Google 試圖透過技術與價格戰重奪市場領先地位。
安裝摘要王後,打開任何 YouTube 影片就能一鍵整理重點,先看值得看的段落,不必再複製網址。
用摘要王先看重點,把時間留給想看的段落。免費註冊,我們會把 YouTube 電腦版安裝連結和教學寄到你的信箱。
使用 Google 免費開始・每個新帳號限領一次
如果願意,點一下最接近你的感受就好。
影片提到 Gemini 4 疑似透過遞迴自我改進(RSI)技術提前完成預訓練,這意味著 AI 已經開始具備「自我優化」能力,而不僅僅是依賴人類標註數據。當 DeepMind 首席策略官提到 AI 營收尚不足以支撐龐大支出時,這種技術加速便成了企業生存的豪賭。
如果 AI 在 2027 年左右實現完全 RSI,這對硬體供應鏈雖是利多,但對知識工作者而言,競爭本質將發生根本改變。我們是否準備好面對一個生成成本極低、且能自我迭代的智能實體?當模型能自主處理複雜機器人控制時,人類在決策鏈中的位置可能需要被重新定義。
觀眾怎麼看
整理 29 則有效留言信心 高觀眾對 Gemini 4 的效能表現持高度懷疑,並質疑影片內容過度炒作且缺乏實質應用價值。
部分觀眾認為 Gemini 模型長期表現不佳且存在幻覺問題,對新模型的實際效能持保留態度。
多位觀眾指出影片提到的 Ox Alpha 實際上應為 GLM-5.3-Flash 模型,而非 Gemini 相關技術。
觀眾批評影片標題具誤導性(Clickbait),並質疑測試基準數據的真實性與技術細節。
觀眾針對 AI 模型的政治傾向提出不同看法,有人認為 Gemini 較為中立,亦有人認為其存在偏見。
部分觀眾表達對 AI 生成影片內容的厭倦,認為這類資訊缺乏深度且過於氾濫。
留言樣本數有限,且部分觀點存在明顯立場差異,僅代表部分觀眾意見。