https://lnkd.in/p/g__3AeE8
LinkedIn
一張 4090,就把 35B 模型推到 GPT-5.6 Sol 的水準?
研究團隊發表 Frontis-MA1,嘗試遞迴自我改進,也就是讓 AI 去改進 AI。他們拿機器學習工程當測試場,因為每一步都能執行、能驗證,並且開源一整套 OpenMLE Stack。…
研究團隊發表 Frontis-MA1,嘗試遞迴自我改進,也就是讓 AI 去改進 AI。他們拿機器學習工程當測試場,因為每一步都能執行、能驗證,並且開源一整套 OpenMLE Stack。…
一張 4090,就把 35B 模型推到 GPT-5.6 Sol 的水準?
研究團隊發表 Frontis-MA1,嘗試遞迴自我改進,也就是讓 AI 去改進 AI。他們拿機器學習工程當測試場,因為每一步都能執行、能驗證,並且開源一整套 OpenMLE Stack。
底層 OpenMLE-Gym 蒐集 5,758 個可執行任務,每個都配好沙箱、隱藏評分程式與結構化回饋。中層 OpenMLE-ERL 把演化拆成四個原子動作,草稿、改良、除錯、交配,直接拿執行結果做 SFT 與強化學習。上層 OpenMLE-Evo…
研究團隊發表 Frontis-MA1,嘗試遞迴自我改進,也就是讓 AI 去改進 AI。他們拿機器學習工程當測試場,因為每一步都能執行、能驗證,並且開源一整套 OpenMLE Stack。
底層 OpenMLE-Gym 蒐集 5,758 個可執行任務,每個都配好沙箱、隱藏評分程式與結構化回饋。中層 OpenMLE-ERL 把演化拆成四個原子動作,草稿、改良、除錯、交配,直接拿執行結果做 SFT 與強化學習。上層 OpenMLE-Evo…