馬克雷達MARK RADAR
EN
事件檔案 AI 強化學習(RL)

Prime Intellect 發布支援萬億參數模型之強化學習基礎設施

1 篇報導 · 首次偵測 2026-06-24 · 最後活動 2026-06-24

Prime Intellect 致力於建立大規模 AI 模型訓練基礎設施;隨著 Agent 需要透過強化學習反覆探索與回饋,運算與通訊成本成為擴展瓶頸。此次將 RL 推向萬億參數混合專家模型(MoE),代表超大型模型的後訓練能力再往前一步。

Prime Intellect 最新發布 prime-rl v0.6.0,可在萬億參數規模的 MoE 上執行 RL 訓練,並整合多項推論與訓練最佳化,以提高 Agent 訓練吞吐量與效能。現有資料未揭露確切發布日期、效能增幅、硬體配置或投入金額,相關報導僅列出「not much happened today」。

全部報導

1 篇原始報導
NEWS.SMOL.AI 2026-06-23
not much happened today

馬克翻舊帳

這個事件的歷史脈絡

這個訊號沒有歷史回聲

馬克雷達|MARK RADAR
全站時間均為台北時間(GMT+8)