隨著生成式AI崛起,許多軟體工程師開始依賴AI代理進行前端開發,特別是針對熱門的React框架。這使得評估AI生成程式碼的品質與安全性,成為科技產業衡量自動化風險的關鍵。開源團隊Million推出專為React設計的基準測試ReactBench,旨在客觀檢驗大模型在真實開發場景中的防錯與除錯能力。
開源團隊Million於2026年7月正式發布ReactBench v1測試結果。數據顯示,在眾多受測的AI編碼代理中,表現最佳的GPT-5.6 Sol成功率僅為43.1%,主流大模型的編碼成功率皆未達五成。這顯示目前AI開發工具仍有極高機率寫出含有錯誤或安全性漏洞的程式碼,對企業資安帶來潛在風險。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。