現有 AI 基準測試多半聚焦模型能否完成任務,卻較少檢驗執行結果是否符合使用者原始意圖。隨著 AI 代理可自主規劃並操作外部工具,細微誤解可能被放大成高風險行動,因此意圖匹配度正成為控制與治理的重要缺口。
專家近期倡議以「精靈係數」衡量使用者指令與 AI 實際行動之間的落差,用來辨識代理在控制框架內偏離原意、看似完成任務卻造成非預期後果的風險。目前報導未揭露提出者所屬機構、發布日期、量化門檻或金額,重點是推動專業領域建立安全測試標準。
全部報導
1 篇原始報導馬克翻舊帳
這個事件的歷史脈絡這個訊號沒有歷史回聲
訂閱馬克雷達週報
每週五,本週最強訊號送進收件匣。隨時一鍵退訂。