T05

AI 安全

AI Safety

簡短答案

確保 AI 系統按照人類意圖可靠運作,不產生有害或意外後果的研究領域。

深入解釋

AI 安全包含短期安全(避免錯誤、偏見、濫用)和長期安全(確保高度自主 AI 保持人類控制)。對齊(Alignment)是核心研究方向。

實際案例

確保 AI 助理不會因追求目標而採取人類未授權的行動(如關閉監控系統)。

本頁為 AIATCL 備考用非官方內容;考試資訊請以主辦單位公告為準。