近期黃仁勳預言,未來5年內,AI會追上人類。剛回鍋的OpenAI執行長奧特曼也強調,AI開發不會停。但其聯合創辦人蘇茨克維卻擔憂,次世代的AI可能帶來重大社會風險。他所領導的「超智慧對齊」(Superalignment)專案,就是為此而生。
對我來說,所謂超智慧對齊,就是「自動化對齊」,讓AI能持續符合人類的期待。要了解這個概念,我們需要先理解預訓練與微調。
「預訓練」是將巨量資料壓縮成模型。在輸入要求後,AI就會照原始資料的共同性,產生答案。好比說,模型會注意到人臉的共同性如輪廓,收到指令後,重新畫一張人臉出來。但原始資料不足時,就可能出現幻覺。
「微調」是進一步考量人類是否接受它給出的結果。例如,模型應該拒絕捏造的回答,給出透明的答案。如果訓練資料裡沒有相關材料,AI也應該如實說明。
而「超智慧對齊」指的是,能不能運用現有AI,來協助人類完成大部分的微調工作?
打個比方:審理複雜的專利侵權案時,法官本人未必是領域專家,但只要交由兩造的專業律師針對事件辯論,法官判斷論點是否合乎法規即可。超智慧對齊的原理,就是將人類放在類似法官的位置。
展望未來,甚至只要共筆一份「憲法式AI」文件,就能讓AI自動對齊這些準則。例如以《世界人權宣言》訓練的小型AI,來對齊次世代的大型AI,讓後者更接近人們期待的樣子。
而做為政策制定者,我們的工作就是透過政策以及政府投資,對市場給出訊號。近期剛開幕的AI評測中心,就揭櫫AI應符合的10大要點,分別是安全、彈性、準確、當責、隱私、可解釋、公平、透明、可靠、資安。如果在這10件事上背道而馳,雖然不會馬上禁用,但政府不鼓勵部署。
在2016年入閣前,我曾協助蘋果Siri團隊6年,當時團隊最注重的,就是準確、無害。我認為,隨著對齊技術的成熟,頻頻出現幻覺的AI系統,將不再獲得投資人青睞。
這就像1980年代,人類發現冰箱用的冷媒會破壞臭氧層,各國迅速簽訂《蒙特婁議定書》,彼此約定停用期限。這對出資者就是很明確的訊號:如果再不迅速調整的話,其他競品很快就會取而代之。反之,當市場上出現更穩定、安全的AI供消費者使用,投資和消費就會引導業界,不至於走上歧途。