
日前Anthropic執行長阿莫戴突然呼籲AI業界放慢最先進模型的發展速度。他擔心AI能力進步太快,尤其AI開始協助開發下一代AI之後,可能形成愈跑愈快的循環。幾天內OpenAI執行長阿特曼、馬斯克等人陸續表示認同,AI安全一下子從少數研究人員的警告,變成社會最熱門的爭論。
不過,AI發展並沒有因為幾位大老闆喊慢就真的慢下來,OpenAI九月公布,最新模型Astra已經達到「嚴重」等級的網路攻擊能力。Anthropic最新威脅情報報告也指出,已發現AI被用在網路攻擊、監控、詐騙、影響力操作、生物風險與武器相關活動。更值得注意的是,AI在網攻中的角色正從幫忙寫程式的「助手」,逐漸變成能夠規劃與執行工作的「指揮者」。
以前談AI倫理,常想到偏見、隱私、著作權、假新聞,這些問題還在。但AI代理人出現後,問題更加嚴重,AI不只回答問題,它開始會自己做事。一個會說錯話的AI很麻煩,一個會自己採取行動又做錯事的AI,麻煩大得多。
阿莫戴提出讓外部安全人員進駐AI公司,取得接近內部員工的資訊與權限,檢查模型到底安不安全,阿特曼也公開支持。這比企業自己發布的安全報告進步很多,但誰去選這些稽核人員?薪水誰付?可以看到多少資料?發現公司不願公開的問題時,有沒有權利向社會大眾公布?
飛機不能由航空公司自己宣布安全,藥品也不能由藥廠自己做完實驗就批准上市。能力愈強的AI,愈需要真正獨立的第三方測試。加州已經通過建立AI稽核人員登錄制度的法律,雖然制度還在起步,至少方向已經很清楚。再者,很多企業談負責任的AI,員工上幾小時倫理課,網站放幾條原則,就算交差。在進入AI代理人時代後,這遠遠不夠。
真正需要的是責任鏈,AI替銀行做風險控制,出事誰負責?AI醫療建議造成傷害,誰要負責?AI代理人擅自下載資料、寄出郵件甚至發動網攻,又要找誰?如果每家公司都說「那是AI自己做的」,AI就會變成最好用的卸責工具。所以每個高風險AI的動作都應留下紀錄,誰下指令、模型做了什麼、呼叫哪些工具、存取哪些資料、什麼時候有人介入,都要能夠追查。
AI的極端情況是否真會發生,沒有人知道;把AI的發展都停下來,也未必合理。AI可協助新藥研發、教育、製造、能源與科研,因為害怕未知風險就全部禁止,就得不到AI的好處。重要的是「勿恃敵之不來,恃吾有以待之。」
我們不必每天討論AI會不會毀滅人類,但可以先處理目前做得到的事。模型上市前做獨立測試,高風險AI設下門檻,重大事故強制通報,保留完整操作紀錄,讓外部研究者有合理的測試管道,企業主管對隱瞞風險負起法律責任。這些都不是阻止AI進步,只是AI產業一定要補上的基本管理。
AI能力進步得愈快,人類管理AI的制度就得跟得越快。阿莫戴這次真正值得聽的,也許不是一個「慢」字,而是提醒我們,AI能力愈來愈強大,AI的安全與倫理不能只靠私人公司良心。AI會愈來愈聰明,但決定AI什麼能做、什麼不能做,最後還是人類的責任。這條界線如果控制不住,越聰明的AI對人類危害越大。