AI滅絕人類的警告是空穴來風? 突顯模型能力快速提升各方將面對AI治理的壓力
(示意圖/AI生成)
(示意圖/AI生成)
Anthropic研究員對AI滅絕風險提出高調警告後,治理問題再度成為焦點。過去AI監管多圍繞隱私、偏見與就業衝擊,如今討論擴大到超級智慧、失控能力與跨國安全門檻,政策制定者面臨更高壓力。
英國政界人士Darren Jones在事件後呼籲,政府應推動多國條約,為超級智慧發展建立共同安全框架。他主張,AI研發具有跨境外溢效果,若只依靠單一國家規範,難以避免企業或競爭對手轉往其他司法管轄區。另有報導指出,Anthropic未將最新模型提交英國AI安全研究所評估。若消息屬實,將凸顯高階模型外部審查的制度脆弱性。監管者需要取得足夠資訊,但企業也可能以商業機密與發布時程作為限制理由。
OpenAI首席科學家Jakub Pachocki也曾指出,業界尚未充分解決對齊與監測問題,不應長期以最高速度擴張模型能力。他期待企業在共同安全標準建立前,自願放慢腳步,讓技術進展與治理能力保持同步。AI對齊並非單一技術指標,而是一整套關於系統是否理解、遵循並維持人類意圖的問題。不同公司使用的測試方式與風險分類並不完全一致,外界因此難以比較模型安全性,也難以判定何時應暫停升級。
對高階AI公司而言,透明度是一道難題。過度公開可能洩漏能力與弱點,增加濫用風險;但資訊不足又會削弱社會信任。當內部研究員公開示警,企業如何回應、揭露哪些證據,將影響外界判斷。AI模型更新週期可能以月計算,但立法與國際協商往往需要多年。這種速度差使監管者難以用傳統程序處理高風險科技。若缺乏預先授權、快速評估與跨境資訊共享機制,政策可能永遠追在風險後方。
專家Wendy Hall提醒,若企業內部人士相信自身技術有重大生存風險,投資人也應重新評估資金所支持的價值與治理。當AI公司接近更大規模融資或上市期待,資本市場不只是旁觀者,也可能成為安全壓力來源。許多倡議者主張,國際社會應建立共同門檻,包括模型能力分級、紅隊測試、發布前審查與事故通報。這些制度不一定能消除風險,但可讓各方在能力快速躍升前,至少共享基本警訊與最低安全要求。
AI治理的挑戰在於,它不能只是事後補救,也不能簡化為反科技立場。面對可能改變社會權力結構的系統,負責任創新需要可驗證安全標準、獨立監督與企業承諾。治理能力將成為AI競爭的一部分。
Copyright © 2022~2026 好好聽文創傳媒股份有限公司 All Rights Reserved.