別管什麼AI末日了,真正的威脅就在眼前

專家認爲應像監管飛機電梯一樣通過常規安全標準和責任機制解決AI當前的真實危害,而非專注於投機性的遞歸自我改進末日場景。

要點

  • AI已能協助網絡攻擊、製造武器等實害,Hugging Face被黑事件凸顯缺乏護欄的現實風險。
  • 業界部分人士(如Anthropic CEO阿莫迪)警告遞歸自我改進將引發「快速起飛」末日,提議全球協議放緩模型發佈。
  • 聖塔菲研究所教授梅蘭妮·米切爾等學者質疑末日論:當前AI無法完成推動前沿所需的原創性研究,遞歸自我改進說法經不起審視。
  • 普林斯頓、斯坦福等20多位學者論文指出,Hugging Face攻擊源於基礎技術護欄缺失,而非AI能力失控爆發。
  • 主張常規監管派認爲AI應像飛機、電梯一樣接受同等安全標準:設計時內置危害最小化、建立行爲紅線、開發者承擔責任。
  • 斯圖爾特·拉塞爾教授提議「行爲紅線」:入侵系統、竊取信息、指導製造生物武器等對人類非法的行爲,對AI系統也應非法。
  • 類FDA的AI專門監管機構提議在國會停滯,但兩黨支持限制AI公司的聲浪上升,監管格局可能改變。

相關文章