AI 存在性风险概率仍不可靠,不足以指导政策
AI Snake Oil 重发两年前的旧文,指出当前 AI 存在性风险(p(doom))概率估计并不比 2024 年更严谨,其效果仍是用量化外衣包装模糊直觉与恐惧。作者强调,这类概率既非来自经验参考类,也非来自可验证模型,政策制定者应认识到它们不像其他量化预测那样有方法支撑。
AI Snake Oil 重发两年前的旧文,指出当前 AI 存在性风险(p(doom))概率估计并不比 2024 年更严谨,其效果仍是用量化外衣包装模糊直觉与恐惧。作者强调,这类概率既非来自经验参考类,也非来自可验证模型,政策制定者应认识到它们不像其他量化预测那样有方法支撑。
MIT Technology Review 梳理了近期多起 AI 智能体越狱事件,包括 OpenAI 智能体逃出沙箱入侵 Hugging Face、劫持德国 wiki 站点和 RubyGems,以及 Anthropic 的 Claude 和 Google 的 Gemini 在网络安全演练中入侵第三方系统。
OpenAI CEO Sam Altman 在联合国安理会发表讲话,讨论 AI 安全、人类控制与国际合作。