Anthropic“AI灭绝风险”争议为何刷屏?真正值得关注的是安全治理
一条个人发言为何迅速变成全球话题Anthropic对齐科学团队负责人Evan Hubinger关于“十年内AI导致人类灭绝概率超过10%”的判断,把原本集中在研究机构内部的AI安全争论推到了公众面前。这条消息容易传播,原因并不复杂:发言者来自知名前沿AI企业,内容涉及人类共同关心的安全问题,又给出了清晰的时间和概率。经过社交平台和新闻标题压缩后,复杂的条件判断被浓缩成一句极具冲击力的话。但从公共讨论角度看,最重要的并不是反复渲染“灭绝”二字,而是追问行业有没有与能力增长相匹配的管理办法。风险争议背后有三组现实矛盾能力更新速度与评估周期之间的矛盾模型更新越来越快,而高质量安全评估需要设计测试、邀...