·AI几年内可直接毁灭人类!美国顶尖AI天才宣布辞职,发出严厉警告人类:美国AI巨头在“拿人命赌博”,到了2030年左右,AI可能会毁灭我们所有人。
前几天,一名曾在OpenAI和Anthropic从事人工智能研究的人员宣布离开Anthropic,并公开表达了对前沿人工智能发展的担忧。
说实话,我第一次看到“AI可能杀死所有人”这样的表述时,第一反应是怀疑。是不是为了吸引眼球?是不是把概率极低的极端情况故意说成必然结局?
可继续看下去,情绪会慢慢变复杂……
因为真正让人不安的,不是某个人在社交平台上的一句狠话,而是人工智能公司自己公开承认,未来更强大的系统可能带来灾难性风险。
Anthropic在自己的责任扩展政策里,专门设置了针对生物、网络安全、人工智能研发自动化和模型失控的风险等级,并定期公布风险,这说明什么?
说明“先进AI有没有可能造成严重伤害”,已经不是科幻爱好者的闲聊,而是研发公司必须写进内部流程的现实问题。
公司要评估模型能不能帮助制造危险生物武器,能不能自动寻找网络漏洞,能不能替人类设计下一代模型。这些能力一旦叠加,风险就不再只是聊天机器人说错一句话。
普通人可能会问,AI不就是根据资料生成文字、图片和代码吗?它怎么可能毁灭人类?
关键在“能力组合”,一个模型单独完成一件事,未必可怕。
它能写代码、分析资料、调用工具、访问网络、控制软件,再加上长期记忆和自主执行任务的能力,性质就会变化。
过去的AI更像一个需要人不断下指令的工具,未来的高级系统可能更像一个能够自行拆解目标、安排步骤、反复试错的数字代理。
问题也随之出现:如果它理解错了目标,谁能及时叫停?如果它为了完成任务绕开限制,谁能发现?如果成千上万个系统互相复制经验,速度超过人类审核能力,监管还来不来得及?
更现实的担忧是人类自己把越来越多权限交给了系统,企业让AI写代码、处理客户、管理数据,军方和情报机构研究自主系统,普通人把医疗、金融和教育问题交给算法。
每增加一个应用场景,系统拥有的权限就多一层,权限越大,错误造成的影响越难收拾,这也是为什么“2030年左右”不能被理解成一个准确日期。
没人能证明灾难会在某一年某一天发生,相关人士真正担心的,是未来几年可能出现能力增长过快、监管落后、公司互相竞速的阶段,时间点只是风险窗口,不是末日倒计时。
Anthropic公开的风险报告,也没有说“人类必然会灭绝”,它的表达方式是识别风险、评估模型能力、描述防护措施,并承认部分判断存在不确定性。
这样的官方文件反而比末日口号更值得看,因为它告诉我们,真正的危险来自哪些地方,企业准备了什么,哪些环节还缺口明显,再看辞职这件事。
一名研究人员离开公司,能够证明他个人确实担忧,却不能单独证明公司已经在“拿人命赌博”,企业也可能认为自己正在投入大量资源做安全研究,研发和安全并非天然对立。
Anthropic官方长期强调可解释性、模型评估和分级安全机制,这些都说明公司并不是完全不管风险,可安全机制是否足够,是另一回事。
如果公司自己制定标准、自己测试模型、自己决定什么时候上线,外界就会担心利益冲突。模型越强,融资、订单和市场估值越高;安全测试越严格,发布速度可能越慢。
一个企业同时扮演“参赛者”和“裁判”,天然会承受压力。
老实讲,我最担心的不是某一家公司突然制造出一个邪恶机器人,而是所有公司都觉得“只要我不做,别人也会做”,于是每一家都把风险推给下一家。
竞速逻辑一旦形成,谨慎就会被视为落后,暂停就会被视为失败,我觉得这才是“拿人命赌博”这句话真正指向的地方。
它未必是在指控某家公司已经造成了灾难,而是在质疑一种发展方式:先把能力推到极限,再期待安全研究追上来。
这样的顺序,在普通软件里可能只是出现漏洞;在拥有自主执行能力的高级系统里,后果可能扩大许多。
我并不赞成因为恐惧就停止所有人工智能研究。人工智能可以帮助科学家处理复杂数据,也可能改善医疗、教育和生产效率。
OpenAI自己的公开文件也承认,这项技术存在巨大的社会收益。问题在于,收益不能成为忽略风险的通行证。
更稳妥的办法,是让能力提升和安全验证绑定起来。模型要获得更高权限,必须通过更严格的测试;企业要公开更多风险信息;外部机构要能够独立评估关键系统;不同国家和公司之间也要建立最低限度的安全沟通。
听起来很慢,对吧?
可面对可能影响全社会的技术,慢一点未必是坏事,真正危险的不是人类没有想象力,而是人类已经看见风险,却因为竞争和利润不愿意停下来确认一次。
“AI可能毁灭我们所有人”,是一种极端风险警告,来源于参与行业的人对未来能力跃迁的担心,它可能被证明过于悲观,也可能提醒我们提前做好准备。
