群发资讯网

《谁有权按下AI的总闸?答案不能只有模型公司》 一座城市请来一名超级电工。他能在十分钟内找出全城电网的隐患,也能在同样时间里让半座城市断电。 市长问:“钥匙交给谁?” 电工回答:“交给我,我还会监督自己。” 这正是Astra带来的治理难题。OpenAI称,它首次达到公司定义的“关键级网络能力 ​

《谁有权按下AI的总闸?答案不能只有模型公司》

一座城市请来一名超级电工。他能在十分钟内找出全城电网的隐患,也能在同样时间里让半座城市断电。

市长问:“钥匙交给谁?”

电工回答:“交给我,我还会监督自己。”

这正是Astra带来的治理难题。OpenAI称,它首次达到公司定义的“关键级网络能力”:在合适工具和权限下,可以发现未知漏洞、组成攻击链。公司同时准备部署自动监控,发现可疑行为便暂停任务。

能力越强,紧急制动越必要。但谁来判断什么时候应该停?如果标准、日志、监控器和停止按钮都掌握在开发公司手中,社会得到的不是完整监督,而是一份企业自我保证书。

更复杂的是,误判也有成本。医院安全人员正在修复漏洞,模型却把他们当成攻击者;企业的重要系统修到一半,任务突然停止;用户还可能不知道触发了哪条规则。

我的判断是,关键级模型至少需要四层治理:企业实时制动、客户本地断权、独立机构复核、监管部门依法处置。事故日志不能只保存在模型公司,重大越权行为应有明确报告期限。

这不是要求政府每天审批一条提示词,而是要求权力与责任匹配。模型公司可以握方向盘,却不能同时兼任交警、事故鉴定人和保险公司。

真正可靠的总闸,不是永远掌握在某个英雄手里,而是谁越权,谁都能被制度按停。