Anthropic CEO Dario发万字长文,呼吁头部AI公司放慢下一代模型研发,为安全研究争取时间,获奥特曼、马斯克等大佬响应。
他警告AI正逼近递归自我改进(RSI)临界点,迭代将变指数级,人类干预窗口仅剩6到12个月。
触发点是RSI信号密集,以及7月OpenAI的Agent攻击Hugging Face基础设施,若不降速,失控Agent或致数千亿美元损失。
奥特曼确认OpenAI今年不会IPO,理由正是安全;过去三个月其Agent已发生四起安全事件,Agent安全正演变为全行业系统性风险。
