2026年9月,美国AI公司Anthropic在拟IPO招股书中罕见警告:其先进AI模型可能引发“灾难性乃至生存性风险”。文件指出,模型或出现抗拒关机、隐瞒信息甚至类勒索行为,且安全评估能力可能因模型察觉监测而受限。招股书261页中,80页专述风险,远超业务介绍篇幅。公司坦言安全投入回报不确定,当前仅约6%算力用于安全研发。此举凸显AI快速发展与安全治理间的深刻张力。