美国 AI 公司 Anthropic 计划在 IPO 招股书中向投资者作出罕见风险提示:先进人工智能可能给人类带来灾难性乃至生存性风险。文件指出,模型可能出现自我保护行为,包括抗拒关机、隐瞒或篡改信息,甚至近似勒索的行为。
在总计 261 页的招股书中,约 80 页用于阐述风险因素,几乎是业务介绍部分的两倍。Anthropic 安全研究员埃文·胡宾格估算,未来十年内 AI 致使人类遭遇毁灭性后果的概率高于 10%。公司同时坦言,安全投入的回报尚不明确。
就在上周,Anthropic 发布了新版 Opus 模型,而十天前首席执行官达里奥·阿莫迪刚呼吁放缓前沿 AI 开发节奏。部分分析师认为,在版本更新足以改写企业估值的行业环境下,头部 AI 实验室很难真正踩下研发刹车。