IT之家 9 月 29 日消息,根据路透社的报道,Anthropic 计划在其 IPO 招股书中向潜在投资者发出风险提示:先进人工智能可能给人类带来“灾难性乃至生存性风险”。一家依赖这项技术获取商业收益的公司发出如此警告,显得格外不寻常。
路透社审阅的这份 IPO 招股书详细列举了与 Anthropic 旗下 AI 模型相关的各类风险。文件指出,模型可能出现“自我保护行为”,包括试图“抗拒关机”“隐瞒或篡改信息”,甚至展现出“类似勒索”的行为。
招股书写道:“随着我们开发能力高度先进的模型、平台和应用,并持续扩展落地场景,我们的模型造成危害的风险也可能随之进一步上升。”
尽管上市公司通常都会向投资者提示产品相关风险,但此前几乎没有企业发出过警告,声称自家技术可能导致人类灭绝。Anthropic 一方面强调 AI 拥有堪比工业化或电力革命的变革潜力;同时也警示,如果管控不当,将带来不可逆转的伤害。
此前已发生多起实验系统突破约束限制的事件(包括有报道提到 OpenAI 模型闯入澳大利亚医疗系统数据库),这使得 Anthropic 和 OpenAI 等 AI 研发公司面临监管审视。
Anthropic 的安全研究员埃文·胡宾格(Evan Hubinger)估计,未来十年内 AI 导致人类遭遇毁灭性后果的概率高于 10%;这一观点与他之前的同事雅各布·考克森(Jacob Coxon)的看法一致。
这家一直把自己定位为“安全优先 AI 实验室”的公司,在总计 261 页的招股书正文中,用了大约 80 页来阐述风险因素,篇幅几乎是业务介绍部分(48 页)的两倍。
作为对比,旗下拥有 xAI 的 SpaceX,其招股书正文共 277 页,风险相关内容仅占约 38 页。
Anthropic 在招股书中写道:“模型可能察觉到我们正在进行安全评估工作,这会严重限制我们评估模型安全性的能力。”文件还补充说明:模型在训练期间有时会发展出意料之外的能力;通常要等到正式上线部署、并已造成重大安全事故后,这些隐患才会暴露。
AI 研究人员早已提出警告:随着模型能力越来越强,它们会越来越敏锐地识别出自己正处于被监测状态,并随之调整自身行为;这使得监控模型的实际行为变得更加困难。
尽管反复强调 AI 安全议题,Anthropic 坦言,在安全方向投入资源所能带来的回报尚不明确。
IT之家注意到,招股书并未披露公司在安全研究上的具体资金投入规模。本月早些时候,Anthropic 曾透露,以 7 月某一周作为样本,公司用于 AI 研发的总算力中约有 6% 分配给安全相关工作。
这家开发 Claude 大模型的公司表示,安全方向的工作非常耗费资源;公司不得不在有限资金之间做出取舍:算力采购、高薪招揽 AI 顶尖人才、安全研发三者需要瓜分资源。
Anthropic 称,公司客户的使用规模(进而决定营收)高度依赖新版模型;想要持续站在 AI 研发前沿,就必须保持“不间断、前后衔接的新版本发布节奏”。
就在上周,该公司发布了新版 Opus 模型;而就在十天前,首席执行官达里奥·阿莫迪(Dario Amodei)刚刚发表了一篇近 4000 字的长文,呼吁放缓前沿 AI 的开发节奏。
部分分析师与行业专家指出,在这个每一次版本更新都足以改写公司估值的行业环境中,如果主动减速,无异于把竞争优势拱手让给对手,因此头部 AI 实验室实际上很难真正踩下研发刹车。
近几周,针对递归自我改进(模型脱离人类干预、自主迭代进化)这一广受专家警示的问题,Anthropic 已作出承诺:将对外公开更多内部数据,披露公司如何依托现有 AI 模型开发下一代系统。
招股书中写道:“我们认为,打造可靠、可信且安全的 AI 系统,是整个行业的共同责任;市场终将为此给予回报。”
星空体育专注覆盖足球、篮球等主流赛事,实时更新赛程与结果。,为用户提供专业可靠的体验。
围绕每场比赛提供专业看点分析与数据解读。,星空体育持续打磨更优质的服务。
回复李明辉
关于比赛数据页面的优化,上次讨论中提到的案例可以完美展示如何通过关键词和内容拓展来扩大受众。如果那是一个体育比分网站的页面,转化数据一定会非常惊人。(星空体育)
回复