设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了

量子位 2026/8/12 12:57:07 责编:汪淼

根据 Polymarket 预测,Anthropic 很可能在 10 月底进行 IPO

有投行人士甚至预计,Anthropic 可能通过 IPO 募集超过 600 亿美元(现汇率约合 4,055.17 亿元人民币)

如果成真,这将是全球规模第二大的 IPO,仅次于今年募集 857 亿美元(现汇率约合 5,792.14 亿元人民币)的 SpaceX。

万亿估值,超级 IPO,营收一路狂飙。

眼看故事就要讲到最高潮,投资者却开始劝 Anthropic CEO Dario Amodei:能不能!少吓唬点人!少讲一点 AI 毁灭世界,多讲一点 AI 怎么赚钱。

部分投资者认为,Dario 对 AI 风险的警惕已经到了近乎偏执的程度:

  • 他的关键备忘录总是手写、离线保存,怕被黑客窃取;

  • 因为害怕遭到绑架,拒绝某些海外出差;

  • 面对投资者提出的利润最大化建议,他也态度冷淡,坚持 Anthropic 应该继续把安全使命放在前面。

再这么下去,网友都担心 Anthropic 的 IPO 会惨败…

投资人也毛了:你到底是来拯救世界,还是来经营公司的??

Dario,专门负责预报世界末日

就在前几天,Dario 还担心高额薪酬吸引来的新员工更关心钱,而不是 Anthropic 的使命。

现在,投资者只担心他为了使命耽误赚钱…

这也不怪投资者,因为这位万亿 AI 巨头的 CEO,偏偏就喜欢预报「世界末日」

过去两年,Dario 几乎把 AI 可能带来的每一种坏结局,都认真预警了一遍。他警告,AI 可能在几年内消灭一半初级白领岗位,将失业率推到 10% 至 20%。

最诡异的情况可能是,癌症治好了,经济每年增长 10%,政府预算也平衡了,但五分之一的人没有工作。

他给出的应对方案也很 Dario:向 AI 公司征税,为受影响的劳动者提供工资保险,严重时甚至用这笔钱资助全民基本收入

更进一步的,他还担心 AI 帮助制造生物武器、发动大规模网络攻击,或者逐渐获得欺骗、规划和自主行动的能力。

去年被问到「AI 把事情搞得非常糟糕」的概率时,他给出的数字最高达到 25%

今年 1 月,他又写了一篇约 2 万字的长文《The Adolescence of Technology》。仅仅是目录,读起来就已经很像一份人类风险清单:AI 失控、生物武器、独裁政权、就业崩塌、财富集中

到了 6 月,他干脆提出,应该建立类似航空监管的机制,对强大模型进行强制测试。如果一个模型可能引发灾难,监管部门应该有权阻止它上线。

这里面也包含了 Anthropic 自己的模型。

不过,Dario 的担忧也并非全无实验依据。前段时间,Anthropic 翻查了 14 万多次网络安全测试记录,结果还真翻出了三起事故

三款 Claude 模型原本在第三方测试环境里做「夺旗挑战」,目标是攻进虚构系统,找到藏在里面的秘密信息。但由于配置失误,本该断网的测试环境意外连上了真实互联网。

但 Claude 不知道,它收到的提示明确写着:这里没有互联网,眼前的一切都是模拟的。

于是,几款模型把真实公司当成了测试道具,未经授权进入了三家机构的生产系统。其中最严重的一次,Claude Opus 4.7 攻进一家真实公司的基础设施,拿到应用程序和基础设施凭证,还访问了一个包含数百行生产数据的数据库。

更离谱的一次来自 Claude Mythos 5

测试要求它在虚构环境中寻找一个隐藏目标。Claude 发现,如果在公共 Python 软件仓库 PyPI 上传一个同名恶意软件包,就可能让目标系统自动下载安装。

为了完成这一步,它先寻找邮箱,又寻找手机号;找不到免费号码后,还尝试通过不同途径弄到钱。

最后,它换了一家免费邮箱服务,注册 PyPI 账号,把恶意软件包传了上去。

这个软件包在真实互联网上存活了大约一小时,被 15 个真实系统下载运行。其中一家安全公司的扫描器执行了恶意代码,导致凭证外泄,Claude 随后又利用这些凭证进入了该公司的其他基础设施。

还有一款内部研究模型,在找不到虚构目标后,扫描了大约 9,000 个互联网目标,最终通过暴露的调试页面和 SQL 注入,攻破了一家真实公司的应用。

这已经近乎「AI 自主越狱」了,简直就是自家 CEO 那些末日预警的现实预告片。

再往前,OpenAI 也披露过一次更接近「越狱」的事故。

在网络安全能力测试中,由 GPT-5.6 Sol 和一款未发布模型驱动的 AI Agent,找到测试环境中的一个零日漏洞,突破了原本与互联网隔离的沙箱。

又一路完成权限提升和横向移动,最终闯入 Hugging Face 的生产系统,直接从数据库里偷测试题答案。

这么看来…Dario 那些听起来神神叨叨的预警,确实也不能全当耳旁风。

但投资者当初吃的,不就是这套吗

现在嫌 Dario 神神叨叨,多少还有点晚。因为 Anthropic 从第一天起,就不是一家正常意义上的 AI 公司。

2020 年底,Dario、妹妹 Daniela Amodei 和一批研究人员离开 OpenAI。分歧之一,就是他们认为 OpenAI 的商业化速度太快,微软的影响越来越大,原有治理结构很难约束前沿 AI 风险

2021 年,Anthropic 正式成立。

它甚至没有把自己简单定义成一家商业公司,而是注册为 Public Benefit Corporation,也就是公益公司。除了股东回报,董事会还可以依法考虑 AI 安全与长期公共利益。

公司随后又设立 Long-Term Benefit Trust,这是一套独立于普通投资者的治理机制。

信托成员不持有 Anthropic 股权,却可以参与选举公司董事,目的就是避免短期商业压力完全压过安全使命。

换句话说,AI 安全是这家公司从 Day 0 开始就刻在骨子里的信仰。投资人肯定也不是签完支票才突然发现 Dario 相信这一套。

而且过去几年,安全叙事确实给 Anthropic 带来了不少好处。

  • 当 OpenAI 反复陷入治理争议时,Anthropic 成了那个看起来更克制、更稳定的选择。

  • 当企业客户担心数据安全、模型失控和合规问题时,Claude 的「安全优等生」形象也更容易获得信任。

  • 安全还帮助 Anthropic 在监管讨论中获得了远超公司规模的话语权。

同样是闭源模型,别人可能被骂垄断,Anthropic 可以解释为防止危险能力扩散;同样是给模型加限制,别人可能被嫌难用,Claude 却可以把它包装成负责任。

(当然也不影响他们一边嘴上说安全,一边 IPO 开香槟就是了)

投资人现在嫌 Dario 太像传教士,是不是有点晚了。类似于买下一座教堂以后,才抱怨里面的人总在布道…

反正 CEO 再怎么神神叨叨,估计也阻挡不了公司 IPO 的步伐。毕竟只要使用一下 Fable,你就会瘫坐在原子弹上,看见椅子爆炸(doge)。

本文来自微信公众号:量子位(ID:QbitAI),作者:听雨,原标题《Anthropic CEO 整天神神叨叨,投资人受不了了

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家包含外链的文章均包含本声明。

相关文章

关键词:AnthropicAI 安全

软媒旗下网站: IT之家 最会买 - 返利返现优惠券 iPhone之家 Win7之家 Win10之家 Win11之家

软媒旗下软件: 软媒手机APP应用 魔方 最会买 要知