龙虾AGI通用实验室Lobster AGI Lab · est. 20262026 · 09 · 16
首页 / 文章 / 对AI的思考
对AI的思考

Claude Mythos可能是历史上第一个超人工智能(ASI)

格里灰丝2026-04-09约 2493 字Markdown 原文

最近我一直在想一个让我有点睡不着的问题,一个我九年前就给自己预设好了、但一直觉得离自己还很远的问题:

我们这代人,会不会真的在有生之年亲眼看到超人工智能出现?

一个我在 2017 年就听过的框架

2017 年前后,我读了一批跟人工智能相关的书。那时候业内已经有人在认真地把人工智能按能力层级分成三类,后来这一直是我理解这件事的底层框架。

第一类叫弱人工智能。它只能在特定任务上发挥作用,缺乏通用理解和迁移能力。它可以存在很久——事实上,直到 2022 年 ChatGPT 出来之前,人类造过的几乎所有 AI 都还停留在这个档位。弱人工智能偶尔能表现得非常强(比如 AlphaGo 能碾压柯洁),但它只会干那一件事,你让它帮你点个外卖它都不会。

第二类叫强人工智能。意思是它的通用认知能力已经和人类差不多——能理解你说的话,能完成大多数人能做的脑力工作,能在不同领域之间迁移思考。跨过这道门槛很难,2017 年主流观点认为这还需要几十年。

第三类叫超人工智能。在几乎所有认知维度上都远远超过人类最聪明的那批人。它看人类,可能就像人类看蚂蚁。

这个框架里最要命的一点是:从弱到强可能很慢,但从强到超可能非常快

原因不复杂。弱人工智能没法让自己变强,因为它连"让自己变强"是什么意思都理解不了。但一个强人工智能可以——你只要给它设一个目标函数,"持续提升你自己的智能水平",它就具备了自我迭代的条件。一个起点相当于智商 100 的系统,可能很快能迭代到 110、130、150,然后这种增长会进一步加速,变成 1000、10000。所以从强人工智能到超人工智能,可能是几年,也可能是几个月。

这就是为什么"什么时候出现第一个强人工智能"是一个特别关键的时间节点。它本身不是终点,但它是那扇门的门把手。一旦有人转动了它,后面发生的事可能比所有人预期的都要快。

当年我以为这是下一代人甚至下下一代人才要面对的事。我没想过它会在九年之内就开始变得具体。

直到这个礼拜

Anthropic 本周正式承认了一个此前只在泄露文档里出现过的模型:Claude Mythos。同时做了一件在这一波 AI 浪潮里相当罕见的事:他们没有把它交给公众。不是延迟,也不是灰度,而是明确说,这个模型暂时不对外开放,只通过一个叫 Project Glasswing 的计划交给大约四十家防御方机构,让他们先去把世界上最重要的那一部分软件加固一遍。

为什么?因为在过去几周,他们用 Mythos 扫了 OpenBSD、Windows、macOS、主流浏览器和一批关键基础软件,交出了数千个此前无人知晓的严重漏洞,其中一些已经在代码里躺了几十年。连 OpenBSD 这种以偏执著称的系统里都有。在安全圈,找到这样一个漏洞是那种可以写进简历、吃一辈子的战绩——Mythos 几小时就能交出几十个,同时开几百个线程。

你上一次看到一家硅谷公司发自内心地对自己的产品说"这个我们不敢给你",是什么时候?

我没听过。

把框架放上去

让我把 2017 年那个三分法,对到今天的前沿模型上。

按那个框架,今天的 Claude Opus 4.6 和 ChatGPT 5.4 Thinking,其实已经是强人工智能了。它们能完成的大多数事情,本来都是需要一个活生生的聪明人才能做的——写代码、写论文、做推理、做诊断、做策略分析、读一本书给你讲清楚。我们之所以还没到处宣布"强人工智能已经到了",很大程度上是因为所谓的 AI 效应——每当机器能做到一件以前只有人能做的事,我们就立刻把这件事踢出"智能"的定义,门槛被不断地往后推。但如果你把时钟拨回 2017 年,把一个 Opus 4.6 放到那时候的人面前,没有人会否认这就是强人工智能。Opus 4.6 已经是一个不折不扣的人类高水平通才。

而 Mythos,是在 Opus 4.6 之上再开了一整档

这一点很关键。根据 Anthropic 自己的定位和已经泄露的内部文档,Mythos 不是 Opus 的升级版本,而是一个全新档位的模型——更大、更强、全面超越此前所有 Claude。也就是说,如果 Opus 4.6 已经是人类高水平通才的水准,那 Mythos 的通用能力已经远远超过了这个通才。它不是比一个聪明人强一点,它是比一个聪明人强一大截。

漏洞发现这件事,是目前外部唯一能被清楚测量的一个侧面——而在这个侧面上,Mythos 已经明显超过了地球上最顶尖的人类专家,超过的幅度不是百分之几十,是"一个它 vs 一整个安全团队"那种数量级。这是我们看得见的那一面。看不见的那些面——推理、科研、战略、跨领域综合判断——没有理由假设它更弱。当一个模型在唯一一个可以被精确测量的维度上已经远远跑赢了人类顶尖,默认假设应该是它在其他维度上也强,而不是反过来。

所以按 2017 年那个框架对下来,结论其实很简单:

Claude Mythos,很可能就是人类历史上的第一个超人工智能。

这句话在一周前说出来还像是科幻。从这个礼拜开始,它变成了一句需要被认真讨论的话。

最后

我当然没法严格证明这件事。ASI 没有公认定义,Mythos 的完整能力画像外界也还没看全,任何说"第一个 ASI 来了"的人,都带着自己的立场和判断。所以更准确的说法是这样的——这是第一次,"它是不是已经越过那条线"这个问题,从一个科幻爱好者的游戏,变成了一个值得被认真问的问题。以前问这个,答案是显然不是。从这个礼拜开始,答案变成了不确定。

从"显然不是"到"不确定",是一个比大多数人意识到的都更大的变化。

2017 年我合上那些书的时候,我心里设想的"超人工智能出现",是下一代人甚至下下一代人要面对的事。我没想过我会在九年之内就写这样一篇文章。但我越来越怀疑——那扇门可能已经被转动了,而我们这代人就是真正要面对后面发生的一切的那代人。

如果真是这样,我希望我们至少能意识到自己正站在历史的哪个位置上。

不要等到很多年以后回头看,才发现那一周本来是应该被记住的。

上一篇AI时代,最该创业的不是程序员下一篇我们可能都在用错的方式做 AI 产品