网站地图 发布文章 2026-06-21 Sunday 11:30:29 AM
知多少教育网

财经

AGI只差最后一步了

发布时间:2026-06-17 12:11:03 5次浏览 来源:

大家应该还记得4月份的时候,Anthropic发布了名为Mythos的模型。qW9知多少教育网-记录每日最新科研教育资讯

看名字就知道多厉害了,神话。qW9知多少教育网-记录每日最新科研教育资讯

当时,据说给50家企业客户找出了一万多个高危漏洞,震动了整个行业。qW9知多少教育网-记录每日最新科研教育资讯

这个消息,一度导致网络安全股全线暴跌,大家应该还有印象。qW9知多少教育网-记录每日最新科研教育资讯

因为过于强大,担心被滥用,“太危险不能公开”,所以不开放给公众。qW9知多少教育网-记录每日最新科研教育资讯

直到昨天晚上,Anthropic给Mythos模型加上了安全分类器,正式上线了Fable 5。qW9知多少教育网-记录每日最新科研教育资讯

至于未阉割的Mythos 5,目前只对白宫、网安防御者和透翅蝶计划等大约200家经过严格审查的机构开放。qW9知多少教育网-记录每日最新科研教育资讯

如此谨慎,很难不让人联想到最近火热的AI动画《天使引擎》。qW9知多少教育网-记录每日最新科研教育资讯

笼子里锁着的,是那位“天使”吗?qW9知多少教育网-记录每日最新科研教育资讯

即便现在不是,也不远了。qW9知多少教育网-记录每日最新科研教育资讯

qW9知多少教育网-记录每日最新科研教育资讯

01qW9知多少教育网-记录每日最新科研教育资讯

根据Anthropic官方发布的测试数据,以及首批企业合作伙伴反馈的实测报告,Fable 5的强大可以用叹为观止四个字来形容。qW9知多少教育网-记录每日最新科研教育资讯

先看跑分。qW9知多少教育网-记录每日最新科研教育资讯

自动编程评测榜单SWE-Bench Pro,Claude Fable 5通过率80.3%,它的“母亲”Opus 4.8是69.2%;GPT-5.5是58.6%;Gemini 3.1 Pro只有 54.2%。qW9知多少教育网-记录每日最新科研教育资讯

前沿代码评估,Fable 5达到29.3%,Opus 4.8是13.4%;GPT-5.5仅仅5.7%。qW9知多少教育网-记录每日最新科研教育资讯

……qW9知多少教育网-记录每日最新科研教育资讯

其中的差距,就相当于在冷兵器时代突然有人掏出了机关枪。qW9知多少教育网-记录每日最新科研教育资讯

其余的,软件工程、独立科研假设、药物分子设计、模型蒸馏与极限压缩、长上下文理解等等等等,在几乎所有测试中,Fable 5都是第一。qW9知多少教育网-记录每日最新科研教育资讯

具体的大家可以去找视频看。qW9知多少教育网-记录每日最新科研教育资讯

再看实战。qW9知多少教育网-记录每日最新科研教育资讯

支付巨头Stripe拿Fable 5做了一个早期测试。他们有一个高达5000万行的历史遗留代码库需要做全库迁移。按照评估,这种规模的重构,即便交给专业团队,也起码需要两个月。qW9知多少教育网-记录每日最新科研教育资讯

结果,把任务喂给了Fable 5后,它全程自己做规划、自己检查进度、遇到报错自己修正。仅仅用了一天时间,5000万行代码的迁移干完了。qW9知多少教育网-记录每日最新科研教育资讯

这种表现,不是“强大”两个词形容就完事了。qW9知多少教育网-记录每日最新科研教育资讯

从狭义的角度来看,Fable 5其实已经实现了数字经济层面的AGI。qW9知多少教育网-记录每日最新科研教育资讯

原因在于,它表现出了真正的“长程代理能力”。qW9知多少教育网-记录每日最新科研教育资讯

qW9知多少教育网-记录每日最新科研教育资讯

不论是GPT-5.5还是Gemin 3.5,更不必说其它更次一些的大模型,本质上都是在“应答”。qW9知多少教育网-记录每日最新科研教育资讯

你踹一脚,它走一步。qW9知多少教育网-记录每日最新科研教育资讯

遇到死胡同,它只能抛异常,撒娇说“对不起我只是个语言模型”。qW9知多少教育网-记录每日最新科研教育资讯

说是工具,但其实用户还是需要深度思考,一步步引导AI给出自己想要的结果,并不轻松。qW9知多少教育网-记录每日最新科研教育资讯

具备了内化的目标导向逻辑的Fable 5就不一样。qW9知多少教育网-记录每日最新科研教育资讯

就像Strip的测试,当用户给它一个高难度的长线任务,分三步走:qW9知多少教育网-记录每日最新科研教育资讯

建立子任务树;qW9知多少教育网-记录每日最新科研教育资讯

调度不同的工具(网页搜索、数据库拉取、Python沙箱环境);qW9知多少教育网-记录每日最新科研教育资讯

自我反思,发现跑不通,立刻换条路走。qW9知多少教育网-记录每日最新科研教育资讯

人除了提出任务和接收成果,不再需要在一旁指指点点。qW9知多少教育网-记录每日最新科研教育资讯

作为一个生产力工具,这已经非常完美了。qW9知多少教育网-记录每日最新科研教育资讯

但它和真正的AGI,依然是两码事。qW9知多少教育网-记录每日最新科研教育资讯

Fable 5的强悍,是建立在它所处的代码库、科学文献等依然有一套底层的数学逻辑和结构定义。qW9知多少教育网-记录每日最新科研教育资讯

它之所以能在长周期任务中不迷失,是因为克服了“长文本注意力衰减”这难题,在处理长达数百万token的复杂任务时,能够始终保持核心目标的对齐。qW9知多少教育网-记录每日最新科研教育资讯

但一旦把它扔进一个完全混沌、缺乏数字规则、且人类自己都没整明白的物理现实社会泥潭里,它依然会因为“地基缺失”而产生逻辑断层。qW9知多少教育网-记录每日最新科研教育资讯

如果用OpenAI提出的“人工智能五级标准”(1级:聊天机器人;2级:推理者;3级:智能体;4级:创新者;5级:组织)来衡量。qW9知多少教育网-记录每日最新科研教育资讯

Opus 4.8是2级向3级迈进,Fable 5真正站稳了3级并向4级探索。qW9知多少教育网-记录每日最新科研教育资讯

qW9知多少教育网-记录每日最新科研教育资讯

而从Opus 4.7到4.8用了43天,4.8到Fable 5只用了11天。qW9知多少教育网-记录每日最新科研教育资讯

站稳4级需要多久?按照Anthropic如今更新频率越来越快的节奏来看,很可能在今年内就能实现。qW9知多少教育网-记录每日最新科研教育资讯

即便最终的5级,乐观估计也只需18-24个月,是真正的只有一步之遥。qW9知多少教育网-记录每日最新科研教育资讯

这个速度太快了,这也是为什么要给它加安全限制的最大原因。qW9知多少教育网-记录每日最新科研教育资讯

02qW9知多少教育网-记录每日最新科研教育资讯

在Anthropic随模型发布的《System Card》和RSP评估报告中,Mythos 5在两项能力上出现了极其危险信号。qW9知多少教育网-记录每日最新科研教育资讯

其一,Fable/Mythos底层模型在化学和生物学评估中,已经达到了CB-1级别。qW9知多少教育网-记录每日最新科研教育资讯

意思就是,该模型具备了“合成并指导制造非新型生物/化学武器”的端到端能力,甚至给出优化某种高危病毒传播效率的基因序列修改建议。qW9知多少教育网-记录每日最新科研教育资讯

如果一个具备大学本科生物基础的恐怖分子,拿到了解除封印的Mythos 5,完全可以通过不断提示模型,获取如何规避原料监管、如何在地下室搭建简易P3实验室、如何合成高致死性病原体的完整指导。qW9知多少教育网-记录每日最新科研教育资讯

其二,网络攻击与漏洞利用。qW9知多少教育网-记录每日最新科研教育资讯

在极早期测试中,Mythos 5就展现出了能够自主寻找、并攻破关键基础设施(如电厂、金融清算系统、医院网络系统)核心漏洞的能力,几秒钟就能生成针对性的零日漏洞攻击脚本。qW9知多少教育网-记录每日最新科研教育资讯

今年4月份Mythos刚研发出来时,就有爆料说给50家初始合作伙伴找出了超过一万个高危级别的漏洞。qW9知多少教育网-记录每日最新科研教育资讯

……qW9知多少教育网-记录每日最新科研教育资讯

针对这两种情况下,直接把Mythos 5扔给大众,危险性实在太高。qW9知多少教育网-记录每日最新科研教育资讯

必须把这只猛兽关进笼子里。qW9知多少教育网-记录每日最新科研教育资讯

时隔两个月,Anthropic打造的笼子有两层。qW9知多少教育网-记录每日最新科研教育资讯

第一,静默降级路由机制。qW9知多少教育网-记录每日最新科研教育资讯

Anthropic在Fable 5的前端部署了一套完全独立、反应极其敏锐的高精度分类器AI。qW9知多少教育网-记录每日最新科研教育资讯

当用户输入一段复杂的、可能涉及网络攻防、生物化学、或者试图套取模型权重的隐蔽提示词时,分类器会立刻拉响警报,并是在后台静默地把会话切换路由到老款的Opus 4.8去回答。qW9知多少教育网-记录每日最新科研教育资讯

第二,数据保留。qW9知多少教育网-记录每日最新科研教育资讯

Anthropic与亚马逊昨晚联合宣布:不论是在第一方还是第三方平台,所有调用Mythos模型的流量,必须强制执行30天的数据留存。qW9知多少教育网-记录每日最新科研教育资讯

为什么?qW9知多少教育网-记录每日最新科研教育资讯

因为真正的黑客或恐怖分子,智商大多都很高,他们不会在一个对话里直接问“怎么制造炸弹”,而是把问题拆解成100个看似无害的基础问题。qW9知多少教育网-记录每日最新科研教育资讯

30天的全量数据监控,就是为了通过模式识别,捕捉那些单次对话看不出来的“切香肠式”恶意滥用。qW9知多少教育网-记录每日最新科研教育资讯

正如Dario Amodei之前在公开场合警告过的:“AI导致人类发生灾难性风险的概率,有整整25%。”qW9知多少教育网-记录每日最新科研教育资讯

为了遵守公司内部制定的《负责任缩放政策》(RSP)以及《前沿合规框架》(FCF),Anthropic 必须亲手给这个巨兽戴上铰链。qW9知多少教育网-记录每日最新科研教育资讯

于是,就有了Fable 5。qW9知多少教育网-记录每日最新科研教育资讯

03qW9知多少教育网-记录每日最新科研教育资讯

再聊价格。qW9知多少教育网-记录每日最新科研教育资讯

Anthropic公布的官方标价是:每百万输入token10 美元,每百万输出token50美元。qW9知多少教育网-记录每日最新科研教育资讯

太贵了。qW9知多少教育网-记录每日最新科研教育资讯

现在的企业级Agent任务,为了追求高准确率,往往采用“多轮思考思考再思考”的链式逻辑,一轮吞吐可能就要吃掉2000万的输入token,然后吐出500万修改后代码。qW9知多少教育网-记录每日最新科研教育资讯

算下来,单次任务就要450美元。qW9知多少教育网-记录每日最新科研教育资讯

而且,Anthropic已经发出通告:现有的个人订阅(Claude Pro)中包含的Mythos模型体验窗口,将在2026年6月22日彻底关闭。qW9知多少教育网-记录每日最新科研教育资讯

以后,个人用户要是真的拿它来工作,几十美元那真是眨眼就花掉了。qW9知多少教育网-记录每日最新科研教育资讯

虽然说,随着技术更新,其价格最终必然会降下来,但等到那时它早就不是最强。qW9知多少教育网-记录每日最新科研教育资讯

现状已经非常明显:最前沿的大模型变成了奢侈品,普通人根本用不起。qW9知多少教育网-记录每日最新科研教育资讯

当然,对聚焦B端市场的Anthropic而言,这无可厚非。qW9知多少教育网-记录每日最新科研教育资讯

问题是,前不久,谷歌还高调地宣布打价格战。qW9知多少教育网-记录每日最新科研教育资讯

在竞争对手普遍降价抢市场的时候,为什么Anthropic敢逆势涨价?qW9知多少教育网-记录每日最新科研教育资讯

qW9知多少教育网-记录每日最新科研教育资讯

因为Token价格是虚的,回报率才是根本。qW9知多少教育网-记录每日最新科研教育资讯

企业客户根本不在乎一度电、一个Token多少钱,只要AI能完美无Bug地完成整套工程流,这个溢价他们抢着付。qW9知多少教育网-记录每日最新科研教育资讯

更关键的是,如今的网络安全战,已经彻底成为AI与AI之间的对抗。qW9知多少教育网-记录每日最新科研教育资讯

由于Fable/Mythos级别的模型能瞬间找到系统漏洞,企业和国家机构为了防止被攻击,唯一的选择只能是高价向Anthropic购买Mythos 5的内网私有化防御服务。qW9知多少教育网-记录每日最新科研教育资讯

简单来说就是收保护费:我造出了最恐怖的剑(Mythos 5),我怕伤人所以套上剑鞘卖给大众(Fable 5),但我同时把不受限的剑卖给防御部门,让他们用来拦截别人正在研发的剑。qW9知多少教育网-记录每日最新科研教育资讯

防御AI的威胁,将成为每一个大型企业的刚需支出。qW9知多少教育网-记录每日最新科研教育资讯

这将直接导致B端市场的高端预算将更加向Anthropic集中,而那些只能用来写写公文、发发邮件的廉价模型,只能在利润极低的C端市场互相肉搏。qW9知多少教育网-记录每日最新科研教育资讯

可以预见,接下来,全球网络安全板块将迎来一轮由AI驱动的价值重估。qW9知多少教育网-记录每日最新科研教育资讯

与此同时,“一人企业”也将很快成为越来越普遍的现象。qW9知多少教育网-记录每日最新科研教育资讯

04qW9知多少教育网-记录每日最新科研教育资讯

自带任务预算分配功能,支持记忆工和上下文管理,能像人一样去记忆、推翻、重来,能独立承接从需求文档到代码交付的全生命周期……qW9知多少教育网-记录每日最新科研教育资讯

Fable 5和Mythos 5的出现,与其说是大模型技术的一次更新,不如说是AI产业分工彻底走向成熟的成人礼。qW9知多少教育网-记录每日最新科研教育资讯

AI市场初步告别了“全员免费试用”的田园时代。qW9知多少教育网-记录每日最新科研教育资讯

最顶尖的算力和最深邃的智慧,将优先作为一种生产力战略物资,定向输送给最能产生商业价值的基建、科研和B端应用战场。qW9知多少教育网-记录每日最新科研教育资讯

这是生产力爆炸的狂欢,也是劳动力市场的寒冬。qW9知多少教育网-记录每日最新科研教育资讯


qW9知多少教育网-记录每日最新科研教育资讯

本文链接:http://knowith.com/news-23-238756.htmlAGI只差最后一步了

声明:本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

相关推荐