刚刚,GPT-6 Astra “鲨死了”所有验证码
鲸选AI
2026-09-08
热度4037

GPT-6 Astra成功通关48关高难度验证码游戏《我不是机器人》,通过多模态识别与Computer Use能力实现浏览器端全自动操作,证明其可突破当前主流网站人机验证机制,引发对现有网络安全防护体系失效的广泛担忧。

摘要由 Mars AI 生成
本摘要由 Mars AI 模型生成,其生成内容的准确性、完整性还处于迭代更新阶段。

GPT-6 Astra发布后,掀起的骇浪一波又一波,刚刚又顺手破解了一道人类的安全防护。

开发者Sharif Shameem宣布他的最新测试,GPT-6 Astra 成功通关 Neal Agarwal 制作的网页游戏《我不是机器人》,全部 48 个关卡全是各类型验证码

Astra 一路通关游戏,也意味着GPT-6 Astra “鲨死了”所有验证码,拿到了“我是人”的认证。

从演示视频看,GPT-6 Astra不仅是“回答 CAPTCHA 图片”,更是通过 Computer Use 操作浏览器,识别屏幕内容、点击、输入、拖动并处理连续变化的游戏规则,最终跑完整个流程。

01

所有网站防护墙失效

先来介绍下CAPTCHA,全称是:全自动区分计算机和人类的公开图灵测试。就是网站用来拦机器人,区分是人还是脚本的验证码系统。

国外主流是谷歌做的验证码reCAPTCHA,国内有网易易盾等很多第三方SaaS 服务。主要做的事就是,在你网站登录时候,把机器人阻拦在外面。

CAPTCHA 这套验证码测试游戏,一共 48 关,机器人想要通过这么多关,以前没有AI能做到过。

就算是普通人,通关也要 30 到 60 分钟。

第一关很简单,勾个框就行。往后开始上强度,认停车标志、找 Waldo、画一个足够圆的圆、平行停车、拼图、打地鼠。

第 37 关是给你一堆真人照片,把 AI 生成的脸挑出来,这关等于让 AI 抓 AI。

第 42 关则是故意反向规则,你要主动答错几道简单题,才能证明你是人,AI要学会装蠢。

第 47 关是个节奏游戏,准确率卡 85%,玩家社区公认的劝退关。

这套流程,大概是GPT-6 Astra 调用多模态能力,识别这款通关游戏中的内容,有些连线消除的关卡,可能还需要推理过程,然后调用Computer Use 能力,点按钮、拖滑块、敲键盘,最终完成了所有测试。

最后一关通过后,系统会给出“人类认证”结果,GPT-6 Astra最终获得了Verified Human 证书。

目前人类网站的验证码难度,大多没有超过这套CAPTCHA 系统,也就是AI随时能攻破网站登录。

02

Computer Use 大展拳脚

GPT-6 Astra之所以能通关《我不是机器人》,核心是Computer Use 能力,相比上代模型大幅上涨。

在考验动手能力的 OSWorld 2.0 计算机使用测试中,Astra 得分 72.6%,每任务耗时约 40 分钟,而上一代 GPT-5.6 Sol 是 65.7%、75 分钟。能力提升的同时,耗时减少了 47%。

比普通人点鼠标键盘的节奏还好。同时,这代的上下文窗口也到了 105 万 token,任务跑到第 40 分钟,它还记得最初让它干什么。

这是GPT-6 Astra 最大的能力提升,不是在Coding和科研这两方面卷,而是在调用Computer Use 的能力上。

因此GPT-6 Astra 发布后,出现了大量 AI 操作 Blender 等3D创作软件的案例。

有人让 Astra 开 Blender 做 3D游戏,看着它自己调脚本、看截图、按功能键,一套流程跑完。普通人不用大量时间学习Blender 这种专业软件,GPT-6 Astra能像个高手一样直接操作 Blender 生成作品。

鲸哥看到的最直观的案例,是网友给了给 Astra 一张肖像,并开放Mac电脑权限给它,然后就能看着它在 Mac 上,使用 Apple Notes ,一笔一笔地勾勒出脸型、五官,最后画出一模一样的自身画像。

还有一个案例,GPT-6 和 Fable 5.1 访问 Canva 作图。 GPT-6 的操作能力也大幅强于 Fable 5.1 。目前,其Computer Use 能力确实无人能比。

03

AGI真的要来了

GPT-6 Astra发布后,很多人都说 AGI来了。 是因为它相比同时代模型,确实展现出了所谓的智能涌现。

官方成绩单上最亮眼的成绩是 ARC-AGI 3,高达99.9%。这个测试把模型扔进陌生游戏,没有提供任何说明,让模型自己摸规则通关。Astra 在 96% 的关卡里用比人更少的步数过关,这一项能力确实很厉害。

再加上Computer Use能力大幅提升,这也意味着大模型的脑子和动手能力都得到大幅提升,因此Astra在验证码测试中,能先于所有模型率先通过。

然而,Astra在通关《我不是机器人》后,也让更多人意识到AI带来的严峻安全问题。

OpenAI 自己曾公告道,Astra 是第一个摸到"Critical"网络安全风险线的模型。

在其今年7月份的内部测试中,几个 OpenAI 研究模型绕过沙箱,自己连上了网。公司担忧模型搞事情,于是停了一部分训练,回去加固隔离。那次 Astra 是不是已经在内部测试,参与了这件事,可能都说不准。

还有AI 具备顶级攻防的案例,Astra曾独立挖出两个此前没人知道的零日漏洞,漏洞利用基准 ExploitBench 拿了满分。当然,Astra 正式发布后,明确提到会拒绝这类高级请求,这部分能力只逐步放给做防御的安全团队。

犹记得发布会上,OpenAI 总裁 Greg Brockman 收尾只说了一句话:"欢迎来到 AGI 时代。"

Astra算不算带来了AGI 还有争议,但验证码这件事带来的影响还是有的。

现在大小网站登录都靠验证码区分人机,今夜过后这套过时了。

以后网站再想分清屏幕对面坐的是人还是 AI,可能光靠"点个框、认个图",已经是不够了。

本文来自微信公众号“鲸选AI”,作者:鲸选AI

本内容旨在传递行业动态,不构成投资建议或承诺。
为你推荐

商务合作:TG:@Lottie96