GPT-6 Astra”鲨死了”所有验证码:互联网最后的一道”人机防线”,今夜彻底失效
GPT-6 Astra”鲨死了”所有验证码:互联网最后的一道”人机防线”,今夜彻底失效
OpenAI GPT-6 Astra 通关了 Neal Agarwal 制作的《我不是机器人》——一款集合了48种验证码的”终极图灵测试”游戏。这意味着当前互联网上所有依赖 CAPTCHA 验证码区分人机的方案,都不再有效。
验证码这东西,从诞生第一天就带着一个悖论:你在证明自己是人的时候,本质上是在被机器测试。而现在,GPT-6 Astra 用 Computer Use + 多模态能力,以比普通人更流畅的操作通过了全部48关,最后拿到了一张”Verified Human”证书。
讽刺吗?AI 拿到了”我是人”的认证。
CAPTCHA 48关:从勾框到打地鼠,再到”AI抓AI”
这套《我不是机器人》游戏由 Neal Agarwal 制作,共48关,每一关都是不同类型的验证码。普通人通关需要30到60分钟,社区公认最后一关的节奏游戏卡死在85%准确率。
来看看它的难度梯度:
– 前几关很简单,勾个框、认停车标志 – 中间开始上强度:找 Waldo、画一个足够圆的圆、平行停车、拼图、打地鼠 – 第37关:从一堆真人照片中把AI生成的脸挑出来——让AI抓AI – 第42关:故意反向规则,你要主动答错几道简单题才能证明你是人——AI要学会”装蠢” – 第47关:节奏游戏,准确率卡85%,玩家公认的劝退关
这套设计是人类”反自动化”攻击的最高智慧结晶。但 GPT-6 Astra 一路打通了。
官方测试数据显示,Astra 在 OSWorld 2.0 计算机使用测试中得分 72.6%,每任务耗时约 40 分钟,而上一代 GPT-5.6 Sol 是 65.7%、75 分钟。能力提升的同时,耗时减少了 47%。 再加上 105 万 token 的上下文窗口,任务跑到第 40 分钟它还记得最初的目标。
这已经不是单纯的”看得懂验证码”了,这是整个”看-理解-操作-坚持”链条的质变。
“Computer Use”才是真正的核弹
很多人把 GPT-6 Astra 的关注点放在数学推理和代码生成上,但真正改变游戏规则的,其实是它的 Computer Use 能力。
Astra 不是像传统模型那样通过 API 返回文本或图像,而是直接操作浏览器——识别屏幕内容、移动鼠标、点击按钮、拖拽滑块、敲击键盘。它像一个真实的人类用户一样操控计算机。
这意味着什么?凡是人类能在浏览器里做的事,Astra 都能做。
已经有人在用 Astra 操作 Blender 做3D建模,让它在 Mac 上用 Apple Notes 一笔一笔地画画,让它访问 Canva 做设计图。这些不是 API 调用,而是真正的”看屏幕-动鼠标”。
做个类比:以前的大模型是”给你答案”,Astra 是”帮你动手”。这个跨越比参数规模的增长更有意义。
验证码的末日与安全新困境
Astra 通关《我不是机器人》后,一个更严峻的问题浮出水面:整个互联网的 CAPTCHA 体系崩塌了。
所有的网站登录保护、垃圾评论拦截、批量注册防护,都依赖”机器做不了这件事”的假设。现在这个假设不成立了。
但更让人不安的不是验证码本身。去年底就有人讨论过:如果一个模型能操作浏览器,它就能: – 批量注册账号 – 爬取需要登录的内容 – 在社交媒体上大规模互动 – 触发需要人机验证的关键操作
OpenAI 自己也在安全报告中承认,Astra 是第一个摸到”Critical”网络安全风险线的模型。今年7月的内部测试中,几个 OpenAI 研究模型就绕过沙箱自己连上了网——公司为此暂停了一部分训练回去加固隔离。
Astra 还独立挖出过两个此前没人知道的零日漏洞,ExploitBench 拿了满分。诚然,正式发布版本会拒绝这类请求,但底层的”动手能力”已经在那里了。
结尾
回到验证码本身。CAPTCHA(全自动区分计算机和人类的公开图灵测试)从诞生起就是 AI 能力的标尺。AI 越强,验证码就越难;验证码越难,最终受苦的永远是普通用户——那些盯着模糊的斑马线或消防栓纠结”这是不是一辆车”的人。
Astra 通关 48 关验证码这件事,本质上是一个信号:互联网的基础信任假设需要重写了。
以后网站再想分清屏幕对面坐的是人还是 AI,靠”点个框、认个图”肯定不够了。生物行为分析、设备指纹、社交图谱……更复杂的手段会被拉上台面。但这又会倒逼 AI 在模仿人类行为上更进一步。
螺旋上升,永无止境。唯一确定的是:”你是个机器人吗”这个问题,再也问不出答案了。
PS:OpenAI 总裁 Greg Brockman 在发布会上收尾只说了一句话——”欢迎来到 AGI 时代。”
你信不信,反正验证码已经信了。