GPT-6 让 48 个网页验证码失效了,最聪明的 AI 和最笨的人类相遇了

GPT-6 让 48 个网页验证码失效了,最聪明的 AI 和最笨的人类相遇了

💡 原文中文,约2900字,阅读约需7分钟。
📝

内容提要

GPT-6成功通关网页游戏「我不是机器人」全部48关,表明传统验证码已难以阻挡AI。研究显示,机器人识别验证码的准确率可达85%至100%,超过真人。行业正转向Cloudflare Turnstile等无感评分机制,通过行为分析判断人类概率。然而,AI爬虫流量激增使人机界限日益模糊,验证难题背后更需关注授权与异常行为的管控。

🔎

延伸解读

验证码失效背后的技术拐点

GPT-6通关48关「我不是机器人」游戏,并非偶然。文章指出,现代计算机视觉模型识别扭曲文字、图片验证码的准确率已达85%至100%,而真人表现仅50%至85%。这意味着传统验证码依赖的「人能轻松认出、程序看不懂」的能力差已基本消失。验证码的设计前提被动摇,行业不得不转向行为分析等新思路。

无感验证的代价:误判与不透明

Cloudflare Turnstile、reCAPTCHA v3等无感评分机制不再出题,而是给每次访问打0到1的人类概率分。这减少了用户操作,却带来新问题:Cloudflare排障文档承认,真人可能因浏览器扩展、代理或网络环境陷入反复验证,且用户往往不知道被挡原因,只能反复刷新。可见的难题消失后,换来的是一套难以理解、也无从申辩的判断。

人机界限模糊后的管控重点

文章强调,人与机器已不总是对立关系。AI助手替用户查票、订酒店时,技术上是机器人,意图却正常;一概拦截会损失便利,仅凭答对图片放行又无法确认授权与滥用风险。同时,真人也会发垃圾信息、倒卖门票。因此,验证难题背后,授权能否撤回、异常行为能否及时停止,应和人机识别一样被纳入产品设计。

Q&A

GPT-6 在「我不是机器人」游戏中表现如何?

GPT-6 成功通过了「我不是机器人」游戏中的所有 48 个关卡。该游戏由独立开发者 Neal Agarwal 制作,随着关卡推进,任务会变得越来越离谱,比如在涂鸦墙里找到威利、玩「西蒙说」、画一个完美的圆,甚至让你和「女友」分手、停车入位。

为什么传统的验证码越来越难以阻挡AI?

传统验证码依赖人类能轻松识别而程序难以理解的能力差,但现代计算机视觉模型识别扭曲文字、图片验证码的能力已经很强。2023年一项USENIX Security研究显示,在有数据可比的题型中,机器人准确率达到85%至100%,而真人表现仅在50%至85%之间。2024年苏黎世联邦理工学院的研究也证明Google的「我不是机器人」复选框很容易被针对性攻破。

行业正在转向什么样的新型验证方式?

行业正在放弃「出题」型验证码,转向Cloudflare Turnstile、reCAPTCHA v3这类「无感」评分机制。这些系统不再问用户问题,而是通过行为分析给每次访问打一个0-1的人类概率分。例如维基百科放弃了字符验证码,改用主要依赖行为分析的hCaptcha服务,只有约千分之一的用户会面临视觉挑战。

Cloudflare 对 AI 爬虫采取了哪些新措施?

从2026年9月15日开始,Cloudflare将默认拦截混用型(既做训练又做搜索)的AI爬虫在带广告的页面上抓取。此前,Cloudflare还推出过「按次付费爬取」模式,允许网站出版商向AI爬虫收取抓取内容的费用。

为什么人机验证变得越来越复杂?

因为一些公司试图阻止能够发布垃圾信息或抢购门票的机器人,机器人涌入会让真正的顾客处于不利地位,甚至导致网站崩溃。同时,攻击方的能力提升速度远快于防御方能承受的用户体验成本,好的验证码设计要像「防熊垃圾桶」一样,挡住最聪明的攻击者同时放行能力最弱的真人。

新型验证方法可能带来哪些问题?

新型验证方法可能要求用户开放摄像头权限或扫描二维码,对于普通访问是否值得开放摄像头权限存疑。此外,后台验证可能导致真人陷入反复验证,浏览器扩展、代理和网络环境都可能影响挑战完成,用户被误判后往往不知道如何申诉,只能反复刷新页面。

🏷️

标签

➡️

继续阅读