这个话题我也在播客里聊过:逆向验证码:互联网正在悄悄「赶走」人类,只欢迎 AI?(《AI 茶水间》)。
网站的验证码一般用来确认访问者是真人,不是机器人。
现在,开源的浏览器操作库 Browser-use 提出了逆向验证码的概念——这种验证码阻挡真人、放行 AI,用于那些只供 AI 使用的接口。
它长什么样呢?是一道被大写字母、随机字符和空格搅乱的数学题。真人看着一片乱码,读都读不通,自然无从作答。但大模型能把这些噪声剔掉,还原出原始题目:
两列火车在长度为 d 的直线轨道上以速度 v1 和 v2 相向而行。一只鸟以速度 vb 从一列火车出发,飞到另一列火车上,然后掉头飞回来,如此反复,直到两列火车相遇。这只鸟一共飞了多远?
读懂题目,调用公式,算出答案,通过验证。
这个东西本身挺好玩的,但真正值得聊的是它背后那条经济逻辑。
#先问:正向验证码为什么存在
我们平时见到的验证码,前提假设是人是有价值的访问者,机器是低价值甚至破坏性的流量。
它的意义体现在两方面:
经济价值的保护。 真人会点击、消费、付费,产生正面经济价值;机器流量则是来抓数据的,对经济价值造成损害。验证码把有价值的流量筛进来,把机器挡在外面。
安全层面的防护。 机器发起的高频请求、撞库、刷接口,会对服务器造成实打实的损耗。验证码相当于一道关卡。
一句话:验证码是一个价值过滤器。
#逆向验证码推出了什么结论
如果正向验证码的前提是”人的价值 > 机器的价值”,那把它反过来,结论就只能是:
在这些场景里,人的流量价值小于机器的流量价值。
人访问反倒成了一种负担,网站更希望机器来。机器能创造收益,人不行。
这个结论听起来刺耳,但顺着成本算一遍,它其实很自然。
#为 AI 而生的东西会越来越多
现在的互联网,越来越多的部分是为 AI 设计的。
以前的小工具去网上抓数据,用的还是给人看的网页。那种页面源码非常杂乱,渲染一次可能要请求几兆的数据。但同样的信息交给 AI 处理,完全不需要这么多——可能几十 K 就够了。
这是上百倍的差距。
流量是要花钱的。如果一个网站能省下几百倍的流量成本,每个月省下来的是真金白银。所以只要接入方是 AI,成本就低得惊人。
因为成本极低,未来会出现大量”为 AI 而生”的东西:
- 这类产品出现后,可能根本不需要人来访问,只希望机器来
- 人访问进去反而没有意义,甚至会困惑——网站展示的就是一堆纯文本,人会觉得”你堆这一堆文字到底要干嘛”
人被挡在外面,是有原因的:纯文本对 AI 有巨大优势。新时代的一部分价值,可能不再为人提供,而是专门为 AI 提供。
想想现在信息的价值在哪里。比如小红书,内容是封闭的,你查东西只能跳进 App 里查,没法让 AI 助手帮你搜。这其实不利于信息流通。未来如果要开放,肯定需要一个专门给 AI 的纯文本接口——一条帖子就是一行文字,按访问次数给 AI 定价。一旦付费就有成本,就需要机制把钱收走,就需要信用体系来限制程序化访问。
#但这个方案本身可能很短命
有意思的是,验证码这道题你丢给 AI,它是能算出来的。就像 256 × 357 你一眼算不出来,但你可以用计算器。
所以它更深一层的意思其实是:你作为人确实能访问,但我要让你意识到,这地方你没必要来。 这点成本对 AI 只是一点点,对人却足以形成劝退。
可正因为如此,我觉得它活不长。
对程序来说,这种验证码没什么意义——它可以识别,也可以不识别,而且有成本更低的方式。如果我是那个发号施令的人,我会说别折腾了,直接用 API。
纯 AI 网站根本不需要这种验证码:
- 只需要一个访问标记,标明你是个 Agent
- 验证这个标记就行,不必再传一张图片、再花流量和算力去解析
它真正的使用场景很窄:某些网站既有人类可读区,也有 AI 可读区,为了防止人类误入 AI 区域造成困扰,才需要这么一道门。
所以它更像一个噱头——既要给人看,又要让机器进,中间那点张力挺尴尬的。我猜它未来会隐到幕后,被成本更低的东西替代。
#那 Browser-use 为什么要提这个概念
这才是最有意思的部分。
先看清楚 Browser-use 是谁。它的核心价值是让 AI 去操作那些原本给人用的网页。它每天做的事,就是让 Agent 点按钮、填表单、绕弹窗,甚至偷偷摸摸解掉验证码。它整个产品存在的前提是:Web 是为人设计的,Agent 必须假装成人才能用。
理解了这点,就能看出三层意思。
第一层是吐槽。 最可能的情况是他们团队被验证码折磨够了。一次次被网站逼着证明”我是个人”,于是干脆反过来说:好,我是 AI,只有我能访问。
第二层是营销。 长期以来大家默认 AI 流量是垃圾流量、是有害的。提出”逆向验证”,等于宣告:这块地是专门给 AI 的。在这个语境里,Agent 成了一等公民,人反而其次。大家会开始意识到——原来真有充分的 AI 服务需求,以后设计网站是不是该单独留个 AI 入口?
第三层,也是最关键的:它把网站拉进了合作空间。 原本 Agent 和网站是对抗关系。一旦网站开始考虑”要不要给 Agent 留个入口”,这些 Agent 开发商就从行业的对立面(攻击者)转变成了推动者,以协议中介的姿态出现。
这件事的意义不在技术,而在姿态。它是在为一个被当下互联网所鄙弃的角色——AI 爬虫——说话:
- 我们不该一直隐瞒身份
- 我们不该一直伪装成人
- 互联网应该为 Agent 留出空间
而且由 Browser-use 来说这句话是最合适的。网站方有动机规范流量但缺乏话语场,用户方不可能主动提这种需求,只能由这样一个既感受过痛苦、又身处行业内、能平衡两边对立的第三方来发声。
#最后
真正魔幻的地方在于:互联网作为一个公共空间,第一次出现了明确不为人服务的部分。
我相信这只是一个过渡层。但对于这类新鲜事物,概念是谁提出来的、概念本身说了什么,往往比技术实现更重要。