做了大半年爬虫和浏览器自动化,工具试了一圈,说说真实感受。 playwright 自己写脚本维护挺累的,网站改版就得跟着改;碰到人机验证基本过不了,这是它本身的限制。接 LLM 的方案思路不错,但 token 消耗是个问题,项目要跑量的时候比较明显。 后来用了 BrowserAct CLI,先说安装,一行命令: uv tool install browser-act-cli --python 3.12 几个特性用下来印象比较深。 一是 stealth 浏览器模式,内置反爬绕过。之前碰到 Cloudflare 这类验证要手动处理,用这个基本能过。 二是它不读整页 HTML,只把页面的交互元素暴露给 LLM。输入量小了,token 消耗自然跟着少,这个逻辑上是直接的。 三是内置验证码解决,不用额外接第三方服务。 当然不是银弹,复杂场景还是要自己调。但浏览器自动化最常卡的几个地方——反爬、验证码、token 控制——这个工具的设计方向是对的。 如果你也做这块,用的什么方案,评论区聊聊。#自动化 #效率神器 #AI工具