6月份有意思的东西挺多。美团旗下的GN06团队发了个AI原生浏览器,叫Tabbit 1.0,而且承诺标准版永久免费——每周大概1000次对话、50张图、10个Agent任务,不要钱。
差不多同时,开源社区也冒出来一个叫Opensteer的框架,能让AI直接操控浏览器干各种活。
这俩东西放在一起看,其实指向同一个方向:当AI能力被嵌到离数据最近的地方——浏览器——很多事情就要变了。

以前是“人肉搬运”,现在AI替你干
搞过数据采集的人应该都懂那种痛苦:看到一个网页想分析,先复制内容,切到AI工具,粘贴,等回答。想换个平台看,再来一遍。想多个平台对比,基本等于重复劳动。
Tabbit的思路挺直接的——你浏览网页的时候,点一下右上角的"Chat"就能呼出AI,直接基于当前页面提问,不用复制粘贴。更厉害的是,AI可以同时引用多个网页甚至本地文件夹,秒变Agent模式直接开始干活。
有人拿它读论文,说原来3-4小时的工作,现在20分钟搞定。
Opensteer那边更激进,它给AI智能体塞了一个真正的Chromium浏览器,支持持久化会话、网络捕获、隐身功能。AI自己能打开网页、点按钮、提取结构化数据、甚至生成爬虫代码。
说白了,以前是人去适配机器,现在是机器替人干活。
效率提升不是一点点
仔细看了下Tabbit的数据,挺有意思。
公测的时候Agent成功率是53.1%,到1.0版本已经干到91.8%了。而且单用户月均Token使用量到了853万——这个数字说明用户是真的把它当生产力工具在用,不是拿来玩玩而已。
三个维度说说它到底提升了什么:
采集自动化。 AI知道你想要什么,自己定位目标字段,自己提取整理。不用你告诉它"第三行第二个单元格是什么",直接说"把这几家酒店的价格和评分整理出来"就行。
多模型协同。 Tabbit塞了十多个国产大模型进去——DeepSeek、Kimi、GLM、MiniMax全在里头。你可以同时勾选好几个模型回答同一个问题,然后让AI做个对比总结。这几个模型互相验证,准确率确实比单模型高不少。
结构化输出。 网页上乱七八糟的信息,AI能自动给你归成标准字段——价格、库存、评分、评论数、促销标签,全部映射好,拿来就能用。省去了自己整理数据的时间。
但有个关键问题:合规
效率归效率,数据采集绕不开合规这道坎。
专业一些的方案,比如亮数据,是通过AI模拟人类行为模式,配合全球2亿多个真实住宅IP池,把请求的"人类相似度"刷到92%。Opensteer也有隐身功能——UA伪装、指纹管理、自动化信号移除。技术上确实越来越成熟了。
但技术可行不等于业务合规。这里有个现成的教训:
2025年11月,亚马逊直接给Perplexity AI发了勒令停止函,原因是它家的AI浏览器Comet AI伪装成真实用户违规访问亚马逊买东西。这个案例把AI浏览器的红线划得很清楚:AI可以当你的"助手",但不能"假扮"你绕过平台规则。
绝大多数平台都明确说了禁止用数据挖掘、爬虫或其他技术未经授权抓取内容。
所以落地的时候,几个原则要记住:
- 优先用官方API或者授权的数据服务商
- 采集范围限定在公开数据,用途得正当(市场洞察、价格趋势这些OK)
- 敏感信息该脱敏脱敏,GDPR之类的隐私法规不能踩
最后说两句
免费AI浏览器的出现,确实让公开数据采集的门槛降了一大截。以前你得懂爬虫、会维护代理池,现在一个对话框就能搞定。
但效率提升不意味着可以随便采。AI浏览器真正的价值,是让"合规且高效"的数据采集变得更简单——在尊重平台规则、保护用户隐私的前提下,让公开数据的获取不再是一件麻烦事。
工具越强大,越要知道边界在哪。
本文所引用的部分图文来自网络,版权归属版权方所有。本文基于合理使用原则少量引用,仅用于对数字营销的分析,非商业宣传目的。 若版权方认为该引用损害其权益,请通过极致了数据微信: JZL3122 联系我方,我们将立即配合处理。发布者:jzl,转载请注明出处:https://www.jizhil.com/rsdata/13921.html