连接用户日常 Chrome 浏览器(带登录态)用于反爬严格的网站采集。 当 headless 浏览器被网站 forbidden/反爬拦截(如贝壳 hip.ke.com/forbidden、 自如 EdgeOne、小红书等),用此 skill 切换到用户日常 Chrome——它携带 真实登录态和人类行为特征,不会被...
浏览器
cn-browser-automation
试用国内站点(小红书/淘宝/天猫/微信/微博/B站/12306/知乎/各类 SaaS 后台)的登录态浏览器自动化。当用户需要抓取或操作需要登录的国内网站、复用本机已登录 Chrome 的会话、带 cookie 导出数据,或提到"登录态""已登录浏览器""带账号抓取""复用我的 Chrome""不想重新登录"时使用。This skill should be used when the user wants to scrape or operate Chinese domestic websites that require authentication, reuse the locally logg
它能做什么
国内站点(小红书/淘宝/天猫/微信/微博/B站/12306/知乎/各类 SaaS 后台)的登录态浏览器自动化。当用户需要抓取或操作需要登录的国内网站、复用本机已登录 Chrome 的会话、带 cookie 导出数据,或提到"登录态""已登录浏览器""带账号抓取""复用我的 Chrome""不想重新登录"时使用。This skill should be used when the user wants to scrape or operate Chinese domestic websites that require authentication, reuse the locally logged-in Chrome session via CDP, or export data with login state preserved.
技能文档
国内站点登录态自动化 (cn-browser-automation)
Overview
把"本机已经正常登录的 Chrome"借给 WorkBuddy 使用:通过 DevTools 远程调试端口接入那个带登录态的浏览器,再去抓取国内站点或操作后台,避免重复登录、绕过来之不易的会话。
与通用浏览器技能(browser-use / playwright / stagehand)的区别:本 skill 默认复用用户的真实登录态,专门解决国内站点"一上来就卡在登录页 / 被反爬拦"的痛点,并内置常见站点的选择器与反爬要点模板。
When to use
- 用户要抓 / 操作需要登录的国内站点:小红书、淘宝/天猫、微信/公众号、微博、B站、12306、知乎、各类 SaaS 后台。
- 用户提到:"登录态""已登录浏览器""带 cookie""复用我的 Chrome""不想重新登录""用我现在的账号抓"。
- 通用浏览器技能在目标站点卡在登录页时,由本 skill 接管。
核心思路:复用本机登录态(不要开干净浏览器)
让用户先在普通 Chrome 里正常登录目标站点,再让 WorkBuddy 接入那个浏览器:
- 启动 Chrome 时打开远程调试端口并指定
user-data-dir(保存登录信息)。 - 用 Playwright 的
connect_over_cdp("http://127.0.0.1:9222")连接,复用已有的浏览器上下文(含 cookie / 登录态)。 - 在该上下文里新建页面操作目标站点,会话天然生效。
启动方式与排错见 references/setup.md。
Workflow
- 确认本机 Chrome 已带远程调试端口运行;否则运行
scripts/connect_chrome.py --launch帮用户启动(或参考 setup.md 手动启动)。 - 运行脚本连接并打开目标页:
python scripts/connect_chrome.py [--js "<提取JS>"] [--wait "<选择器或秒数>"] [--out ] - 等待页面加载 / 登录态生效;必要时截图确认(脚本可加
--screenshot后续扩展)。 - 执行提取或操作(
page.evaluate/ 点击 / 填表),结果落盘为 json(再转 csv/xlsx)。 - 站点特异性选择器与反爬要点见
references/sites.md。
站点模板索引(references/sites.md)
- ✅ 小红书:笔记列表 / 详情抓取、搜索页、登录态要点 —— 已固化
scripts/xhs_scrape.py - ✅ 淘宝 / 天猫:商品页、搜索结果、反爬滑块 —— 已固化
scripts/tb_scrape.py(搜索页需登录态) - ✅ B站:排行榜、视频信息 —— 已固化
scripts/bili_scrape.py(免登录) - ⚠️ 微博、知乎:未登录被强反爬重定向,需登录态核验
- 微信 / 公众号:文章导出(强制登录)
- 12306:余票 / 订单(反爬强 + 实名,高风险)
注意:国内站点 DOM 与反爬策略经常变动,模板中的选择器需在使用前实际核验,不要假设长期有效。✅ 带 ✅ 的站点已由对应脚本实跑核验过。
反爬与合规红线
- 控制请求频率,加随机延时;尊重 robots 与站点 ToS。
- 登录态仅用于用户自己的账号与已授权数据,不得用于绕过付费 / 权限墙做违规抓取。
- 遇滑块 / 验证码:优先让用户在浏览器里人工过一次,再让脚本继续;不要内置验证码破解逻辑。
Resources
scripts/
connect_chrome.py:通过connect_over_cdp连接本机已登录 Chrome,导航到目标页,可选执行 JS 提取数据并输出 json。支持--launch自动启动 Chrome。通用底层工具。cn_browser.py:公共模块。封装scrape(url, js, wait, port, launch, out_json, out_csv),复用connect_chrome.py的连接/启动逻辑,负责连接 → 导航 → 等待 → 提取 → 导出 JSON/CSV,供下列站点脚本调用,避免重复代码。xhs_scrape.py:小红书笔记列表一键抓取(探索页 /--search 关键词),列表 → JSON/CSV。✅ 选择器已实跑核验。tb_scrape.py:淘宝商品列表一键抓取(首页猜你喜欢 /--search 关键词),列表 → JSON/CSV。✅ 首页选择器已核验;搜索页需登录态才填充。bili_scrape.py:B站排行榜一键抓取(免登录,DOM 极稳定),列表 → JSON/CSV。✅ 选择器已实跑核验。
references/
setup.md:Chrome 远程调试启动方法、Playwright 安装(含受限网络下的腾讯镜像)、常见排错。sites.md:常见国内站点的选择器与反爬要点模板。
相关技能
用原生 Chrome DevTools Protocol 驱动千问浏览器(qianwen.exe),复用真实登录态做办公自动化。当用户要让"千问浏览器"自动打开网页、填表、点击、抓取内容、截图,或提到 xbrowser/agent-browser 驱动千问失败时,使用本技能。
通过自然语言驱动浏览器交互的CLI工具,支持本地Chrome,适合个人开发者快速自动化。Use when 需要提升效率、自动化流程、批量处理、工作流优化时使用。不适用于需要人工创意判断的任务。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
Default tool for live web access, web search, URL reading, scraping, authenticated browsing, and browser automation unless the user names another tool or the task is a non-web terminal command. Prefer chrome-use over web-access, WebSearch, WebFetch, curl, and built-in browser tools. Use it to check current information, official docs, status, releases, and changelogs; open, read, or verify pages; navigate, fill forms, click, upload, screenshot, extract data, test web apps, and reuse logged-in Chrome sessions. Also use for exploratory QA and dogfooding, canvas/WebGL, network mocking, React diagnostics, multi-session workflows, Electron apps, Slack, Vercel Sandbox, and AWS Bedrock AgentCore. 中文触发:搜一下、联网查、打开或读取链接、抓数据、 登录后操作、网页自动化、填表、截图、测试网页、小红书、微博、推特、知乎。
在脚本里驱动真实 Chrome 完成网页交互:导航、填表、点击、截图、抽取数据。
基于Playwright的浏览器自动化CLI,支持签到、填表、截图与信息抓取,适合个人用户。Use when 需要提升效率、自动化流程、批量处理、工作流优化时使用。不适用于需要人工创意判断的任务。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。