Install
openclaw skills install @thcjp/browser-automation-v2openclaw skills install @thcjp/browser-automation-v2核心功能: 本技能提供中文交互、时使用等能力。
| 能力 | 免费版 | 付费版 |
|---|---|---|
| 基础功能 | 支持 | 支持 |
| 多标签页并行抓取 | 不支持 | 支持 |
| 反爬虫策略自动绕过 | 不支持 | 支持 |
| 页面结构变化自适应 | 不支持 | 支持 |
| 批量导出结构化数据 | 不支持 | 支持 |
详细的输入输出格式请参考下方章节说明。
| 场景 | 输入 | 输出 |
|---|---|---|
| 场景1 企业级浏览器自动化 | 用户请求数据 | 结构化处理结果 |
| 场景2 自动清标签/超时重试/并发锁 | 用户请求数据 | 结构化处理结果 |
不适用于:需要人工判断的复杂决策场景
| 参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
| content | string | 否 | browser-automation-v2处理的内容输入 |
| mode | string | 否 | 处理模式, 可选: json/text/markdown, |
| max_retries | integer | 否 | 单步最大重试次数, 默认: 2 |
| skip_steps | array | 否 | 跳过的步骤编号(用于断点续传), 默认: [] |
{
"success": true,
"data": {
"final_result": {
"v2_result": "v2_result_value",
"v2_metadata": "v2_metadata_value",
"v2_status": "v2_status_value"
},
"execution_log": [
{
"step": 1,
"name": "按流程执行",
"status": "completed",
"duration_ms": 1200,
"output_summary": "按流程执行"
},
{
"step": 2,
"name": "按流程执行",
"status": "completed",
"duration_ms": 3500,
"output_summary": "按流程执行"
},
{
"step": 3,
"name": "按流程执行",
"status": "completed",
"duration_ms": 2100,
"output_summary": "按流程执行"
},
{
"step": 4,
"name": "按流程执行",
"status": "completed",
"duration_ms": 800,
"output_summary": "按流程执行"
}
],
"total_duration_ms": 7600,
"gates_passed": 3,
"gates_total": 3
},
"error": null
}
中间产物模板参考: assets/browser-automation-v2_template
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 页面加载超时 | 目标网站响应慢或网络延迟 | 增加超时阈值,启用重试机制,检查代理配置 |
| 页面结构变化导致选择器失效 | 目标网站更新了DOM结构 | 切换到可访问性树定位元素,或提示用户提供新的选择器 |
| 反爬虫机制触发 | 频繁请求被目标站点识别 | 降低请求频率,启用随机延迟,更换User-Agent |
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
API Key配置方式:
export API_KEY="${API_KEY:?请设置环境变量}"
配置后需重启会话或开启新终端生效。API Key应妥善保管,避免泄露到版本控制系统.
A: 请参考使用流程和依赖说明章节,确保运行环境满足要求后调用本技能。
A: 在技能调用时,可以通过concurrency参数设置并发数,系统会自动管理并发锁,避免资源冲突。
A: 可以尝试使用不同的选择器或定位策略,或者通过技能提供的元素定位辅助工具进行调试。
A: 在技能调用时,设置skip_steps参数,指定跳过的步骤编号,实现断点续传。
A: 可以通过技能提供的日志配置参数,自定义日志输出格式,包括日志级别、输出位置等。
A: 可以通过设置技能的timeout参数,增加超时阈值,或者启用重试机制来处理页面加载超时的情况。
| 错误现象 | 可能原因 | 诊断步骤 | 解决方案 |
|---|---|---|---|
| 执行失败,无输出 | 网络问题 | 检查网络连接,重试执行 | 确保网络连接正常,重试执行 |
| 页面元素定位失败 | 选择器错误 | 检查选择器,尝试不同定位策略 | 使用正确的选择器或定位策略 |
| 执行超时 | 资源冲突 | 检查并发设置,调整资源分配 | 调整并发数或优化资源分配 |
| 反爬虫机制触发 | 请求频率过高 | 降低请求频率,启用随机延迟 | 调整请求频率,使用随机延迟策略 |
| 风险项 | 等级 | 防护措施 | 验证方法 |
|---|---|---|---|
| API Key泄露 | 高 | 使用环境变量存储API Key,避免版本控制泄露 | 检查版本控制中是否有API Key信息 |
| 代理服务器安全 | 中 | 使用安全的代理服务器,定期更换代理 | 检查代理服务器安全状态,定期更换代理 |
| 数据安全 | 高 | 加密敏感数据,限制数据访问 | 使用加密技术,限制数据访问权限 |
| 网络安全 | 高 | 使用HTTPS连接,防止中间人攻击 | 检查连接使用HTTPS,确保网络安全 |
| 效率提升量化分析 |
|---|
| 场景 |
| :---------------- |
| 批量数据处理 |
| 工作流优化 |
| 网络爬虫 |
| 数据分析 |
| 差异性对比表格 |
|---|
| 对比项 |
| :---------------- |
| 功能丰富度 |
| 执行效率 |
| 安全性 |
| 易用性 |
| 操作场景 | 手动耗时 | 自动化耗时 | 效率提升 |
|---|---|---|---|
| 文件解析与提取 | 5-10分钟/个 | <5秒/个 | 60-120x |
| 批量文件处理(100个) | 8-16小时 | <5分钟 | 96-192x |
| API调用与响应解析 | 2-3分钟/次 | <1秒/次 | 120-180x |
| 多接口数据聚合 | 15-30分钟 | <10秒 | 90-180x |
| 命令执行与结果收集 | 3-5分钟/次 | <2秒/次 | 90-150x |
| 重复任务批量执行 | 因任务而异 | 线性缩减 | 5-50x |
| 错误排查与修复 | 10-30分钟 | <30秒 | 20-60x |
| 对比维度 | 浏览器自动化 | 传统手动方式 | 通用脚本工具 |
|---|---|---|---|
| 自动化程度 | 全流程自动 | 完全手动 | 部分自动 |
| 错误处理 | 内置错误恢复 | 依赖人工经验 | 基本try-catch |
| 可复用性 | 参数化配置 | 一次性脚本 | 模板化 |
| 安全合规 | 内置安全检查 | 无安全保障 | 无安全保障 |
| 适用场景 | 企业级浏览器自动化,自动清标签/超时重试/并发锁,稳如生产。Enterprise | 通用场景 | 通用场景 |
针对浏览器自动化使用中可能遇到的常见问题,提供以下排查方案:
| 错误类型 | 原因分析 | 解决方案 |
|---|---|---|
| API认证失败(401) | API密钥错误或过期 | 检查密钥配置,重新生成token |
| 接口限流(429) | 请求频率超出限制 | 降低调用频率,启用重试退避策略 |
| 响应超时(504) | 网络延迟或服务端负载过高 | 增加超时阈值,检查网络连接 |
| 文件不存在 | 路径错误或文件未创建 | 检查路径拼写,确认文件已生成 |
| 文件格式不支持 | 扩展名不在支持列表中 | 转换为支持的格式后重试 |
| 权限不足 | 当前用户无读写权限 | 检查文件权限,以管理员身份运行 |
| 命令执行失败 | 参数错误或环境依赖缺失 | 检查命令语法,确认依赖已安装 |
| 进程超时 | 命令执行时间过长 | 增加超时设置,优化命令参数 |
| 网络连接失败 | DNS解析失败或防火墙拦截 | 检查网络配置,确认代理设置 |