Install
openclaw skills install @thcjp/internet-search-tool-proopenclaw skills install @thcjp/internet-search-tool-pro功能说明: 本技能涵盖 中文交互、化工作流场景 等核心能力。
聚合搜索专业版是面向企业用户和专业研究人员的进阶多引擎搜索工具。在免费版 SearXNG 聚合能力之上,新增批量查询、自定义引擎配置、结果导出、定时任务与搜索分析等高级功能,支持高效的规模化信息检索。与免费版完全兼容,已有 SearXNG 配置可无缝迁移升级.
| 能力 | 免费版 | PRO 版 |
|---|---|---|
| 多引擎聚合 | 是 | 是 |
| 分类路由 | 是 | 是 |
| SearXNG 语法 | 是 | 是 |
| 批量查询 | 否 | 是(单次 50 个关键词) |
| 自定义引擎 | 否 | 自由组合配置 |
| 结果导出 | 否 | JSON/CSV/Markdown |
| 定时任务 | 否 | Cron 调度 |
| 搜索缓存 | 否 | 智能缓存去重 |
| 引擎监控 | 否 | 性能分析 |
| 分析报告 | 否 | 搜索效果报告 |
| API 接口 | 否 | REST API |
| 优先支持 | 社区 | 优先响应 |
处理: 解析功能对比的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回功能对比的响应数据,包含状态码、结果和日志.
python (请参考skill目录中的脚本文件) \
--keywords-file keywords.txt \
--category=academic \
--count=10 \
--output results.json
支持从文件批量加载关键词,并行执行搜索任务,结果统一归档.
# 配置自定义引擎组合
python (请参考skill目录中的脚本文件) add \
--name="学术优先" \
--engines="arxiv,google scholar,pubmed" \
--category=academic
# ...
python (请参考skill目录中的脚本文件) add \
--name="技术搜索" \
--engines="stackoverflow,github,brave" \
--category=general
# ...
# 使用自定义引擎
internet_search("query", engine="学术优先")
# 导出为 JSON
python (请参考skill目录中的脚本文件) \
--query="关键词" \
--format=json \
--output=data.json
# ...
# 导出为 CSV
python (请参考skill目录中的脚本文件) \
--query="关键词" \
--format=csv \
--output=data.csv
# 配置定时搜索
python (请参考skill目录中的脚本文件) \
--keyword "行业动态 2026" \
--cron="0 9 * * *" \
--category=news \
--archive-dir=./archive
处理: 解析PRO 版独有功能的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回PRO 版独有功能的响应数据,包含状态码、结果和日志.
input_params参数,支持创建/查询/导出操作用input_params参数进行配置.
处理: 解析核心功能执行的输入参数,完成核心逻辑,返回结构化响应. 输出: 返回核心功能执行的响应数据,包含状态码、结果和日志.
input_params参数,支持创建/查询/导出操作
能力覆盖范围:本skill的核心能力覆盖以下场景关键词:企业级多引擎聚合、搜索工具、支持批量查询、定时任务与搜索分、适合专业研究与数、据采集、核心能力、批量关键词查询、并行执行数十个搜、自定义搜索引擎配、置与组合、结果导出为、多种格式、Use、when、SEO、关键词分析、排名提升、搜索流量优化时使、不适用于黑帽等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持.市场团队需要批量检索竞品相关信息.
# 准备关键词文件
cat > market_keywords.txt <<EOF
竞品A 功能对比 2026
竞品B 用户评价
竞品C 定价策略
竞品D 最新动态
EOF
# ...
# 批量搜索并导出
python (请参考skill目录中的脚本文件) \
--keywords-file market_keywords.txt \
--count=10 \
--category=general \
--export json \
--output=market_research.json
系统自动并行执行所有关键词搜索,聚合多个引擎结果,导出结构化 JSON 数据.
研究人员需要系统化检索学术资料.
# 使用学术引擎组合
python (请参考skill目录中的脚本文件) \
--keywords-file research_topics.txt \
--engine="学术优先" \
--count=10 \
--export md \
--output=literature_review.md
营销团队需要定期追踪关键词在不同引擎的排名.
# 配置 SEO 监控定时任务
python (请参考skill目录中的脚本文件) \
--keywords-file seo_keywords.txt \
--cron="0 8 * * 1" \
--track-rank \
--output-dir=./seo_reports \
--alert-email=seo@company.com
# 依赖说明
pip install apscheduler pandas redis
# ...
# 现有 SearXNG 配置自动兼容
python (请参考skill目录中的脚本文件) --version
# 输出: internet-search-tool-pro v1.0.0
# 创建关键词文件
echo "Python 异步编程
Docker 容器化部署
Kubernetes 集群管理" > topics.txt
# ...
# 执行批量搜索
python (请参考skill目录中的脚本文件) \
--keywords-file topics.txt \
--count=10 \
--export json \
--output=results.json
# config.yaml - PRO 版企业配置
searxng:
url: http://localhost:8080
timeout: 15
retry: 3
# ...
engines:
- name: 学术优先
engines: [arxiv, google scholar, pubmed]
category: academic
- name: 技术搜索
engines: [stackoverflow, github, brave]
category: general
- name: 新闻聚合
engines: [bing news, ddg news]
category: news
# ...
batch:
parallel_workers: 4
delay_between_queries: 1
max_results: 10
cache_enabled: true
cache_ttl: 3600
deduplicate: true
# ...
export:
default_format: json
output_dir: ./exports
# ...
schedule:
enabled: true
timezone: Asia/Shanghai
archive_dir: ./archive
# ...
analytics:
enabled: true
track_engine_performance: true
report_frequency: weekly
storage: ./analytics
# 启动 REST API 服务
python (请参考skill目录中的脚本文件) --port 8000
# ...
# 调用 API 执行搜索
curl -X POST http://localhost:8000/search \
-H "Content-Type: application/json" \
-d '{"query": "Python 教程", "count": 10, "category": "general"}'
# ...
# 批量搜索
curl -X POST http://localhost:8000/batch-search \
-H "Content-Type: application/json" \
-d '{"keywords": ["query1", "query2"], "format": "json"}'
| 参数 | 类型 | 默认值 | 说明 |
|---|---|---|---|
--keywords-file | 字符串 | 无 | 关键词文件 |
--engine | 字符串 | default | 引擎组合名称 |
--category | 字符串 | general | 搜索类别 |
--count | 整数 | 10 | 返回结果数 |
--export | 字符串 | json | 导出格式 |
--cron | 字符串 | 无 | 定时表达式 |
--cache | 布尔 | true | 启用缓存 |
--workers | 整数 | 4 | 并行线程数 |
# batch_config.py - 批量搜索配置
from batch_search import BatchSearchConfig
# ...
config = BatchSearchConfig(
parallel_workers=4,
delay_between_queries=1,
max_results=10,
cache_enabled=True,
cache_ttl=3600,
deduplicate=True,
retry_on_failure=True
)
# ...
# 执行批量搜索
results = config.execute("keywords.txt")
print(f"完成 {len(results)} 个关键词搜索")
# 查看已配置的引擎组合
python (请参考skill目录中的脚本文件) list
# ...
# 创建引擎组合
python (请参考skill目录中的脚本文件) create \
--name="综合搜索" \
--engines="google,bing,brave,ddg" \
--category=general
# ...
# 测试引擎性能
python (请参考skill目录中的脚本文件) benchmark \
--engine="学术优先" \
--test-queries=test_queries.txt
# 合并多个搜索结果并去重
python (请参考skill目录中的脚本文件) \
--input="./exports/*.json" \
--output=merged.json \
--deduplicate \
--sort-by=relevance
# ...
# 生成分析报告
python (请参考skill目录中的脚本文件) \
--input=merged.json \
--output=analysis.md \
--format=summary
# 增加并行线程
python (请参考skill目录中的脚本文件) --workers 8 keywords.txt
# ...
# 启用缓存
python (请参考skill目录中的脚本文件) --cache keywords.txt
# ...
# 调整查询间隔
python (请参考skill目录中的脚本文件) --delay 0.5 keywords.txt
# 检查 SearXNG 负载
curl http://localhost:8080/stats
# ...
# 减少引擎数量
python (请参考skill目录中的脚本文件) optimize --max-engines=3
# ...
# 增加超时时间
python (请参考skill目录中的脚本文件) --timeout 30 keywords.txt
# 验证引擎可用性
python (请参考skill目录中的脚本文件) check-all
# ...
# 禁用失败引擎
python (请参考skill目录中的脚本文件) disable-failed
# ...
# 重置为默认配置
python (请参考skill目录中的脚本文件) reset
# 检查 cron 配置
python (请参考skill目录中的脚本文件) --list
# ...
# 查看任务日志
cat ./logs/scheduled_search.log
# ...
# 手动触发测试
python (请参考skill目录中的脚本文件) --run-now --task-id=task_001
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| SearXNG | 搜索引擎聚合 | 是 | Docker 部署或使用公共实例 |
| Docker | 容器运行时 | 否(自托管时) | docker.com 下载 |
| Python 3.7+ | 运行时 | 是 | 系统包管理器安装 |
| requests | HTTP 库 | 是 | pip install requests |
| apscheduler | 定时任务 | 否(推荐) | pip install apscheduler |
| pandas | 数据处理 | 否(推荐) | pip install pandas |
| redis | 缓存服务 | 否(推荐) | pip install redis |
| flask | API 服务 | 否(推荐) | pip install flask |
| LLM API | API | 是 | 由 Agent 内置 LLM 提供 |
export REDIS_URL=redis://localhost:6379/0
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
{
"success": true,
"data": {
"result": "聚合搜索专业版处理结果",
"execution_time": "0.5s",
"metadata": {
"version": "1.0",
"processor": "internet search pro"
}
},
"execution_log": ["解析输入参数", "执行核心处理", "格式化输出结果"],
"error": null
}
| 风险类型 | 防范措施 |
|---|---|
| API密钥泄露 | 通过环境变量配置,禁止硬编码到代码或配置文件中 |
| 命令执行风险 | 仅执行白名单命令,避免拼接用户输入到命令行参数中 |
| 网络通信安全 | 使用HTTPS协议,验证SSL证书有效性 |
| 敏感数据暴露 | 输出结果中不包含密钥、令牌等敏感信息 |
使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。