Install
openclaw skills install @thcjp/cloud-architect-designopenclaw skills install @thcjp/cloud-architect-design多云架构模式:
模式一:主动-主动(多云并行)
├── AWS(主区域)→ 处理主要流量
├── Azure(备区域)→ 处理欧洲流量
└── GCP(数据分析)→ BigQuery数据处理
适用:全球业务、数据合规要求
模式二:主动-被动(云灾备)
├── AWS(主)→ 日常运行
└── Azure(备)→ 灾难时切换
适用:业务连续性要求高
模式三:云分工(按优势选云)
├── AWS → 计算与存储
├── GCP → AI与数据分析
└── Azure → 企业集成
适用:利用各云优势
输入: 用户提供多云架构策略所需的指令和必要参数。 输出: 返回多云架构策略的执行结果,包含操作状态和输出数据。
云迁移规划操作,处理输入数据并返回结果云迁移规划相关配置参数进行设置# 云迁移路线图框架
migration_roadmap = {
"phase_1_assess": {
"name": "评估阶段",
"duration": "2-4周",
"deliverables": [
"现有架构盘点",
"应用依赖关系图",
"迁移优先级矩阵",
"TCO对比分析"
]
},
"phase_2_plan": {
"name": "规划阶段",
"duration": "3-5周",
"deliverables": [
"目标架构设计",
"迁移策略选择(6R模型)",
"迁移批次规划",
"风险与回退方案"
]
},
"phase_3_migrate": {
"name": "迁移阶段",
"duration": "8-16周",
"deliverables": [
"基础设施搭建",
"数据迁移",
"应用迁移",
"验证测试"
]
},
"phase_4_optimize": {
"name": "优化阶段",
"duration": "持续",
"deliverables": [
"性能优化",
"成本优化",
"架构现代化",
"运维自动化"
]
}
}
# 6R迁移策略
migration_strategies = {
"Rehost": "直接迁移(Lift & Shift)",
"Replatform": "平台优化迁移",
"Refactor": "架构重构迁移",
"Repurchase": "替换为SaaS",
"Retain": "暂时保留",
"Retire": "废弃不用"
}
输出: 返回云迁移规划的执行结果,包含操作状态和输出数据。
云迁移规划操作,处理输入数据并返回结果云迁移规划 选项FinOps优化框架:
阶段一:可见性(Visibility)
- 建立成本标签体系
- 实施成本分摊与展示
- 设置成本告警阈值
阶段二:优化(Optimization)
- 资源右尺寸(Right-sizing)
- Reserved Instance/ savings Plan
- Spot Instance利用
- 存储分层优化
- 数据传输优化
阶段三:治理(Governance)
- 预算审批流程
- 资源生命周期管理
- 自动化策略执行
- 定期成本审查
优化效果预估:
| 优化措施 | 预估节省 | 实施难度 |
| --- | --- | --- |
| RI/Savings Plan | 30-40% | 低 |
| 资源右尺寸 | 15-25% | 中 |
| Spot Instance | 60-70% | 高 |
| 存储分层 | 20-30% | 低 |
| 架构优化 | 30-50% | 高 |
输入: 用户提供FinOps成本优化所需的指令和必要参数。 输出: 返回FinOps成本优化的执行结果,包含操作状态和输出数据。
合规框架对照:
等保2.0三级要求:
├── 物理与环境安全 → 云数据中心认证
├── 网络与通信安全 → VPC隔离 + 安全组 + WAF
├── 设备与计算安全 → 加密 + 补丁管理
├── 应用与数据安全 → 传输加密 + 存储加密
├── 安全管理 → IAM + 审计日志
└── 应急响应 → 监控告警 + 应急预案
GDPR要求:
├── 数据主体权利 → 数据可携性设计
├── 数据保护设计 → 隐私设计原则
├── 数据处理记录 → 完整审计链
├── 数据泄露通知 → 72小时告警机制
└── 跨境数据传输 → 数据本地化存储
HIPAA要求:
├── 行政保障 → 访问审计 + 培训
├── 物理保障 → 设备安全 + 媒体控制
├── 技术保障 ├── 访问控制 + 唯一标识
│ ├── 审计控制 + 活动记录
│ ├── 完整性控制 + 数据校验
│ └── 传输安全 + 加密
└── BAA协议 → 与云厂商签署
输入: 用户提供合规架构设计所需的指令和必要参数。 输出: 返回合规架构设计的执行结果,包含操作状态和输出数据。
合规架构设计操作,处理输入数据并返回结果合规架构设计 选项本skill还覆盖以下能力场景: 企业级云架构设计、支持多云策略、合规设计与灾备方、云架构师专业版、面向企业团队与架、构师的高级云架构、设计平台、核心能力、跨云架构设计与容、灾方案、本地到云、云到云的完整迁移、深度成本分析与节、省计划制定、满足等保、等合规要求、灾难恢复方案、RPO、RTO、规划与多区域灾备、架构评审与治理、架构决策记录、ADR、与治理框架、微服务架构设计、服务拆分、API、服务网格方案、性能工程、容量规划、性能基准与扩展策。这些能力在上述核心功能中均有对应处理逻辑。
大型企业需要多云架构满足全球业务与合规要求。
用户指令:为一家全球电商设计多云架构。
需求:亚洲用AWS、欧洲用Azure(合规)、数据分析用GCP
云架构师输出:
【多云架构方案】
架构总览:
├── AWS(亚太区域 - 主)
│ ├── 计算层:EKS + Fargate
│ ├── 数据层:Aurora Global Database
│ ├── 缓存层:ElastiCache Global
│ └── CDN:CloudFront
├── Azure(欧洲区域 - 合规)
│ ├── 计算层:AKS
│ ├── 数据层:Cosmos DB(多区域复制)
│ └── 合规:GDPR数据本地化
├── GCP(全球 - 分析)
│ ├── 数据湖:BigQuery
│ ├── 数据管道:Dataflow
│ └── ML平台:Vertex AI
└── 全局层
├── DNS:Route 53(全局路由)
├── 流量管理:Azure Traffic Manager
└── 灾备:跨云故障切换
【成本估算】
- AWS(亚太): ~$15,000/月
- Azure(欧洲): ~$8,000/月
- GCP(分析): ~$5,000/月
- 跨云连接: ~$2,000/月
总计: ~$30,000/月
【合规保障】
- 欧洲用户数据存储在Azure欧洲区域
- 数据跨境传输使用加密通道
- 满足GDPR数据本地化要求
企业将本地数据中心迁移到云平台。
用户指令:规划将本地数据中心(50台服务器)迁移到AWS。
云架构师输出:
【迁移路线图】
优秀阶段:评估(2周)
- 盘点50台服务器:20台Web、15台应用、10台数据库、5台其他
- 应用依赖分析:识别核心应用与辅助应用
- TCO分析:本地$200万/年 → 云端预估$120万/年
第二阶段:规划(3周)
迁移批次(6R策略):
| 批次 | 应用类型 | 策略 | 优先级 |
| --- | --- | --- | --- |
| 1 | Web服务器(20台) | Rehost | 高 |
| 2 | 应用服务器(15台) | Replatform | 中 |
| 3 | 数据库(10台) | Refactor | 高 |
| 4 | 其他(5台) | Retain/Retire | 低 |
第三阶段:迁移(12周)
- 批次1:直接迁移Web服务器到EC2
- 批次2:迁移应用到EKS容器化
- 批次3:数据库迁移到RDS
- 批次4:评估保留或废弃
第四阶段:优化(持续)
- 实施FinOps成本优化
- 架构现代化改造
- 运维自动化
【风险与回退】
- 每批次保留回退能力
- 数据库迁移使用DMS双写
- 设置迁移检查点
为关键业务系统设计灾难恢复方案。
用户指令:为核心支付系统设计灾备方案。
RPO: 15分钟
RTO: 30分钟
云架构师输出:
【灾难恢复方案 - AWS多区域】
架构设计:
├── 主区域(us-east-1)
│ ├── 应用层:EKS(3节点)
│ ├── 数据层:Aurora主集群
│ ├── 缓存层:ElastiCache主
│ └── 监控:CloudWatch
├── 备区域(us-west-2)
│ ├── 应用层:EKS standby(1节点)
│ ├── 数据层:Aurora只读副本
│ ├── 缓存层:ElastiCache备
│ └── Route 53健康检查
└── 全局层
├── Route 53故障切换路由
├── Lambda自动扩容脚本
└── SNS告警通知
RPO保障(15分钟):
- Aurora跨区域复制(延迟<1秒)
- 持续数据同步
RTO保障(30分钟):
- Route 53自动检测故障(30秒间隔)
- Lambda自动扩展备区域EKS
- Route 53自动切换流量
【灾备成本】
- 备区域EKS(1节点): ~$200/月
- Aurora跨区域复制: ~$100/月
- ElastiCache备: ~$150/月
- Route 53: ~$50/月
灾备总成本: ~$500/月(主架构的~20%)
【演练计划】
- 每季度执行一次灾备切换演练
- 每月验证数据同步状态
- 自动化故障检测与切换
指令:请为[业务场景]设计多云架构。
业务规模:[规模]
合规要求:[合规需求]
灾备要求:[RPO/RTO]
指令:请规划[当前环境]到[目标云]的迁移方案。
服务器数量:[数量]
应用类型:[应用列表]
时间要求:[时间约束]
指令:请对以下云账单进行FinOps优化分析。
月度账单:[金额]
主要花费:[资源分布]
优化目标:[节省目标]
-sizing: 命令参数,用于指定操作选项-west-2: 命令参数,用于指定操作选项-east-1: 命令参数,用于指定操作选项结果处理: 执行完成后,查看输出结果确认操作状态。成功时输出包含处理摘要和结果数据;失败时根据错误信息排查问题,参考错误处理章节获取恢复步骤。
| 参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
| content | string | 是 | 相关说明 |
| content | string | 否 | 相关说明, 默认: 全部维度 |
| strict_level | string | 否 | 审查严格度, 可选: strict/normal/loose, 默认: normal |
{
"success": true,
"data": {
"overall_grade": "A",
"total_score": 92,
"max_score": 100,
"summary": "处理完成",
"details": [
{
"item": "代码风格",
"status": "pass",
"score": 95,
"comment": "符合规范"
},
{
"item": "安全合规",
"status": "warn",
"score": 80,
"comment": "符合规范"
}
],
"improvements": [
{
"priority": "high",
"suggestion": "建议优化",
"expected_gain": "+5分"
},
{
"priority": "medium",
"suggestion": "建议优化",
"expected_gain": "+3分"
}
]
},
"error": null
}
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
| Python 3 | 运行时 | 可选 | python.org 下载安装 |
| Terraform | IaC工具 | 可选 | terraform.io 下载安装 |
| AWS CLI | 云CLI | 可选 | AWS官网下载安装 |
| Azure CLI | 云CLI | 可选 | Azure官网下载安装 |
| 方案 | RPO | RTO | 成本 | 复杂度 |
|---|---|---|---|---|
| 备份恢复 | 24小时 | 24小时 | 低 | 低 |
| Pilot Light | 1小时 | 4小时 | 中 | 中 |
| 温备 | 15分钟 | 1小时 | 中高 | 中 |
| 热备多活 | <1分钟 | <5分钟 | 高 | 高 |
| 策略 | 适用场景 | 迁移速度 | 优化程度 |
|---|---|---|---|
| Rehost | 时间紧迫 | 快 | 低 |
| Replatform | 平台优化 | 中 | 中 |
| Refactor | 架构重构 | 慢 | 高 |
| Repurchase | 替换SaaS | 中 | 中 |
| Retain | 暂不迁移 | - | - |
| Retire | 废弃 | 快 | - |
| 合规标准 | 关注重点 | 架构要求 |
|---|---|---|
| 等保2.0 | 网络安全 | VPC隔离+审计 |
| GDPR | 数据隐私 | 数据本地化 |
| HIPAA | 医疗数据 | 加密+BAA |
| PCI-DSS | 支付数据 | 网络分段+加密 |
| SOC 2 | 服务安全 | 监控+审计 |
会增加,但可通过统一管理工具(如Terraform)和标准化流程缓解。建议根据业务需求评估多云的必要性。
采用分批次迁移策略,每批次保留回退能力。数据库使用双写或复制方式实现平滑迁移。
根据优化程度不同,通常可节省20-50%。RI购买+资源右尺寸是最快速有效的优化手段。
根据业务重要性选择合适的灾备级别。非核心系统可使用备份恢复方案,核心系统使用热备或双活。
兼容。专业版在免费版单云架构基础上扩展,免费版的架构方案可作为专业版多云策略的组成部分。
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| LLM响应超时或无响应 | 网络延迟或模型负载过高 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接,执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令请求;确认Agent平台LLM服务正常 |
| 输入内容格式不正确 | 用户输入不符合skill预期格式 | 检查输入是否符合skill使用说明中的格式要求,参考示例章节 |
| 执行结果与预期不符 | 指令描述不够明确或上下文不足 | 提供更详细的指令描述,补充必要的上下文信息 |
| 命令执行失败 | 运行环境不满足要求或权限不足 | 确认运行环境符合依赖说明中的要求;检查命令权限设置 |