Install
openclaw skills install @qq435912743/multimodal-gen多模态内容生成技能。覆盖文生图、图生图、文生视频、语音转写,统一封装提示词范式与调用约定,衔接系统内置的 ImageGen / VideoGen 工具。内置 prompt 构造助手脚本。适用于配图、海报、视频素材、语音笔记转写。
openclaw skills install @qq435912743/multimodal-gen把"我要一张图/一段视频"变成稳定可控的生成请求。
| 需求 | 工具 | 说明 |
|---|---|---|
| 文生图 | ImageGen | 文本→图像;注意单图消耗约 5–10 积分 |
| 图生图 | ImageGen(带 image 参数) | 基于参考图变换风格/元素 |
| 文生视频 | VideoGen | 文本→短视频(约 1–3 分钟,5s 约 50–100 积分) |
| 图生视频 | VideoGen(带 image) | 图片→动态视频 |
| 语音转写 | 本地 ffmpeg + whisper / 或外部 API | 音频→文本(标记 needs_web) |
# 把简略需求扩写成结构化生成提示
python scripts/prompt_build.py "一张猫咪插画" --style 水彩 --aspect 1:1
输出可直接喂给 ImageGen/VideoGen 的优化提示词。
python scripts/learner.py record <技能目录> --capability 文生图 --note "用户偏好写实风而非卡通"
python scripts/learner.py record <技能目录> --capability 文生视频 --fail --error 时长超限 --note "超过10s被拒"
python scripts/learner.py insight <技能目录>
python scripts/learner.py reflect <技能目录>
记忆落盘 learned_patterns.json。