Large Model Visual Question Answering Skill | 大模型视觉问答技能

Conducts open-ended Q&A on image content based on computer vision and large language models, supporting any questions to receive natural language responses. | 大模型视觉问答(VQA)技能,基于计算机视觉和大语言模型对图片内容进行开放式问答,支持任意提问得到自然语言回答

Install

openclaw skills install @18072937735/smyx-visual-qa-analysis