Install
openclaw skills install @zxw-wwwww/questionnaire-generatorGenerate standardized usability and human factors questionnaires (SUS, ASQ, SEQ, NASA-TLX, UEQ, SUS, CSUQ, etc.) with scoring instructions for UX coursework.
openclaw skills install @zxw-wwwww/questionnaire-generator本 skill 用于生成「用户体验与人因工程」领域常用的标准化问卷,并附计分方法。问卷覆盖系统可用性、任务易用性、认知负荷、用户体验等多个测量维度,服务于课程中的可用性测试、实验设计与主观评估环节。
标准化问卷的优势在于:信效度经过验证、可跨研究比较、结果可量化。
当用户出现以下需求时,调用本 skill:
| 问卷 | 测量维度 | 题量 | 适用场景 |
|---|---|---|---|
| SUS(System Usability Scale) | 系统整体可用性 | 10 题 | 快速评估系统可用性,最通用 |
| ASQ(After-Scenario Questionnaire) | 任务完成后的易用性 | 3 题 | 每个任务完成后即时评估 |
| SEQ(Single Ease Question) | 单任务易用性 | 1 题 | 极简快速评估 |
| NASA-TLX(Task Load Index) | 任务认知负荷/工作负荷 | 6 维度 | 评估任务的心智与时间负荷 |
| UEQ(User Experience Questionnaire) | 用户体验(吸引力、效率等) | 26 题 | 综合评估产品整体体验 |
| CSUQ(Computer System Usability Questionnaire) | 系统可用性 | 19 题 | 较全面的系统可用性评估 |
| SMILE 式微笑量表 | 主观满意度 | 1 题 | 儿童或极简场景 |
指导语:请根据你刚才使用该系统的真实感受,对以下陈述打分。1 = 非常不同意,5 = 非常同意。请凭第一印象作答,不要停留过久。
| 编号 | 题目(中文) | 1 | 2 | 3 | 4 | 5 |
|---|---|---|---|---|---|---|
| 1 | 我认为我会愿意经常使用这个系统 | ○ | ○ | ○ | ○ | ○ |
| 2 | 我发现这个系统过于复杂 | ○ | ○ | ○ | ○ | ○ |
| 3 | 我认为这个系统容易使用 | ○ | ○ | ○ | ○ | ○ |
| 4 | 我认为我需要技术人员帮助才能使用这个系统 | ○ | ○ | ○ | ○ | ○ |
| 5 | 我发现这个系统中的各项功能整合得很好 | ○ | ○ | ○ | ○ | ○ |
| 6 | 我认为这个系统有太多不一致的地方 | ○ | ○ | ○ | ○ | ○ |
| 7 | 我认为大多数人能很快学会使用这个系统 | ○ | ○ | ○ | ○ | ○ |
| 8 | 我发现这个系统使用起来很繁琐 | ○ | ○ | ○ | ○ | ○ |
| 9 | 我对使用这个系统感到有信心 | ○ | ○ | ○ | ○ | ○ |
| 10 | 在使用这个系统之前,我需要学习很多东西 | ○ | ○ | ○ | ○ | ○ |
计分方法:
结果解读(Bangor et al. 的等级参考):
经验参考:SUS 平均分约为 68 分,超过 68 分可视为「高于平均水平」。
指导语:请根据你刚才完成的这项任务,回答以下问题。1 = 非常不同意,7 = 非常同意。
| 编号 | 题目 | 1 | 2 | 3 | 4 | 5 | 6 | 7 |
|---|---|---|---|---|---|---|---|---|
| 1 | 总的来说,我对完成这项任务的容易程度感到满意 | ○ | ○ | ○ | ○ | ○ | ○ | ○ |
| 2 | 总的来说,我对完成这项任务所花费的时间感到满意 | ○ | ○ | ○ | ○ | ○ | ○ | ○ |
| 3 | 总的来说,我对完成任务时的支持信息(在线帮助、说明文档等)感到满意 | ○ | ○ | ○ | ○ | ○ | ○ | ○ |
计分方法:取 3 题的平均分(1–7 分),分数越高表示任务易用性越好。建议在每项任务完成后立即施测。
指导语:总体来说,这项任务有多难?请在 1–7 之间选择(1 = 非常困难,7 = 非常容易)。
非常困难 1 2 3 4 5 6 7 非常容易
计分方法:直接记录 1–7 分。SEQ 平均分 < 5 通常提示该任务存在易用性问题,建议在每项任务后立即施测。
指导语:请根据你刚才完成任务的体验,在以下 6 个维度上打分(0–100,数值越高表示该维度负荷越高)。
| 维度 | 说明 | 评分(0–100) |
|---|---|---|
| 脑力需求(Mental Demand) | 完成任务需要多少脑力和感知活动(思考、决策、记忆、搜索) | ____ |
| 体力需求(Physical Demand) | 完成任务需要多少体力活动 | ____ |
| 时间需求(Temporal Demand) | 任务节奏带来的时间压力如何 | ____ |
| 绩效表现(Performance) | 你认为自己在任务目标达成上表现如何 | ____ |
| 努力程度(Effort) | 为达到这一绩效水平,你付出了多少努力 | ____ |
| 挫折感(Frustration) | 过程中你感到多大程度的沮丧、压力、厌烦 | ____ |
计分方法:
结果解读:分数越高表示任务负荷越大。绩效表现维度通常反向计分。
UEQ 共 26 题,每题为一对语义对立的形容词(如「令人讨厌的 / 令人愉快的」),使用 7 级量表,覆盖 6 个维度:吸引力(Attractiveness)、效率(Efficiency)、清晰度(Perspicuity)、可靠感(Dependability)、刺激感(Stimulation)、新颖性(Novelty)。
计分方法:每个维度取对应题目的平均值,范围为 −3 到 +3。推荐使用官方 Excel 工具在线计算(ueq-online.org),以便按 26 题的完整矩阵精确计分。
注:完整 26 题 UEQ 建议使用官方工具计分。本 skill 可应要求输出完整 26 题量表。
共 19 题,7 级量表,覆盖「系统有效性、信息质量、界面质量」三个分量表。
计分方法:取各题平均分(1–7),分数越低表示可用性越好(与 SUS 相反,需注意方向)。
为每个问卷生成时,按以下顺序输出:
我想评估一款校园 App 整体好不好用,做可用性测试,请问用哪个问卷?
推荐使用 SUS(系统可用性量表):它是评估系统整体可用性最通用的标准化问卷,10 题、约 2 分钟,适合快速评估整体可用性水平。
随后按「问卷名称 → 指导语 → 完整题目 → 计分方法 → 结果解读 → 施测建议」的格式输出完整 SUS 问卷(题目与计分见上方「各问卷详解」第 1 条)。