Install
openclaw skills install @duding-engicool/skill-hypothesis-testing统计假设检验工具;支持正态性检验(Shapiro-Wilk/K-S)、t检验(单样本/独立/配对)、卡方检验(拟合优度/独立性)、ANOVA、Levene检验、Mann-Whitney U检验;自动计算统计量、p值、置信区间与效应量;提供结果解释指南
openclaw skills install @duding-engicool/skill-hypothesis-testing确保数据格式符合要求:
根据研究问题选择合适的检验:
| 目的 | 检验方法 |
|---|---|
| 判断数据是否正态 | Shapiro-Wilk / K-S检验 |
| 比较样本均值与总体均值 | 单样本t检验 |
| 比较两组独立样本 | 独立样本t检验 / Mann-Whitney U |
| 比较配对样本 | 配对样本t检验 |
| 检验分类变量关联 | 卡方独立性检验 |
| 检验观测与期望频数 | 卡方拟合优度检验 |
| 比较三组及以上均值 | 单因素ANOVA |
| 检验方差齐性 | Levene检验 |
调用脚本进行分析:
python scripts/hypothesis_test.py --test <检验类型> --data1 <数据> [参数]
python scripts/hypothesis_test.py --test shapiro --data1 "85,90,78,92,88,76,95,82,89,91"
python scripts/hypothesis_test.py --test two_sample_t --data1 "85,88,90,92,87" --data2 "78,82,80,76,79"
python scripts/hypothesis_test.py --test chi_square_goodness --data1 "18,22,16,20,15,19"
python scripts/hypothesis_test.py --test anova --data1 "85,90,88" --data2 "78,82,80;92,95,90"
python scripts/hypothesis_test.py --test shapiro --data1 ./data/grades.csv
| 参数 | 说明 | 默认值 |
|---|---|---|
| --test | 检验类型 | 必需 |
| --data1 | 第一组数据 | 必需 |
| --data2 | 第二组数据(两样本检验) | 可选 |
| --alpha | 显著性水平 | 0.05 |
| --pop_mean | 总体均值(单样本t检验) | 样本均值 |
| --expected | 期望频数(卡方检验) | 均匀分布 |
| --output | 输出JSON文件路径 | 输出到stdout |
| test值 | 检验名称 | 适用场景 |
|---|---|---|
| shapiro | Shapiro-Wilk正态性检验 | 小样本(n<5000)正态判断 |
| ks | K-S正态性检验 | 大样本正态判断 |
| one_sample_t | 单样本t检验 | 与已知总体比较 |
| two_sample_t | 独立样本t检验 | 两独立组比较 |
| paired_t | 配对样本t检验 | 配对/重复测量比较 |
| chi_square_goodness | 卡方拟合优度检验 | 观测vs期望频数 |
| chi_square_independence | 卡方独立性检验 | 两分类变量关联 |
| anova | 单因素ANOVA | 三组及以上均值比较 |
| levene | Levene方差齐性检验 | 方差齐性判断 |
| mann_whitney | Mann-Whitney U检验 | 两组非参数比较 |
脚本输出JSON格式结果,包含:
test_name: 检验名称statistic: 检验统计量(t值/F值/χ²值等)p_value: p值df: 自由度alpha: 显著性水平confidence_interval: 置信区间(适用时)effect_size: 效应量(适用时)conclusion: 结论描述interpretation: 解释字符串| 维度 | 评分 | 说明 |
|---|---|---|
| T — 可信任度 | 9/10 | 纯文档/脚本技能,无外部依赖风险,支持中文交互 |
| R — 可靠性 | 9/10 | 有异常处理说明; 输出格式明确 |
| A — 适用性 | 9/10 | 有适用范围声明; 触发条件明确 |
| C — 规范性 | 10/10 | frontmatter 完整; 文档结构清晰; 内容充分 |
| E — 有效性 | 10/10 | 输出明确; 含使用示例; 文档详尽 |
| 总分 | 47/50 | 通过 |