---

slug: "data-analysis-hub"
name: "data-analysis-hub"
version: 1.0.1
displayName: "数据分析中枢(专业版)"
summary: "全功能决策分析平台,支持批处理、多重比较校正、定时任务、协同审阅与高级报告模板。。数据分析中枢专业版面向数据分析师、增长负责人、产品负责人与 BI 团队,提供完整的方法论纪律、批量处理能力与"
summary_zh: "全功能决策分析平台,支持批处理、多重比较校正、定时任务、协同审阅与高级报告模板。。数据分析中枢专业版面向数据分析师、增长负责人、产品负责人与 BI 团队,提供完整的方法论纪律、批量处理能力与"
license: "MIT"
edition: "pro"
description: |-
  数据分析中枢专业版面向数据分析师、增长负责人、产品负责人与 BI 团队,提供完整的方法论纪律、批量处理能力与团队协同机制。核心能力:
  - 涵盖免费版全部能力,无条数限制、无功能裁剪
  - 批量分析任务编排与检查点恢复,支持千万级数据集增量更新
  - 多重比较自动化校正(Bonferroni、Benjamini-Hochberg、Holm)
  - 高级统计建模:贝叶斯估计、混合效应模型、时间序列预测(ARIMA/Prophet)
  - 多角色协同审阅与版本对比,支持结论回滚与审计追踪
  - 定时分析任务、阈值告警与多渠道通知(邮件/IM...
tags:
  - 数据分析
  - 批量处理
  - 协同审阅
  - 用户提供
  - 不支持
tools:
  - read
  - exec
  - write
  - glob
homepage: ""
category: "Research"

---

# 数据分析中枢(专业版)

## 付费版专享能力

| 能力 | 免费版 | 付费版 |
|---|---|---|
| 基础功能 | 支持 | 支持 |
| 数据分析中枢(专业版)全功能决策分析 | 不支持 | 支持 |
| 数据分析中枢(专业版)支持批处理 | 不支持 | 支持 |
| 大数据集流式处理 | 不支持 | 支持 |
| 多数据源关联查询 | 不支持 | 支持 |
| 可视化图表自动生成 | 不支持 | 支持 |

## 核心能力

### 2.1 决策优先框架(完整版)
| 序号 | 关键问题 | 进阶要点 |
|:-----|:-----|:-----|
| 1 | 这次分析服务于哪个**决策**? | 同时记录决策者、决策截止时间、决策影响范围 |
| 2 | 什么样的结果会**改变我的判断**? | 明确"翻转阈值",避免事后调标准 |
| 3 | 实际拥有的数据 vs 理想数据? | 识别数据缺口并标记是否阻塞结论 |
| 4 | 哪个**时间窗口**与决策相关? | 与历史同期、环比周期同步对照 |

**输入**: 用户提供1 决策优先框架(完整版)所需的指令和必要参数.
### 2.2 批量分析与增量更新
- **任务编排**:依赖图方式定义多步骤分析,自动并行无依赖任务
- **检查点恢复**:每个步骤完成后落盘检查点,失败可断点续跑
- **幂等保证**:同任务多次执行结果一致,避免重复计算污染结论
- **增量更新**:基于数据版本号做差量计算,仅处理新增/变更数据
- **千万级数据集**:支持 Dask/Polars 等并行计算后端

**输入**: 用户提供2 批量分析与增量更新所需的指令和必要参数.
### 2.3 多重比较自动化校正
| 校正方法 | 适用场景 | 严格度 |
|---:|---:|---:|
| Bonferroni | 检验数量少、要求严格 | 最严格 |
| Holm | 平衡严格度与功效 | 中等 |
| Benjamini-Hochberg | 控制 FDR,适合探索性分析 | 较宽松 |
| Permutation | 分布未知时使用 | 数据驱动 |

**输入**: 用户提供3 多重比较自动化校正所需的指令和必要参数.
**输出**: 返回3 多重比较自动化校正的处理结果,包含执行状态码、结果数据和执行日志.
### 2.4 高级统计建模
- **贝叶斯估计**:支持先验分布指定、MCMC 采样与后验可视化
- **混合效应模型**:处理重复测量、分层抽样数据
- **时间序列预测**:ARIMA、Prophet、状态空间模型
- **因果推断**:倾向得分匹配(PSM)、双重差分(DID)、合成控制法
- **生存分析**:Kaplan-Meier、Cox 比例风险模型

**输入**: 用户提供4 高级统计建模所需的指令和必要参数.
**输出**: 返回4 高级统计建模的处理结果,包含执行状态码、结果数据和执行日志.
### 2.5 协同审阅与版本管理
- 多角色审阅流:Analyst 提交 → Reviewer 复核 → Decision Maker 拍板
- 结论版本树:每次修订生成新版本,可任意回滚
- 修订说明:必须填写变更原因与影响范围
- 审计日志:记录谁在何时修改了哪个结论,用于合规追溯

**输入**: 用户提供5 协同审阅与版本管理所需的指令和必要参数.
**处理**: 解析5 协同审阅与版本管理的输入参数,执行核心处理逻辑,返回结构化结果和执行状态.
### 2.6 定时任务与告警
- **定时分析**:支持 cron 表达式调度,自动拉取最新数据
- **阈值告警**:指标超出阈值自动通知,支持多级阈值
- **多渠道通知**:邮件、企业 IM、Webhook、移动端推送
- **告警去重**:相同根因短时间内只触发一次,避免告警风暴

**输出**: 返回6 定时任务与告警的处理结果,包含执行状态码、结果数据和执行日志.
### 2.7 报告模板与品牌化输出
- 内置 Markdown / HTML / PDF / PPT 四种输出格式
- 支持自定义模板变量与品牌 Logo、配色
- 报告内嵌图表与结论卡片,可一键分发
- 历史报告归档与全文检索

**输入**: 用户提供7 报告模板与品牌化输出所需的指令和必要参数.
**处理**: 解析7 报告模板与品牌化输出的输入参数,执行核心处理逻辑,返回结构化结果和执行状态.
#
## 快速开始

1. 确认运行环境满足依赖说明中的要求
2. 在AI Agent对话中调用本技能,提供必要的输入参数
3. 检查输出结果,根据需要进行后续处理

> 详细的输入输出格式请参考下方章节说明。

## 适用场景

### 3.1 按角色场景矩阵

| 角色 | 场景 | 关键能力 | 输出形态 |
|:---:|:---:|:---:|:---:|
| 数据分析师 | 大规模 A/B 测试平台批量结论 | 批处理 + 多重比较校正 | 结构化结论表 + 异常清单 |
| 增长负责人 | 周报/月报自动化 | 定时任务 + 报告模板 | PDF 周报 + 邮件分发 |
| 产品负责人 | 关键指标异动监控 | 阈值告警 + 归因 | 告警卡片 + 归因树 |
| BI 团队 | 跨部门数据协同 | 协同审阅 + 版本审计 | 版本化结论 + 审计日志 |

### 示例

```text
1. 数据分析师提交一份异动归因分析(版本 v1.0)
2. Reviewer 审阅后提出补充维度拆分,分析师修订为 v1.1
3. Decision Maker 拍板采纳 v1.1 结论
4. 系统自动生成 PDF 报告并分发至相关干系人
5. 后续定时任务监控该指标,异常自动告警
```

## 使用流程

预计上手时间:**< 120 秒**(批量任务需配置数据源).
### 4.1 单次分析

```text
请对这份销售数据做归因分析:
1. 数据源: postgres 连接(凭证从环境变量读取)
2. 表: sales_fact(2024-01-01 至 2024-12-31)
3. 关注问题: 华东销售额下降 15% 的根因
4. 输出: HTML 报告 + 结论卡片
```

### 4.2 批量分析任务

```text
请编排批量分析任务:
5. 任务1: 对 10 个 A/B 实验做结论判定(并行)
6. 任务2: 对结论做 BH 多重比较校正(依赖任务1)
7. 任务3: 生成汇总 PDF 报告(依赖任务2)
8. 检查点: 每个任务完成后落盘
9. 失败策略: 单任务失败重试 3 次,仍失败则跳过并告警
```

### 4.3 定时监控任务

```text
请配置每日监控:
10. 数据源: 销售明细表
11. 频率: 每日 09:00 拉取昨日数据
12. 阈值: 转化率下降 > 5% 触发 P1 告警
13. 通知: 邮件 + 企业 IM Webhook
14. 去重: 同根因 1 小时内只通知一次
```

## 输入格式

| 参数名 | 类型 | 必填 | 说明 |
|:------|------:|:------|:------|
| content | string | 否 | data-analysis-hub处理的内容输入 |,  |
| content | string | 否 | data-analysis-hub处理的内容输入 |, 可选值: json/text/markdown |
| style | string | 否 | 输出风格, 参考 `references/style.md` |

## 输出格式

```json
{
  "success": true,
  "data": {
    result: "hub 相关配置参数",
    result: "hub 相关配置参数",
    result: "hub 相关配置参数",
    "metadata": {
      "template_used": "reviewer",
      "word_count": 0,
      "style": "专业"
    }
  },
  "error": null
}
```

输出模板参考: `assets/output.json`

## 异常处理

| 错误场景 | 原因 | 处理方式 |
|---:|:---|---:|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 

## 依赖说明

### 运行环境

- **Agent 平台**: 任意支持 SKILL.md 的 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- **操作系统**: Windows / macOS / Linux
- **Python**: 3.9+(批量任务与高级建模需要)
- **可选集群**: Dask/Polars 用于并行计算后端

### 第三方依赖

| 依赖项 | 类型 | 是否必需 | 获取方式 |
|:------:|--------|:-------|:------:|
| LLM API | API | 必需 | 由 Agent 内置 LLM 提供 |
| pandas | Python 库 | 必需 | `pip install pandas` |
| numpy | Python 库 | 必需 | `pip install numpy` |
| scipy | Python 库 | 必需 | `pip install scipy` |
| statsmodels | Python 库 | 必需 | `pip install statsmodels` |
| scikit-learn | Python 库 | 可选 | `pip install scikit-learn` |
| pymc | Python 库 | 可选 | `pip install pymc`(贝叶斯) |
| prophet | Python 库 | 可选 | `pip install prophet`(时序预测) |
| dask | Python 库 | 可选 | `pip install dask`(大数据集) |
| polars | Python 库 | 可选 | `pip install polars`(高性能) |
| jinja2 | Python 库 | 必需 | `pip install jinja2`(报告模板) |
| redis | Python 库 | 可选 | `pip install redis`(缓存与告警去重) |

### API Key 配置

- **数据库凭证**: 通过 `DB_HOST`/`DB_USER`/`DB_PASSWORD` 等环境变量传入
- **告警通道**: SMTP、IM Webhook 等凭证通过环境变量传入
- **禁止**: 在 SKILL.md、脚本、配置文件中硬编码任何凭证
- **推荐路径**: 凭证统一存放在 `d:\skills\.skill-credentials\` 目录(已 gitignore)

### 可用性分类

- **分类**: MD+EXEC(纯 Markdown 指令,部分功能需要 exec 命令行执行能力)
- **说明**: 基于自然语言驱动的 AI Skill,集成批量处理、协同审阅与自动化告警的完整生产线

## 案例展示

### 示例1: 基础用法
**输入**:
```json
{
  "content": "示例数据",
  "content": "示例数据",
  "style": "示例数据"
}
```
**输出**:
```
示例数据
```

### 示例3: 边界情况 - 边界情况
**输入**:
```json
{
  "content": "示例数据"
}
```
**输出**:
```
示例数据
```

## 常见问题

### Q1: 专业版支持多大的数据集?

A: 单机模式支持千万级行,集群模式(Dask/Polars 后端)可处理亿级行。增量更新可显著降低重复计算成本.
### Q2: 多重比较校正如何选择?

A: 严格场景(医疗/金融)用 Bonferroni;探索性分析用 BH 控制 FDR;分布未知时用 Permutation。专业版会自动给出推荐.
### Q3: 协同审阅是否支持多人同时编辑?

A: 当前采用"串行修订"模式,即同一时刻只有一个角色可修订。下一个角色看到的是上一角色提交的版本,避免冲突.
### Q4: 定时任务失败如何处理?

A: 单任务失败自动重试 3 次(指数退避),仍失败则跳过并触发告警。检查点机制保证已成功步骤不重算.
### Q5: 报告模板是否支持自定义?

A: 支持自定义模板,通过 Jinja2 语法嵌入变量。专业版内置 5 套行业模板(电商/SaaS/金融/游戏/内容).
### Q6: 是否支持因果推断?

A: 支持 PSM、DID、合成控制法等因果推断方法,适用于评估政策变动、营销活动等场景.
### Q7: 告警去重逻辑是什么?

A: 基于根因指纹(指标+维度+时间窗口),相同根因在去重窗口内只触发一次告警.
### Q8: 是否可以接入 MCP工具扩展能力?

A: 专业版支持通过 MCP工具协议接入外部数据源与计算后端,可在 `mcp_servers` 配置块中注册 MCP server 与 MCP端点,融入 MCP生态共享工具能力.
### Q9: 是否支持版本回滚?

A: 支持任意版本回滚。每次修订都会生成新版本并保留修订说明,可对比任意两个版本的差异.
### Q10: 数据安全如何保障?

A: 凭证必须通过环境变量传入,禁止硬编码;数据访问有审计日志;报告可加水印与访问控制.
## 错误处理

| 错误场景(续)| 原因 | 处理方式 |
|----|:--:|---:|
| LLM响应超时或无响应 | 网络延迟或模型负载过高 | ，请求；确认Agent平台LLM服务正常 |
| 输入内容格式不正确 | 用户输入不符合skill预期格式 | 检查输入是否符合skill使用说明中的格式要求，参考示例章节 |
| 执行结果与预期不符 | 指令描述不够明确或上下文不足 | 提供更详细的指令描述，补充必要的上下文信息 |
| 命令执行失败 | 运行环境不满足要求或权限不足 | 确认运行环境符合依赖说明中的要求；检查命令权限设置 |

