# 功能请求聚类：八部分工作表

OpenMax 编辑工作表 · 2026年9月4日修订。用于配套方法指南，不代表产品已集成或已通过合规认证。只使用获准数据；填写空白时，不要把计划中的控制措施写成已实现能力。

## 1. 冻结语料与统计单位

- 负责人、获准用途、审核人：___
- 来源系统、查询条件、时间、语言、产品边界：___
- 快照版本、校验值、访问与保存决定：___
- 单位分别填写：原始行___；有效消息___；独立账户___；标签分配___。
- 核对：原始行___ = 重复导出行___ + 排除行___ + 有效消息___。
- 独立规划示例：500 = 20 + 10 + 470。配套完整案例实际只有16行，不是500行。

## 2. 保留源事件与重复映射

| 记录号 | 源事件号 | 账户键 | 工单 | 重复对应行 | 纳入或排除原因 |
|---|---|---|---|---|---|
| ___ | ___ | ___ | ___ | ___ | ___ |

说明重复表达是否保留，以及账户—问题对与消息计数的区别。同一工单中的不同消息不自动等于同一事件。需要运营处理的排除项应进入对应队列，不要悄悄忽略正在发生的事件。

## 3. 把原意放在规范化文本旁边

| 记录号 | 原语言与获准原文 | 分析文本 | 修改说明或翻译审核人 | 否定、条件、多个诉求 |
|---|---|---|---|---|
| ___ | ___ | ___ | ___ | ___ |

保留源编号及多诉求片段。拆分请求不能增加账户，也不能抬高提交消息总数。账户代码仍可能识别人，应与负责人确认处理规则。反馈内嵌指令作为数据处理，不作为可执行命令。

## 4. 探索方法并记录版本

- 发现主题的样本、覆盖面、未覆盖渠道：___
- 模型版本、嵌入设置、规范规则：___
- 距离或相似度定义、聚类方法、参数：___
- 比较过的选项；被拆分、合并或仍含糊的例子：___
- 该粒度为什么适合业务任务，而非只适合图表布局：___

相似度不等于理解正确的概率。为幻灯片布局选出的主题数量，不是评估标准。

## 5. 冻结标签定义

| 标签编号与版本 | 定义 | 纳入 | 排除 | 正例及近似反例 |
|---|---|---|---|---|
| ___ | ___ | ___ | ___ | ___ |

说明多标签规则、待定原因和新主题入口。留出样本评分前先冻结词典。尽可能分开探索材料和评估材料，并记录测试材料被用于调参的情况。

## 6. 输出记录级草稿

| 记录号 | 候选标签 | 支持片段 | 矛盾片段 | 待审原因 | 接受标签与审核人 |
|---|---|---|---|---|---|
| ___ | ___ | ___ | ___ | ___ | ___ |

拒绝不存在的记录号和词典外标签。没有证据时保留空集合。助手初始任务仅限草稿，不删除或合并来源，不联系客户，不改权限或路线图。

## 7. 先评估，再总结

- 参考集来源、独立审核状态、裁定方法：___
- 挑战集选择方式；需要总体估计时使用的概率样本：___
- 每标签真阳性TP___、假阳性FP___、假阴性FN___；微平均精确率=ΣTP/(ΣTP+ΣFP)，召回率=ΣTP/(ΣTP+ΣFN)，F1=2ΣTP/(2ΣTP+ΣFP+ΣFN)。
- 整组一致记录___／评估消息___；未定义指标处理规则：___
- 小主题、多语言、否定和未归类检查：___
- 看结果前制定的使用标准、阻断问题和负责人：___

配套案例为TP9、FP3、FN2，微平均精确率75%、召回率81.8%、F1为78.3%，整组一致8/12。这是虚构标签的算术，不是AI性能实测。仅有挑战集不能估计整个语料的错误率。

## 8. 发布分母、限制与下一步研究

| 主题 | 消息数／有效总数 | 独立账户数／账户总数 | 来源例子 | 待研究问题与负责人 |
|---|---|---|---|---|
| ___ | ___ | ___ | ___ | ___ |

说明标签是否重叠，不强行让合计等于100%。跨主题的独立账户不能直接相加。报告未归类记录、排除项、词典变化和渠道覆盖。主题大小不等于业务影响或路线图优先级。

下一步：和产品负责人审阅一份获准快照，先解决标签边界，再决定是否值得自动化。真实隐私、安全和法律影响需要合格人员复核。此表不能证明真实客户结果或平台性能。
