11# PsyLens
22
3- PsyLens 是一套社区反馈分析与可靠性评测工作流 。当前案例围绕《英雄联盟》海克斯大乱斗社区讨论展开,将多平台公开反馈整理为样本与证据单元,再从具体话题、体验机制和数据可靠性三个层面分析 。
3+ PsyLens 把分散的玩家反馈整理成可核查的产品线索,并对整条分析链路做可靠性评测 。当前案例围绕《英雄联盟》海克斯大乱斗的社区讨论 。
44
55- ** 在线页面** :https://sherlock0717.github.io/PsyLens/
66- ** 完整项目说明** :[ ` docs/files/PsyLens_project_brief.docx ` ] ( docs/files/PsyLens_project_brief.docx )
77- ** 公开数据** :[ ` data/public/ ` ] ( data/public/ )
88- ** 离线 Demo** :[ ` demo/ ` ] ( demo/ )
99
10- ## 当前案例
10+ ## 当前案例与主要结果
1111
12- | 项目 | 结果 |
13- | --- | --- |
14- | 数据来源 | NGA、贴吧、B 站公开讨论 |
15- | 样本设计 | 三个平台各 120 条,共 360 条 |
16- | 证据单元 | 927 条,平均每条样本 2.575 条 |
17- | 文本回溯 | 927 条证据均能在对应公开样本中定位 |
18- | 结构问题 | 孤立证据 0,平台错配 0,重复文本组 0 |
19- | 日期覆盖 | 120 条有日期,240 条日期为空 |
12+ 案例整合 NGA、贴吧、B 站三个平台的公开讨论。每个平台等额保留 120 条样本,共 360 条。样本再切分为 927 条证据单元,平均每条样本约 2.58 条证据,全部能在对应公开样本中逐字定位。
2013
21- ## 主要分析结果
14+ ** 证据单元 ** :从一条完整反馈中切出的、可以单独判断问题类型的短片段。
2215
23- ### 具体话题
16+ 主要分布以 441 条可明确分类的证据为分母:
2417
25- 排除 ` other_uncertain ` 后,共有 441 条证据能够分配具体话题:
18+ - 具体话题最集中在平衡与数值:270 条,占 61.2%;其次是匹配与对局分配:82 条,占 18.6%。
19+ - 体验机制最集中在胜任受挫:308 条,占 69.8%;其次是公平受损:88 条,占 20.0%。
20+ - 数量较高的交叉组合是平衡与数值 × 胜任受挫,共 138 条。
2621
27- - 平衡与数值:270 条,占 61.2%;
28- - 匹配与对局分配:82 条,占 18.6%;
29- - 活动与玩法设计:24 条,占 5.4%;
30- - 成长与养成:20 条,占 4.5%;
31- - 社区冲突与氛围:18 条,占 4.1%。
22+ ** 体验机制** :玩家在表达中呈现的主要体验方向,例如觉得难以发挥、觉得规则不公平,或觉得官方说明不清楚。
3223
33- ### 体验机制
34-
35- 排除 ` uncertain ` 后,共有 441 条证据能够分配主要体验机制:
36-
37- - 胜任受挫:308 条,占 69.8%;
38- - 公平受损:88 条,占 20.0%;
39- - 信任与沟通落差:24 条,占 5.4%;
40- - 归属感下降:11 条,占 2.5%;
41- - 规范与安全风险:10 条,占 2.3%。
42-
43- ### 话题与机制交叉
44-
45- 数量较高的具体组合包括:
24+ 完整分布由 [ ` tools/summarize_public_analysis.py ` ] ( tools/summarize_public_analysis.py ) 从公开数据计算,页面读取 [ ` docs/assets/data/analysis_summary.json ` ] ( docs/assets/data/analysis_summary.json ) 展示。
4625
47- - 平衡与数值 × 胜任受挫:138 条;
48- - 平衡与数值 × 公平受损:35 条;
49- - 匹配与对局分配 × 胜任受挫:22 条;
50- - 匹配与对局分配 × 公平受损:16 条;
51- - 沟通与透明度 × 信任与沟通落差:13 条。
26+ ## 分析方法
5227
53- 完整分布由 [ ` tools/summarize_public_analysis.py ` ] ( tools/summarize_public_analysis.py ) 从公开数据计算,页面读取 [ ` docs/assets/data/analysis_summary.json ` ] ( docs/assets/data/analysis_summary.json ) 展示 。
28+ 项目采用双层编码。表层话题记录反馈在谈什么,体验机制记录文本呈现的心理体验方向。两层分开记录,使产品问题、心理机制和证据来源可以分别核对 。
5429
55- ## 心理学分析框架
30+ 编码顺序是先判断证据是否能独立成立,再分别标注话题与机制。当文本过短、依赖上下文或同时指向多个方向时,标签保留为 uncertain,避免牵强归类。
5631
57- 项目采用双层编码:
32+ ## 心理学思路
5833
59- 1 . ** 表层话题** 记录反馈正在讨论的问题;
60- 2 . ** 体验机制** 记录文本呈现的心理体验方向。
34+ 机制层参考胜任需要、公平判断、组织信任、社群归属与规范安全五个方向的研究,并把这些方向转化为可观察的文本判据。体验类型、操作性定义和参考文献见 [ ` docs/methodology/PSYCHOLOGY_FRAMEWORK.md ` ] ( docs/methodology/PSYCHOLOGY_FRAMEWORK.md ) 。
6135
62- 机制层参考胜任需要、公平判断、组织信任、社群归属与规范安全研究,并通过固定纳入、排除和相邻标签区分规则转化为文本编码。详细构念、操作性定义和参考文献见 [ ` docs/methodology/PSYCHOLOGY_FRAMEWORK.md ` ] ( docs/methodology/PSYCHOLOGY_FRAMEWORK.md ) 。
36+ 交叉组合用于提出可验证的产品问题,再由问卷、访谈、行为日志或实验继续检验 。
6337
64- ## 数据处理流程
38+ ## 数据处理
6539
66- ``` text
67- 候选讨论登记
68- → 页面与回复采集
69- → 原始缓存
70- → 规则预清洗
71- → 内容筛选与字段规整
72- → 平台等额抽样
73- → 公开脱敏
74- → 证据单元切分
75- → 话题与机制编码
76- → 完整性与分布审计
77- ```
40+ 处理流程从候选讨论登记开始,依次经过采集、规则预清洗、内容筛选、平台等额抽样、公开脱敏、证据切分与双层编码,最后做完整性与分布审计。
7841
79- 关键操作包括:删除回复头、引用残留、图片路径和多余空白;移除空文本与低信息噪声; 删除来源链接和账号定位字段; 按标点切分证据;检查证据文本是否能在父样本中逐字定位;扫描重复、空值、URL 和非法标签 。
42+ 关键操作包括删除回复头与引用残留、移除低信息文本、 删除来源链接和账号定位字段、 按标点切分证据,并检查每条证据能否在父样本中逐字定位。字段、清洗规则和复现命令见 [ ` docs/methodology/DATA_CLEANING_AND_CODING.md ` ] ( docs/methodology/DATA_CLEANING_AND_CODING.md ) 。
8043
81- 详细字段、清洗规则和复现命令见 [ ` docs/methodology/DATA_CLEANING_AND_CODING.md ` ] ( docs/methodology/DATA_CLEANING_AND_CODING.md ) 。
44+ 日期字段覆盖 120 / 360 条样本。当前版本聚焦当前样本的整体分布,时间维度在日期覆盖扩展后启用 。
8245
8346## 可靠性评测
8447
85- 评测分为五组:
86-
87- - ** 结构完整性** :ID、父样本、平台和文本定位;
88- - ** 清洗与隐私** :字段白名单、URL、重复、空值和文件哈希;
89- - ** 编码可用性** :合法标签、不确定比例、标签边界和编码来源;
90- - ** 分析支撑** :结论是否带有证据、样本量、分母和平台范围;
91- - ** 运行复现** :同输入输出一致、manifest 完整、跨平台 CI。
48+ 评测把"结果看起来合理"拆成可检查的条件,分为五组:结构完整性、清洗与隐私、编码可用性、分析支撑、运行复现。当前结构完整性全部通过,公开数据 URL 命中为 0,重复文本组为 0。完整方法见 [ ` docs/evaluation/EVALUATION_METHOD.md ` ] ( docs/evaluation/EVALUATION_METHOD.md ) 。
9249
93- 当前最明显的质量风险是机制不确定率较高 :486 / 927,约 52.4%。这项结果提示短文本、上下文依赖和标签边界仍需要更细的编码设计。完整评测方法见 [ ` docs/evaluation/EVALUATION_METHOD.md ` ] ( docs/evaluation/EVALUATION_METHOD.md ) 。
50+ 编码可用性的校准重点是暂时保留为不确定的证据 :486 条证据的体验机制标注为 uncertain,主要涉及短文本、上下文依赖和多种解释并存。这批样本是下一步标签边界校准的重点材料 。
9451
95- ## 两种不确定性
52+ ## 自动校准计划
9653
97- 公开数据包含两个含义不同的字段:
54+ v1.1 通过三个互不查看彼此结果的代理,对分层样本做独立复检,输出一致结果、争议标签和重复运行稳定性。
9855
99- - ` mechanism_label=uncertain ` :486 条,表示无法明确判断体验机制;
100- - ` analysis_inclusion_status=included_flagged_uncertain ` :163 条,表示证据仍被保留,但纳入时存在上下文或解释风险。
56+ ** 自动校准参考集** :由多个互不查看彼此结果的代理独立判断后形成的参考标签,用于发现稳定结果和争议案例。它定位为自动校准参考,人工金标准另行建立。流程见 [ ` docs/evaluation/AGENT_CALIBRATION_WORKFLOW.md ` ] ( docs/evaluation/AGENT_CALIBRATION_WORKFLOW.md ) 。
10157
102- 两者分别统计,不能合并为同一“不确定率”。
58+ ## 运行与复现
10359
104- ## 离线 Demo
60+ 离线 Demo 默认使用本地固定示例模式,不联网,也不调用外部模型:
10561
10662``` bash
10763python tools/run_demo.py
10864```
10965
110- Demo 默认使用确定性 mock provider,不联网,也不调用外部模型。输出写入 ` artifacts/ ` ,包括 JSON、Markdown、HTML 和 manifest。
111-
11266生成公开分析汇总:
11367
11468``` bash
@@ -117,31 +71,17 @@ python tools/summarize_public_analysis.py \
11771 --output artifacts/public_analysis_summary.json
11872```
11973
120- 规范化公开数据到独立目录 :
74+ 检查公开文案表达 :
12175
12276``` bash
123- python tools/normalize_public_dataset.py \
124- --source-dir data/public \
125- --output-dir artifacts/normalized_public
77+ python tools/lint_public_copy.py --root . --format markdown
12678```
12779
128- ## 仓库结构
129-
130- ``` text
131- data/public/ 公开脱敏样本、证据与字段说明
132- demo/ 离线分析示例
133- docs/index.html GitHub Pages 展示页
134- docs/methodology/ 心理框架、编码与清洗方法
135- docs/evaluation/ 评测方法
136- evaluation/ 指标与失败类型配置
137- pipeline/ 采集、配置和 Prompt 模板
138- tools/ 公开数据规范化、统计与 Demo 入口
139- tests/ 数据、页面与文档校验
140- ```
80+ ## 结果使用说明
14181
142- ## 解释边界
82+ 三个平台采用等额抽样,编码来源包含历史 AI 结果与离线规则提案。证据数量也会受文本长度和切分粒度影响。当前分布用于方法审计、探索性分析和研究设计。它为访谈、问卷、行为分析和实验提供问题线索。总体占比与因果结论由这些后续研究继续检验。
14383
144- 三个平台采用等额抽样,编码来源包含历史 AI 结果与离线规则提案,且证据数量会受到文本长度和切分粒度影响。因此当前分布用于方法审计、探索性分析和后续研究设计,不直接代表总体玩家意见占比,也不构成产品效果或心理状态的因果结论 。
84+ 公开数据还包含两个含义不同的字段,各统计一次即可: ` mechanism_label=uncertain ` 有 486 条,表示机制暂时无法明确归类; ` analysis_inclusion_status=included_flagged_uncertain ` 有 163 条,表示证据仍被保留但纳入时需要提醒 。
14585
14686## 权利与使用
14787
0 commit comments