Remove legacy event and mixed distribution paths
This commit is contained in:
@@ -4,10 +4,13 @@
|
||||
|
||||
补充现有四级 extra-information 证据链:
|
||||
|
||||
1. `disease_only`:疾病事件、相对患病时间和 sex;无 CHECKUP、无 extra-info token。
|
||||
2. `smoking_alcohol_bmi`:疾病史、sex、CHECKUP、smoking/alcohol/BMI。
|
||||
3. `assessment_only`:疾病史、sex、CHECKUP、65项常规体格、肺功能、血液、尿液和生化指标。
|
||||
4. `all`:疾病史、sex、CHECKUP、全部265项体检和暴露信息。
|
||||
1. `disease_only`:疾病事件、相对患病时间和 sex;无 extra-info token。
|
||||
2. `smoking_alcohol_bmi`:疾病史、sex、smoking/alcohol/BMI token。
|
||||
3. `assessment_only`:疾病史、sex、65项常规体格、肺功能、血液、尿液和生化指标 token。
|
||||
4. `all`:疾病史、sex、全部265项体检和暴露信息 token。
|
||||
|
||||
所有配置均不使用 CHECKUP。额外信息以独立 token 注入,并使用各自的 assessment 时间。
|
||||
所有连续变量均强制使用训练子集拟合的 RobustScale;训练与评估不设置未标准化对照或兼容模式。
|
||||
|
||||
目标是区分:
|
||||
|
||||
@@ -63,7 +66,7 @@ assessment_only − disease_only
|
||||
all − assessment_only
|
||||
```
|
||||
|
||||
回答生活方式、社会经济、心理和环境暴露是否在常规体检之后仍有增量价值。这是新增实验中最干净的主要比较,因为两组都保留 CHECKUP,Landmark 和随访边界应一致。
|
||||
回答生活方式、社会经济、心理和环境暴露是否在常规体检之后仍有增量价值。两组使用完全相同的疾病事件、Landmark 和随访边界,仅 extra-info token 集合不同。
|
||||
|
||||
### 4.3 全体检相对紧凑变量集
|
||||
|
||||
@@ -130,15 +133,9 @@ smoking_alcohol_bmi − disease_only
|
||||
- Brier、NLL及绝对校准偏差越低越好;
|
||||
- 不以单个 seed 或单个 horizon 决定模型。
|
||||
|
||||
## 7. disease_only 比较的评估限制
|
||||
## 7. disease_only 比较的评估边界
|
||||
|
||||
`disease_only` 按设计删除 CHECKUP,其他三组保留 CHECKUP。当前评估实现会使两类模型的随访终点和 `n_at_risk` 略有差异。
|
||||
|
||||
因此:
|
||||
|
||||
- `assessment_only`、`smoking_alcohol_bmi`、`all` 三者之间可以直接比较;
|
||||
- 它们与 `disease_only` 的比较应使用固定的原始随访终点、Landmark 和 censoring;
|
||||
- 在共享风险集评估完成前,不能把与 `disease_only` 的全部差异严格归因于 extra-info 数值。
|
||||
所有配置均从同一疾病/死亡事件流构造历史、查询点、随访终点和 censoring,并且都不使用 CHECKUP。不同配置只改变 extra-info token,因此可以在共同支持集上把差异解释为额外信息的增量价值。
|
||||
|
||||
## 8. 决策规则
|
||||
|
||||
|
||||
Reference in New Issue
Block a user