Add train-split robust scaling for continuous values
This commit is contained in:
@@ -10,6 +10,7 @@
|
||||
# - smoking
|
||||
# - alcohol
|
||||
# - BMI is already included in the assessment variables
|
||||
# - continuous values use train-split RobustScaler statistics
|
||||
#
|
||||
# A6000 48 GB default:
|
||||
# batch_size=256
|
||||
@@ -34,7 +35,7 @@ SEED_CSV="42,43,44"
|
||||
NUM_WORKERS=4
|
||||
BATCH_SIZE=256
|
||||
PYTHON_BIN="${PYTHON_BIN:-python}"
|
||||
CAMPAIGN_NAME="extra_info_assessment_smoking_alcohol_multiseed"
|
||||
CAMPAIGN_NAME="extra_info_assessment_smoking_alcohol_robust_multiseed"
|
||||
DRY_RUN=0
|
||||
|
||||
ENTRYPOINT="$SCRIPT_DIR/train_all_future.py"
|
||||
@@ -66,6 +67,7 @@ Fixed experiment settings:
|
||||
disease history timed
|
||||
sex enabled by the model
|
||||
extra information extra_info_types_assessment_smoking_alcohol.txt
|
||||
continuous scaling robust (training-subset median/IQR)
|
||||
|
||||
A6000 48 GB default:
|
||||
batch_size 256
|
||||
@@ -234,6 +236,7 @@ run_job() {
|
||||
--time_mode relative
|
||||
--dist_mode weibull
|
||||
--disease_history_mode timed
|
||||
--continuous_value_scaling robust
|
||||
--extra_info_types_file "$EXTRA_INFO_TYPES_FILE"
|
||||
)
|
||||
|
||||
|
||||
Reference in New Issue
Block a user