Training in progress, step 40

Browse files

Files changed (11) hide show

checkpoint-40/config.json +80 -0
checkpoint-40/optimizer.pt +3 -0
checkpoint-40/pytorch_model.bin +3 -0
checkpoint-40/rng_state.pth +3 -0
checkpoint-40/scheduler.pt +3 -0
checkpoint-40/trainer_state.json +324 -0
checkpoint-40/training_args.bin +3 -0
config.json +80 -0
pytorch_model.bin +3 -0
runs/Feb12_06-53-01_robovision.csres.utexas.edu/events.out.tfevents.1707742388.robovision.csres.utexas.edu.2756623.0 +3 -0
training_args.bin +3 -0

checkpoint-40/config.json ADDED Viewed

	@@ -0,0 +1,80 @@

+{
+  "_name_or_path": "nvidia/mit-b0",
+  "architectures": [
+    "SegformerForSemanticSegmentation"
+  ],
+  "attention_probs_dropout_prob": 0.0,
+  "classifier_dropout_prob": 0.1,
+  "decoder_hidden_size": 256,
+  "depths": [
+    2,
+    2,
+    2,
+    2
+  ],
+  "downsampling_rates": [
+    1,
+    4,
+    8,
+    16
+  ],
+  "drop_path_rate": 0.1,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.0,
+  "hidden_sizes": [
+    32,
+    64,
+    160,
+    256
+  ],
+  "id2label": {
+    "0": "unlabeled",
+    "1": "dropoff",
+    "2": "undropoff"
+  },
+  "image_size": 224,
+  "initializer_range": 0.02,
+  "label2id": {
+    "dropoff": 1,
+    "undropoff": 2,
+    "unlabeled": 0
+  },
+  "layer_norm_eps": 1e-06,
+  "mlp_ratios": [
+    4,
+    4,
+    4,
+    4
+  ],
+  "model_type": "segformer",
+  "num_attention_heads": [
+    1,
+    2,
+    5,
+    8
+  ],
+  "num_channels": 6,
+  "num_encoder_blocks": 4,
+  "patch_sizes": [
+    7,
+    3,
+    3,
+    3
+  ],
+  "reshape_last_stage": true,
+  "semantic_loss_ignore_index": 255,
+  "sr_ratios": [
+    8,
+    4,
+    2,
+    1
+  ],
+  "strides": [
+    4,
+    2,
+    2,
+    2
+  ],
+  "torch_dtype": "float32",
+  "transformers_version": "4.30.2"
+}

checkpoint-40/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:34c273537bb1abc8910513c5232fd8c54f0fc71d87a75b8e1215240269a66de9
+size 29876485

checkpoint-40/pytorch_model.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b67fc1e9142a1425d3256b17a33712c77775bc46bfde2d9cb053361338550cf4
+size 14951629

checkpoint-40/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:12614450c70a1153287aefc455bca8990f9cabf36a348572795d8d1a2ba80518
+size 14575

checkpoint-40/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:25237a923eee17c18a7b29086e4a1cf0b19b4cee7a21985adcaa35e9c29c2ac8
+size 627

checkpoint-40/trainer_state.json ADDED Viewed

	@@ -0,0 +1,324 @@

+{
+  "best_metric": 0.48036208748817444,
+  "best_model_checkpoint": "/robodata/smodak/Projects/nspl/scripts/terrainseg/training/models/dropoff-utcustom-train-SF-RGBD-b0_7/checkpoint-40",
+  "epoch": 20.0,
+  "global_step": 40,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.5,
+      "learning_rate": 6.666666666666667e-06,
+      "loss": 1.0264,
+      "step": 1
+    },
+    {
+      "epoch": 1.0,
+      "learning_rate": 1.3333333333333333e-05,
+      "loss": 1.0249,
+      "step": 2
+    },
+    {
+      "epoch": 1.5,
+      "learning_rate": 2e-05,
+      "loss": 1.0219,
+      "step": 3
+    },
+    {
+      "epoch": 2.0,
+      "learning_rate": 2.6666666666666667e-05,
+      "loss": 1.0261,
+      "step": 4
+    },
+    {
+      "epoch": 2.5,
+      "learning_rate": 3.3333333333333335e-05,
+      "loss": 1.0043,
+      "step": 5
+    },
+    {
+      "epoch": 3.0,
+      "learning_rate": 4e-05,
+      "loss": 0.9882,
+      "step": 6
+    },
+    {
+      "epoch": 3.5,
+      "learning_rate": 4.666666666666667e-05,
+      "loss": 0.9908,
+      "step": 7
+    },
+    {
+      "epoch": 4.0,
+      "learning_rate": 5.333333333333333e-05,
+      "loss": 0.9709,
+      "step": 8
+    },
+    {
+      "epoch": 4.5,
+      "learning_rate": 6.000000000000001e-05,
+      "loss": 0.961,
+      "step": 9
+    },
+    {
+      "epoch": 5.0,
+      "learning_rate": 6.666666666666667e-05,
+      "loss": 0.9508,
+      "step": 10
+    },
+    {
+      "epoch": 5.0,
+      "eval_accuracy_dropoff": 0.19369710314456753,
+      "eval_accuracy_undropoff": 0.9010801242217483,
+      "eval_accuracy_unlabeled": NaN,
+      "eval_iou_dropoff": 0.06049444267748618,
+      "eval_iou_undropoff": 0.8706257192603624,
+      "eval_iou_unlabeled": 0.0,
+      "eval_loss": 1.026282548904419,
+      "eval_mean_accuracy": 0.5473886136831579,
+      "eval_mean_iou": 0.31037338731261616,
+      "eval_overall_accuracy": 0.8716676712036133,
+      "eval_runtime": 2.7665,
+      "eval_samples_per_second": 7.229,
+      "eval_steps_per_second": 0.723,
+      "step": 10
+    },
+    {
+      "epoch": 5.5,
+      "learning_rate": 7.333333333333333e-05,
+      "loss": 0.9292,
+      "step": 11
+    },
+    {
+      "epoch": 6.0,
+      "learning_rate": 8e-05,
+      "loss": 0.9246,
+      "step": 12
+    },
+    {
+      "epoch": 6.5,
+      "learning_rate": 7.964912280701755e-05,
+      "loss": 0.9097,
+      "step": 13
+    },
+    {
+      "epoch": 7.0,
+      "learning_rate": 7.929824561403509e-05,
+      "loss": 0.8786,
+      "step": 14
+    },
+    {
+      "epoch": 7.5,
+      "learning_rate": 7.894736842105263e-05,
+      "loss": 0.8697,
+      "step": 15
+    },
+    {
+      "epoch": 8.0,
+      "learning_rate": 7.859649122807017e-05,
+      "loss": 0.8421,
+      "step": 16
+    },
+    {
+      "epoch": 8.5,
+      "learning_rate": 7.824561403508773e-05,
+      "loss": 0.8223,
+      "step": 17
+    },
+    {
+      "epoch": 9.0,
+      "learning_rate": 7.789473684210527e-05,
+      "loss": 0.8166,
+      "step": 18
+    },
+    {
+      "epoch": 9.5,
+      "learning_rate": 7.754385964912281e-05,
+      "loss": 0.7987,
+      "step": 19
+    },
+    {
+      "epoch": 10.0,
+      "learning_rate": 7.719298245614036e-05,
+      "loss": 0.7814,
+      "step": 20
+    },
+    {
+      "epoch": 10.0,
+      "eval_accuracy_dropoff": 0.09518566939608707,
+      "eval_accuracy_undropoff": 0.9726282293027602,
+      "eval_accuracy_unlabeled": NaN,
+      "eval_iou_dropoff": 0.05836274909643214,
+      "eval_iou_undropoff": 0.9358911019066932,
+      "eval_iou_unlabeled": NaN,
+      "eval_loss": 0.7567641139030457,
+      "eval_mean_accuracy": 0.5339069493494236,
+      "eval_mean_iou": 0.4971269255015627,
+      "eval_overall_accuracy": 0.9361448287963867,
+      "eval_runtime": 2.8406,
+      "eval_samples_per_second": 7.041,
+      "eval_steps_per_second": 0.704,
+      "step": 20
+    },
+    {
+      "epoch": 10.5,
+      "learning_rate": 7.68421052631579e-05,
+      "loss": 0.7775,
+      "step": 21
+    },
+    {
+      "epoch": 11.0,
+      "learning_rate": 7.649122807017544e-05,
+      "loss": 0.744,
+      "step": 22
+    },
+    {
+      "epoch": 11.5,
+      "learning_rate": 7.614035087719298e-05,
+      "loss": 0.7385,
+      "step": 23
+    },
+    {
+      "epoch": 12.0,
+      "learning_rate": 7.578947368421052e-05,
+      "loss": 0.7156,
+      "step": 24
+    },
+    {
+      "epoch": 12.5,
+      "learning_rate": 7.543859649122808e-05,
+      "loss": 0.7073,
+      "step": 25
+    },
+    {
+      "epoch": 13.0,
+      "learning_rate": 7.508771929824562e-05,
+      "loss": 0.6876,
+      "step": 26
+    },
+    {
+      "epoch": 13.5,
+      "learning_rate": 7.473684210526316e-05,
+      "loss": 0.68,
+      "step": 27
+    },
+    {
+      "epoch": 14.0,
+      "learning_rate": 7.43859649122807e-05,
+      "loss": 0.6647,
+      "step": 28
+    },
+    {
+      "epoch": 14.5,
+      "learning_rate": 7.403508771929825e-05,
+      "loss": 0.656,
+      "step": 29
+    },
+    {
+      "epoch": 15.0,
+      "learning_rate": 7.368421052631579e-05,
+      "loss": 0.642,
+      "step": 30
+    },
+    {
+      "epoch": 15.0,
+      "eval_accuracy_dropoff": 0.10256657262781256,
+      "eval_accuracy_undropoff": 0.9861238615411099,
+      "eval_accuracy_unlabeled": NaN,
+      "eval_iou_dropoff": 0.07771069890623208,
+      "eval_iou_undropoff": 0.9491694411343236,
+      "eval_iou_unlabeled": NaN,
+      "eval_loss": 0.590660810470581,
+      "eval_mean_accuracy": 0.5443452170844613,
+      "eval_mean_iou": 0.5134400700202778,
+      "eval_overall_accuracy": 0.9493862152099609,
+      "eval_runtime": 2.7723,
+      "eval_samples_per_second": 7.214,
+      "eval_steps_per_second": 0.721,
+      "step": 30
+    },
+    {
+      "epoch": 15.5,
+      "learning_rate": 7.333333333333333e-05,
+      "loss": 0.6219,
+      "step": 31
+    },
+    {
+      "epoch": 16.0,
+      "learning_rate": 7.298245614035087e-05,
+      "loss": 0.6276,
+      "step": 32
+    },
+    {
+      "epoch": 16.5,
+      "learning_rate": 7.263157894736843e-05,
+      "loss": 0.5895,
+      "step": 33
+    },
+    {
+      "epoch": 17.0,
+      "learning_rate": 7.228070175438597e-05,
+      "loss": 0.5987,
+      "step": 34
+    },
+    {
+      "epoch": 17.5,
+      "learning_rate": 7.192982456140351e-05,
+      "loss": 0.578,
+      "step": 35
+    },
+    {
+      "epoch": 18.0,
+      "learning_rate": 7.157894736842105e-05,
+      "loss": 0.5622,
+      "step": 36
+    },
+    {
+      "epoch": 18.5,
+      "learning_rate": 7.12280701754386e-05,
+      "loss": 0.5411,
+      "step": 37
+    },
+    {
+      "epoch": 19.0,
+      "learning_rate": 7.087719298245614e-05,
+      "loss": 0.5512,
+      "step": 38
+    },
+    {
+      "epoch": 19.5,
+      "learning_rate": 7.052631578947368e-05,
+      "loss": 0.5536,
+      "step": 39
+    },
+    {
+      "epoch": 20.0,
+      "learning_rate": 7.017543859649124e-05,
+      "loss": 0.5118,
+      "step": 40
+    },
+    {
+      "epoch": 20.0,
+      "eval_accuracy_dropoff": 0.20064680382577582,
+      "eval_accuracy_undropoff": 0.9839122686389837,
+      "eval_accuracy_unlabeled": NaN,
+      "eval_iou_dropoff": 0.146396810999508,
+      "eval_iou_undropoff": 0.9509353469996961,
+      "eval_iou_unlabeled": 0.0,
+      "eval_loss": 0.48036208748817444,
+      "eval_mean_accuracy": 0.5922795362323798,
+      "eval_mean_iou": 0.3657773859997347,
+      "eval_overall_accuracy": 0.9513446807861328,
+      "eval_runtime": 3.0452,
+      "eval_samples_per_second": 6.568,
+      "eval_steps_per_second": 0.657,
+      "step": 40
+    }
+  ],
+  "max_steps": 240,
+  "num_train_epochs": 120,
+  "total_flos": 2.035958276947968e+16,
+  "trial_name": null,
+  "trial_params": null
+}

checkpoint-40/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:8aac04d8cdad507b67b0cf9d85a115bd8b48759ff485068ff5a4f634035f8954
+size 4219

config.json ADDED Viewed

	@@ -0,0 +1,80 @@

+{
+  "_name_or_path": "nvidia/mit-b0",
+  "architectures": [
+    "SegformerForSemanticSegmentation"
+  ],
+  "attention_probs_dropout_prob": 0.0,
+  "classifier_dropout_prob": 0.1,
+  "decoder_hidden_size": 256,
+  "depths": [
+    2,
+    2,
+    2,
+    2
+  ],
+  "downsampling_rates": [
+    1,
+    4,
+    8,
+    16
+  ],
+  "drop_path_rate": 0.1,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.0,
+  "hidden_sizes": [
+    32,
+    64,
+    160,
+    256
+  ],
+  "id2label": {
+    "0": "unlabeled",
+    "1": "dropoff",
+    "2": "undropoff"
+  },
+  "image_size": 224,
+  "initializer_range": 0.02,
+  "label2id": {
+    "dropoff": 1,
+    "undropoff": 2,
+    "unlabeled": 0
+  },
+  "layer_norm_eps": 1e-06,
+  "mlp_ratios": [
+    4,
+    4,
+    4,
+    4
+  ],
+  "model_type": "segformer",
+  "num_attention_heads": [
+    1,
+    2,
+    5,
+    8
+  ],
+  "num_channels": 6,
+  "num_encoder_blocks": 4,
+  "patch_sizes": [
+    7,
+    3,
+    3,
+    3
+  ],
+  "reshape_last_stage": true,
+  "semantic_loss_ignore_index": 255,
+  "sr_ratios": [
+    8,
+    4,
+    2,
+    1
+  ],
+  "strides": [
+    4,
+    2,
+    2,
+    2
+  ],
+  "torch_dtype": "float32",
+  "transformers_version": "4.30.2"
+}

pytorch_model.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b67fc1e9142a1425d3256b17a33712c77775bc46bfde2d9cb053361338550cf4
+size 14951629

runs/Feb12_06-53-01_robovision.csres.utexas.edu/events.out.tfevents.1707742388.robovision.csres.utexas.edu.2756623.0 ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:2d11245e8ea3b3a52fffcc9f3d5edcf93b36a0db606421a1c6d8c55e0277a3b7
+size 14056

training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:8aac04d8cdad507b67b0cf9d85a115bd8b48759ff485068ff5a4f634035f8954
+size 4219