AshtonLKY commited on Mar 23

Commit

f42bc87

•

1 Parent(s): 7ef0bd1

Upload 49 files

Browse files

Files changed (49) hide show

ner_model/config.json +59 -0
ner_model/model.safetensors +3 -0
test_ner/checkpoint-1000/config.json +59 -0
test_ner/checkpoint-1000/merges.txt +0 -0
test_ner/checkpoint-1000/model.safetensors +3 -0
test_ner/checkpoint-1000/rng_state.pth +3 -0
test_ner/checkpoint-1000/scheduler.pt +3 -0
test_ner/checkpoint-1000/special_tokens_map.json +51 -0
test_ner/checkpoint-1000/tokenizer_config.json +56 -0
test_ner/checkpoint-1000/trainer_state.json +116 -0
test_ner/checkpoint-1000/training_args.bin +3 -0
test_ner/checkpoint-1000/vocab.json +0 -0
test_ner/checkpoint-1500/config.json +59 -0
test_ner/checkpoint-1500/merges.txt +0 -0
test_ner/checkpoint-1500/model.safetensors +3 -0
test_ner/checkpoint-1500/optimizer.pt +3 -0
test_ner/checkpoint-1500/rng_state.pth +3 -0
test_ner/checkpoint-1500/scheduler.pt +3 -0
test_ner/checkpoint-1500/special_tokens_map.json +51 -0
test_ner/checkpoint-1500/tokenizer_config.json +56 -0
test_ner/checkpoint-1500/trainer_state.json +173 -0
test_ner/checkpoint-1500/training_args.bin +3 -0
test_ner/checkpoint-1500/vocab.json +0 -0
test_ner/checkpoint-2000/config.json +59 -0
test_ner/checkpoint-2000/merges.txt +0 -0
test_ner/checkpoint-2000/model.safetensors +3 -0
test_ner/checkpoint-2000/optimizer.pt +3 -0
test_ner/checkpoint-2000/rng_state.pth +3 -0
test_ner/checkpoint-2000/scheduler.pt +3 -0
test_ner/checkpoint-2000/special_tokens_map.json +51 -0
test_ner/checkpoint-2000/tokenizer_config.json +56 -0
test_ner/checkpoint-2000/trainer_state.json +230 -0
test_ner/checkpoint-2000/training_args.bin +3 -0
test_ner/checkpoint-2000/vocab.json +0 -0
test_ner/checkpoint-500/config.json +59 -0
test_ner/checkpoint-500/merges.txt +0 -0
test_ner/checkpoint-500/model.safetensors +3 -0
test_ner/checkpoint-500/optimizer.pt +3 -0
test_ner/checkpoint-500/rng_state.pth +3 -0
test_ner/checkpoint-500/scheduler.pt +3 -0
test_ner/checkpoint-500/special_tokens_map.json +51 -0
test_ner/checkpoint-500/tokenizer_config.json +56 -0
test_ner/checkpoint-500/trainer_state.json +59 -0
test_ner/checkpoint-500/training_args.bin +3 -0
test_ner/checkpoint-500/vocab.json +0 -0
tokenizer/merges.txt +0 -0
tokenizer/special_tokens_map.json +51 -0
tokenizer/tokenizer_config.json +56 -0
tokenizer/vocab.json +0 -0

ner_model/config.json ADDED Viewed

	@@ -0,0 +1,59 @@

+{
+  "_name_or_path": "roberta-base",
+  "architectures": [
+    "RobertaForTokenClassification"
+  ],
+  "attention_probs_dropout_prob": 0.1,
+  "bos_token_id": 0,
+  "classifier_dropout": null,
+  "eos_token_id": 2,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.1,
+  "hidden_size": 768,
+  "id2label": {
+    "0": "B-callsign",
+    "1": "B-condition conjunction",
+    "10": "I-instruction type",
+    "11": "I-instruction unit",
+    "12": "I-instruction value",
+    "13": "O",
+    "2": "B-condition requirement",
+    "3": "B-instruction qualifier",
+    "4": "B-instruction type",
+    "5": "B-instruction unit",
+    "6": "B-instruction value",
+    "7": "I-callsign",
+    "8": "I-condition requirement",
+    "9": "I-instruction qualifier"
+  },
+  "initializer_range": 0.02,
+  "intermediate_size": 3072,
+  "label2id": {
+    "B-callsign": "0",
+    "B-condition conjunction": "1",
+    "B-condition requirement": "2",
+    "B-instruction qualifier": "3",
+    "B-instruction type": "4",
+    "B-instruction unit": "5",
+    "B-instruction value": "6",
+    "I-callsign": "7",
+    "I-condition requirement": "8",
+    "I-instruction qualifier": "9",
+    "I-instruction type": "10",
+    "I-instruction unit": "11",
+    "I-instruction value": "12",
+    "O": "13"
+  },
+  "layer_norm_eps": 1e-05,
+  "max_position_embeddings": 514,
+  "model_type": "roberta",
+  "num_attention_heads": 12,
+  "num_hidden_layers": 12,
+  "pad_token_id": 1,
+  "position_embedding_type": "absolute",
+  "torch_dtype": "float32",
+  "transformers_version": "4.39.1",
+  "type_vocab_size": 1,
+  "use_cache": true,
+  "vocab_size": 50265
+}

ner_model/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:cde5008b0c1e8b590fa4605ca5dcb8807da60b1caba4b76a2cfd40d5e071bf01
+size 496287152

test_ner/checkpoint-1000/config.json ADDED Viewed

	@@ -0,0 +1,59 @@

+{
+  "_name_or_path": "roberta-base",
+  "architectures": [
+    "RobertaForTokenClassification"
+  ],
+  "attention_probs_dropout_prob": 0.1,
+  "bos_token_id": 0,
+  "classifier_dropout": null,
+  "eos_token_id": 2,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.1,
+  "hidden_size": 768,
+  "id2label": {
+    "0": "B-callsign",
+    "1": "B-condition conjunction",
+    "10": "I-instruction type",
+    "11": "I-instruction unit",
+    "12": "I-instruction value",
+    "13": "O",
+    "2": "B-condition requirement",
+    "3": "B-instruction qualifier",
+    "4": "B-instruction type",
+    "5": "B-instruction unit",
+    "6": "B-instruction value",
+    "7": "I-callsign",
+    "8": "I-condition requirement",
+    "9": "I-instruction qualifier"
+  },
+  "initializer_range": 0.02,
+  "intermediate_size": 3072,
+  "label2id": {
+    "B-callsign": "0",
+    "B-condition conjunction": "1",
+    "B-condition requirement": "2",
+    "B-instruction qualifier": "3",
+    "B-instruction type": "4",
+    "B-instruction unit": "5",
+    "B-instruction value": "6",
+    "I-callsign": "7",
+    "I-condition requirement": "8",
+    "I-instruction qualifier": "9",
+    "I-instruction type": "10",
+    "I-instruction unit": "11",
+    "I-instruction value": "12",
+    "O": "13"
+  },
+  "layer_norm_eps": 1e-05,
+  "max_position_embeddings": 514,
+  "model_type": "roberta",
+  "num_attention_heads": 12,
+  "num_hidden_layers": 12,
+  "pad_token_id": 1,
+  "position_embedding_type": "absolute",
+  "torch_dtype": "float32",
+  "transformers_version": "4.39.1",
+  "type_vocab_size": 1,
+  "use_cache": true,
+  "vocab_size": 50265
+}

test_ner/checkpoint-1000/merges.txt ADDED Viewed

The diff for this file is too large to render. See raw diff

test_ner/checkpoint-1000/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:520d9115eae82dbb25fb38b68b89a8cedb5e875c03011821dba452e7afc023f3
+size 496287152

test_ner/checkpoint-1000/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b9176b64b569b8bca907482ec0f4b06a1200d8b006a084cdb6d4bb9b4db34452
+size 14244

test_ner/checkpoint-1000/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:d6b5012776f03aafcd3b72b0e840aa46e74cbd44b047aebdf9e90d9e5353e3ec
+size 1064

test_ner/checkpoint-1000/special_tokens_map.json ADDED Viewed

	@@ -0,0 +1,51 @@

+{
+  "bos_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "cls_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "eos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "mask_token": {
+    "content": "<mask>",
+    "lstrip": true,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "pad_token": {
+    "content": "<pad>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "sep_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "unk_token": {
+    "content": "<unk>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  }
+}

test_ner/checkpoint-1000/tokenizer_config.json ADDED Viewed

	@@ -0,0 +1,56 @@

+{
+  "add_prefix_space": false,
+  "added_tokens_decoder": {
+    "0": {
+      "content": "<s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "1": {
+      "content": "<pad>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "2": {
+      "content": "</s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "3": {
+      "content": "<unk>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "50264": {
+      "content": "<mask>",
+      "lstrip": true,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    }
+  },
+  "bos_token": "<s>",
+  "clean_up_tokenization_spaces": true,
+  "cls_token": "<s>",
+  "eos_token": "</s>",
+  "errors": "replace",
+  "mask_token": "<mask>",
+  "model_max_length": 512,
+  "pad_token": "<pad>",
+  "sep_token": "</s>",
+  "tokenizer_class": "RobertaTokenizer",
+  "unk_token": "<unk>"
+}

test_ner/checkpoint-1000/trainer_state.json ADDED Viewed

	@@ -0,0 +1,116 @@

+{
+  "best_metric": null,
+  "best_model_checkpoint": null,
+  "epoch": 5.649717514124294,
+  "eval_steps": 500,
+  "global_step": 1000,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 1.0,
+      "grad_norm": 0.5113261938095093,
+      "learning_rate": 1.8333333333333333e-05,
+      "loss": 0.1617,
+      "step": 177
+    },
+    {
+      "epoch": 1.0,
+      "eval_accuracy": 0.9871559395695364,
+      "eval_f1": 0.9942739560323971,
+      "eval_loss": 0.03775998204946518,
+      "eval_precision": 0.9954126025089182,
+      "eval_recall": 0.9931379115611415,
+      "eval_runtime": 9.8126,
+      "eval_samples_per_second": 30.777,
+      "eval_steps_per_second": 3.873,
+      "step": 177
+    },
+    {
+      "epoch": 2.0,
+      "grad_norm": 0.3615623414516449,
+      "learning_rate": 1.6666666666666667e-05,
+      "loss": 0.0372,
+      "step": 354
+    },
+    {
+      "epoch": 2.0,
+      "eval_accuracy": 0.9891608029801324,
+      "eval_f1": 0.9940221302774663,
+      "eval_loss": 0.03091522306203842,
+      "eval_precision": 0.9949474681420761,
+      "eval_recall": 0.9930985120102964,
+      "eval_runtime": 8.9145,
+      "eval_samples_per_second": 33.878,
+      "eval_steps_per_second": 4.263,
+      "step": 354
+    },
+    {
+      "epoch": 3.0,
+      "grad_norm": 0.9381418824195862,
+      "learning_rate": 1.5000000000000002e-05,
+      "loss": 0.0295,
+      "step": 531
+    },
+    {
+      "epoch": 3.0,
+      "eval_accuracy": 0.9920322847682119,
+      "eval_f1": 0.9952843510071654,
+      "eval_loss": 0.02342694066464901,
+      "eval_precision": 0.995460875505807,
+      "eval_recall": 0.9951078891033975,
+      "eval_runtime": 10.0078,
+      "eval_samples_per_second": 30.176,
+      "eval_steps_per_second": 3.797,
+      "step": 531
+    },
+    {
+      "epoch": 4.0,
+      "grad_norm": 0.6691648364067078,
+      "learning_rate": 1.3333333333333333e-05,
+      "loss": 0.0249,
+      "step": 708
+    },
+    {
+      "epoch": 4.0,
+      "eval_accuracy": 0.9922974441225165,
+      "eval_f1": 0.9952737388699671,
+      "eval_loss": 0.021945813670754433,
+      "eval_precision": 0.9956105478272869,
+      "eval_recall": 0.994937157716402,
+      "eval_runtime": 8.0868,
+      "eval_samples_per_second": 37.345,
+      "eval_steps_per_second": 4.699,
+      "step": 708
+    },
+    {
+      "epoch": 5.0,
+      "grad_norm": 0.32520022988319397,
+      "learning_rate": 1.1666666666666668e-05,
+      "loss": 0.0216,
+      "step": 885
+    },
+    {
+      "epoch": 5.0,
+      "eval_accuracy": 0.9924720612582781,
+      "eval_f1": 0.9952702525159629,
+      "eval_loss": 0.020533699542284012,
+      "eval_precision": 0.9956496024183479,
+      "eval_recall": 0.9948911915737494,
+      "eval_runtime": 8.3353,
+      "eval_samples_per_second": 36.231,
+      "eval_steps_per_second": 4.559,
+      "step": 885
+    }
+  ],
+  "logging_steps": 500,
+  "max_steps": 2124,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 12,
+  "save_steps": 500,
+  "total_flos": 2084067713587200.0,
+  "train_batch_size": 8,
+  "trial_name": null,
+  "trial_params": null
+}

test_ner/checkpoint-1000/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:589411fcaa1011d1bc4a7f79bb7f19351dcf5e1ecdfe5e386f38e11ad600452f
+size 4920

test_ner/checkpoint-1000/vocab.json ADDED Viewed

The diff for this file is too large to render. See raw diff

test_ner/checkpoint-1500/config.json ADDED Viewed

	@@ -0,0 +1,59 @@

+{
+  "_name_or_path": "roberta-base",
+  "architectures": [
+    "RobertaForTokenClassification"
+  ],
+  "attention_probs_dropout_prob": 0.1,
+  "bos_token_id": 0,
+  "classifier_dropout": null,
+  "eos_token_id": 2,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.1,
+  "hidden_size": 768,
+  "id2label": {
+    "0": "B-callsign",
+    "1": "B-condition conjunction",
+    "10": "I-instruction type",
+    "11": "I-instruction unit",
+    "12": "I-instruction value",
+    "13": "O",
+    "2": "B-condition requirement",
+    "3": "B-instruction qualifier",
+    "4": "B-instruction type",
+    "5": "B-instruction unit",
+    "6": "B-instruction value",
+    "7": "I-callsign",
+    "8": "I-condition requirement",
+    "9": "I-instruction qualifier"
+  },
+  "initializer_range": 0.02,
+  "intermediate_size": 3072,
+  "label2id": {
+    "B-callsign": "0",
+    "B-condition conjunction": "1",
+    "B-condition requirement": "2",
+    "B-instruction qualifier": "3",
+    "B-instruction type": "4",
+    "B-instruction unit": "5",
+    "B-instruction value": "6",
+    "I-callsign": "7",
+    "I-condition requirement": "8",
+    "I-instruction qualifier": "9",
+    "I-instruction type": "10",
+    "I-instruction unit": "11",
+    "I-instruction value": "12",
+    "O": "13"
+  },
+  "layer_norm_eps": 1e-05,
+  "max_position_embeddings": 514,
+  "model_type": "roberta",
+  "num_attention_heads": 12,
+  "num_hidden_layers": 12,
+  "pad_token_id": 1,
+  "position_embedding_type": "absolute",
+  "torch_dtype": "float32",
+  "transformers_version": "4.39.1",
+  "type_vocab_size": 1,
+  "use_cache": true,
+  "vocab_size": 50265
+}

test_ner/checkpoint-1500/merges.txt ADDED Viewed

The diff for this file is too large to render. See raw diff

test_ner/checkpoint-1500/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:3cb114253fe876001a85cb79c7ed3eb75baac508e8cd70e8ca3a119d85e9ba6b
+size 496287152

test_ner/checkpoint-1500/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:759dbec0c5ab3216b786c83ff729abf1e3a21b71e2e0f4e2c575b56ebddefa2a
+size 992692794

test_ner/checkpoint-1500/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:c3dfb2abfecea1eda6f9930fba39d6248eb797844e9d8b7377defd90d15734fb
+size 14244

test_ner/checkpoint-1500/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:bc7b369353de906a352aa3b98a50910b2a8af028f3024d216feb0c91f655fee7
+size 1064

test_ner/checkpoint-1500/special_tokens_map.json ADDED Viewed

	@@ -0,0 +1,51 @@

+{
+  "bos_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "cls_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "eos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "mask_token": {
+    "content": "<mask>",
+    "lstrip": true,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "pad_token": {
+    "content": "<pad>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "sep_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "unk_token": {
+    "content": "<unk>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  }
+}

test_ner/checkpoint-1500/tokenizer_config.json ADDED Viewed

	@@ -0,0 +1,56 @@

+{
+  "add_prefix_space": false,
+  "added_tokens_decoder": {
+    "0": {
+      "content": "<s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "1": {
+      "content": "<pad>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "2": {
+      "content": "</s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "3": {
+      "content": "<unk>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "50264": {
+      "content": "<mask>",
+      "lstrip": true,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    }
+  },
+  "bos_token": "<s>",
+  "clean_up_tokenization_spaces": true,
+  "cls_token": "<s>",
+  "eos_token": "</s>",
+  "errors": "replace",
+  "mask_token": "<mask>",
+  "model_max_length": 512,
+  "pad_token": "<pad>",
+  "sep_token": "</s>",
+  "tokenizer_class": "RobertaTokenizer",
+  "unk_token": "<unk>"
+}

test_ner/checkpoint-1500/trainer_state.json ADDED Viewed

	@@ -0,0 +1,173 @@

+{
+  "best_metric": null,
+  "best_model_checkpoint": null,
+  "epoch": 8.474576271186441,
+  "eval_steps": 500,
+  "global_step": 1500,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 1.0,
+      "grad_norm": 0.5113261938095093,
+      "learning_rate": 1.8333333333333333e-05,
+      "loss": 0.1617,
+      "step": 177
+    },
+    {
+      "epoch": 1.0,
+      "eval_accuracy": 0.9871559395695364,
+      "eval_f1": 0.9942739560323971,
+      "eval_loss": 0.03775998204946518,
+      "eval_precision": 0.9954126025089182,
+      "eval_recall": 0.9931379115611415,
+      "eval_runtime": 9.8126,
+      "eval_samples_per_second": 30.777,
+      "eval_steps_per_second": 3.873,
+      "step": 177
+    },
+    {
+      "epoch": 2.0,
+      "grad_norm": 0.3615623414516449,
+      "learning_rate": 1.6666666666666667e-05,
+      "loss": 0.0372,
+      "step": 354
+    },
+    {
+      "epoch": 2.0,
+      "eval_accuracy": 0.9891608029801324,
+      "eval_f1": 0.9940221302774663,
+      "eval_loss": 0.03091522306203842,
+      "eval_precision": 0.9949474681420761,
+      "eval_recall": 0.9930985120102964,
+      "eval_runtime": 8.9145,
+      "eval_samples_per_second": 33.878,
+      "eval_steps_per_second": 4.263,
+      "step": 354
+    },
+    {
+      "epoch": 3.0,
+      "grad_norm": 0.9381418824195862,
+      "learning_rate": 1.5000000000000002e-05,
+      "loss": 0.0295,
+      "step": 531
+    },
+    {
+      "epoch": 3.0,
+      "eval_accuracy": 0.9920322847682119,
+      "eval_f1": 0.9952843510071654,
+      "eval_loss": 0.02342694066464901,
+      "eval_precision": 0.995460875505807,
+      "eval_recall": 0.9951078891033975,
+      "eval_runtime": 10.0078,
+      "eval_samples_per_second": 30.176,
+      "eval_steps_per_second": 3.797,
+      "step": 531
+    },
+    {
+      "epoch": 4.0,
+      "grad_norm": 0.6691648364067078,
+      "learning_rate": 1.3333333333333333e-05,
+      "loss": 0.0249,
+      "step": 708
+    },
+    {
+      "epoch": 4.0,
+      "eval_accuracy": 0.9922974441225165,
+      "eval_f1": 0.9952737388699671,
+      "eval_loss": 0.021945813670754433,
+      "eval_precision": 0.9956105478272869,
+      "eval_recall": 0.994937157716402,
+      "eval_runtime": 8.0868,
+      "eval_samples_per_second": 37.345,
+      "eval_steps_per_second": 4.699,
+      "step": 708
+    },
+    {
+      "epoch": 5.0,
+      "grad_norm": 0.32520022988319397,
+      "learning_rate": 1.1666666666666668e-05,
+      "loss": 0.0216,
+      "step": 885
+    },
+    {
+      "epoch": 5.0,
+      "eval_accuracy": 0.9924720612582781,
+      "eval_f1": 0.9952702525159629,
+      "eval_loss": 0.020533699542284012,
+      "eval_precision": 0.9956496024183479,
+      "eval_recall": 0.9948911915737494,
+      "eval_runtime": 8.3353,
+      "eval_samples_per_second": 36.231,
+      "eval_steps_per_second": 4.559,
+      "step": 885
+    },
+    {
+      "epoch": 6.0,
+      "grad_norm": 0.5477111339569092,
+      "learning_rate": 1e-05,
+      "loss": 0.0195,
+      "step": 1062
+    },
+    {
+      "epoch": 6.0,
+      "eval_accuracy": 0.9939078021523179,
+      "eval_f1": 0.9962434901391617,
+      "eval_loss": 0.017846418544650078,
+      "eval_precision": 0.9963547276883062,
+      "eval_recall": 0.9961322774253707,
+      "eval_runtime": 8.2755,
+      "eval_samples_per_second": 36.493,
+      "eval_steps_per_second": 4.592,
+      "step": 1062
+    },
+    {
+      "epoch": 7.0,
+      "grad_norm": 0.6245275139808655,
+      "learning_rate": 8.333333333333334e-06,
+      "loss": 0.0176,
+      "step": 1239
+    },
+    {
+      "epoch": 7.0,
+      "eval_accuracy": 0.9940048116721855,
+      "eval_f1": 0.9963592671260534,
+      "eval_loss": 0.018705232068896294,
+      "eval_precision": 0.9962382568620628,
+      "eval_recall": 0.9964803067911693,
+      "eval_runtime": 9.9312,
+      "eval_samples_per_second": 30.409,
+      "eval_steps_per_second": 3.826,
+      "step": 1239
+    },
+    {
+      "epoch": 8.0,
+      "grad_norm": 0.6405406594276428,
+      "learning_rate": 6.666666666666667e-06,
+      "loss": 0.0162,
+      "step": 1416
+    },
+    {
+      "epoch": 8.0,
+      "eval_accuracy": 0.9943411113410596,
+      "eval_f1": 0.9965161599611229,
+      "eval_loss": 0.017182840034365654,
+      "eval_precision": 0.9965914240491781,
+      "eval_recall": 0.9964409072403241,
+      "eval_runtime": 8.8446,
+      "eval_samples_per_second": 34.145,
+      "eval_steps_per_second": 4.296,
+      "step": 1416
+    }
+  ],
+  "logging_steps": 500,
+  "max_steps": 2124,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 12,
+  "save_steps": 500,
+  "total_flos": 3125448257617920.0,
+  "train_batch_size": 8,
+  "trial_name": null,
+  "trial_params": null
+}

test_ner/checkpoint-1500/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:589411fcaa1011d1bc4a7f79bb7f19351dcf5e1ecdfe5e386f38e11ad600452f
+size 4920

test_ner/checkpoint-1500/vocab.json ADDED Viewed

The diff for this file is too large to render. See raw diff

test_ner/checkpoint-2000/config.json ADDED Viewed

	@@ -0,0 +1,59 @@

+{
+  "_name_or_path": "roberta-base",
+  "architectures": [
+    "RobertaForTokenClassification"
+  ],
+  "attention_probs_dropout_prob": 0.1,
+  "bos_token_id": 0,
+  "classifier_dropout": null,
+  "eos_token_id": 2,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.1,
+  "hidden_size": 768,
+  "id2label": {
+    "0": "B-callsign",
+    "1": "B-condition conjunction",
+    "10": "I-instruction type",
+    "11": "I-instruction unit",
+    "12": "I-instruction value",
+    "13": "O",
+    "2": "B-condition requirement",
+    "3": "B-instruction qualifier",
+    "4": "B-instruction type",
+    "5": "B-instruction unit",
+    "6": "B-instruction value",
+    "7": "I-callsign",
+    "8": "I-condition requirement",
+    "9": "I-instruction qualifier"
+  },
+  "initializer_range": 0.02,
+  "intermediate_size": 3072,
+  "label2id": {
+    "B-callsign": "0",
+    "B-condition conjunction": "1",
+    "B-condition requirement": "2",
+    "B-instruction qualifier": "3",
+    "B-instruction type": "4",
+    "B-instruction unit": "5",
+    "B-instruction value": "6",
+    "I-callsign": "7",
+    "I-condition requirement": "8",
+    "I-instruction qualifier": "9",
+    "I-instruction type": "10",
+    "I-instruction unit": "11",
+    "I-instruction value": "12",
+    "O": "13"
+  },
+  "layer_norm_eps": 1e-05,
+  "max_position_embeddings": 514,
+  "model_type": "roberta",
+  "num_attention_heads": 12,
+  "num_hidden_layers": 12,
+  "pad_token_id": 1,
+  "position_embedding_type": "absolute",
+  "torch_dtype": "float32",
+  "transformers_version": "4.39.1",
+  "type_vocab_size": 1,
+  "use_cache": true,
+  "vocab_size": 50265
+}

test_ner/checkpoint-2000/merges.txt ADDED Viewed

The diff for this file is too large to render. See raw diff

test_ner/checkpoint-2000/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:63e4476d5dc931bdb8e8c0de135d136ac59f01852feaa5d48aaf0042f486fb05
+size 496287152

test_ner/checkpoint-2000/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:4e54951f4afd1c950dc282458e6b92468272aeb623d3f3a0859c14bcb52d7206
+size 992692794

test_ner/checkpoint-2000/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:814bf20401ee76a36f4021cc32fbf8663152c79b1d68538e9315ee92678820ce
+size 14244

test_ner/checkpoint-2000/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:39b8d1c11e09e5bfc35e2cf80dd825f265a89a10a0203834b563f8b3e8e69668
+size 1064

test_ner/checkpoint-2000/special_tokens_map.json ADDED Viewed

	@@ -0,0 +1,51 @@

+{
+  "bos_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "cls_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "eos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "mask_token": {
+    "content": "<mask>",
+    "lstrip": true,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "pad_token": {
+    "content": "<pad>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "sep_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "unk_token": {
+    "content": "<unk>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  }
+}

test_ner/checkpoint-2000/tokenizer_config.json ADDED Viewed

	@@ -0,0 +1,56 @@

+{
+  "add_prefix_space": false,
+  "added_tokens_decoder": {
+    "0": {
+      "content": "<s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "1": {
+      "content": "<pad>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "2": {
+      "content": "</s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "3": {
+      "content": "<unk>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "50264": {
+      "content": "<mask>",
+      "lstrip": true,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    }
+  },
+  "bos_token": "<s>",
+  "clean_up_tokenization_spaces": true,
+  "cls_token": "<s>",
+  "eos_token": "</s>",
+  "errors": "replace",
+  "mask_token": "<mask>",
+  "model_max_length": 512,
+  "pad_token": "<pad>",
+  "sep_token": "</s>",
+  "tokenizer_class": "RobertaTokenizer",
+  "unk_token": "<unk>"
+}

test_ner/checkpoint-2000/trainer_state.json ADDED Viewed

	@@ -0,0 +1,230 @@

+{
+  "best_metric": null,
+  "best_model_checkpoint": null,
+  "epoch": 11.299435028248588,
+  "eval_steps": 500,
+  "global_step": 2000,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 1.0,
+      "grad_norm": 0.5113261938095093,
+      "learning_rate": 1.8333333333333333e-05,
+      "loss": 0.1617,
+      "step": 177
+    },
+    {
+      "epoch": 1.0,
+      "eval_accuracy": 0.9871559395695364,
+      "eval_f1": 0.9942739560323971,
+      "eval_loss": 0.03775998204946518,
+      "eval_precision": 0.9954126025089182,
+      "eval_recall": 0.9931379115611415,
+      "eval_runtime": 9.8126,
+      "eval_samples_per_second": 30.777,
+      "eval_steps_per_second": 3.873,
+      "step": 177
+    },
+    {
+      "epoch": 2.0,
+      "grad_norm": 0.3615623414516449,
+      "learning_rate": 1.6666666666666667e-05,
+      "loss": 0.0372,
+      "step": 354
+    },
+    {
+      "epoch": 2.0,
+      "eval_accuracy": 0.9891608029801324,
+      "eval_f1": 0.9940221302774663,
+      "eval_loss": 0.03091522306203842,
+      "eval_precision": 0.9949474681420761,
+      "eval_recall": 0.9930985120102964,
+      "eval_runtime": 8.9145,
+      "eval_samples_per_second": 33.878,
+      "eval_steps_per_second": 4.263,
+      "step": 354
+    },
+    {
+      "epoch": 3.0,
+      "grad_norm": 0.9381418824195862,
+      "learning_rate": 1.5000000000000002e-05,
+      "loss": 0.0295,
+      "step": 531
+    },
+    {
+      "epoch": 3.0,
+      "eval_accuracy": 0.9920322847682119,
+      "eval_f1": 0.9952843510071654,
+      "eval_loss": 0.02342694066464901,
+      "eval_precision": 0.995460875505807,
+      "eval_recall": 0.9951078891033975,
+      "eval_runtime": 10.0078,
+      "eval_samples_per_second": 30.176,
+      "eval_steps_per_second": 3.797,
+      "step": 531
+    },
+    {
+      "epoch": 4.0,
+      "grad_norm": 0.6691648364067078,
+      "learning_rate": 1.3333333333333333e-05,
+      "loss": 0.0249,
+      "step": 708
+    },
+    {
+      "epoch": 4.0,
+      "eval_accuracy": 0.9922974441225165,
+      "eval_f1": 0.9952737388699671,
+      "eval_loss": 0.021945813670754433,
+      "eval_precision": 0.9956105478272869,
+      "eval_recall": 0.994937157716402,
+      "eval_runtime": 8.0868,
+      "eval_samples_per_second": 37.345,
+      "eval_steps_per_second": 4.699,
+      "step": 708
+    },
+    {
+      "epoch": 5.0,
+      "grad_norm": 0.32520022988319397,
+      "learning_rate": 1.1666666666666668e-05,
+      "loss": 0.0216,
+      "step": 885
+    },
+    {
+      "epoch": 5.0,
+      "eval_accuracy": 0.9924720612582781,
+      "eval_f1": 0.9952702525159629,
+      "eval_loss": 0.020533699542284012,
+      "eval_precision": 0.9956496024183479,
+      "eval_recall": 0.9948911915737494,
+      "eval_runtime": 8.3353,
+      "eval_samples_per_second": 36.231,
+      "eval_steps_per_second": 4.559,
+      "step": 885
+    },
+    {
+      "epoch": 6.0,
+      "grad_norm": 0.5477111339569092,
+      "learning_rate": 1e-05,
+      "loss": 0.0195,
+      "step": 1062
+    },
+    {
+      "epoch": 6.0,
+      "eval_accuracy": 0.9939078021523179,
+      "eval_f1": 0.9962434901391617,
+      "eval_loss": 0.017846418544650078,
+      "eval_precision": 0.9963547276883062,
+      "eval_recall": 0.9961322774253707,
+      "eval_runtime": 8.2755,
+      "eval_samples_per_second": 36.493,
+      "eval_steps_per_second": 4.592,
+      "step": 1062
+    },
+    {
+      "epoch": 7.0,
+      "grad_norm": 0.6245275139808655,
+      "learning_rate": 8.333333333333334e-06,
+      "loss": 0.0176,
+      "step": 1239
+    },
+    {
+      "epoch": 7.0,
+      "eval_accuracy": 0.9940048116721855,
+      "eval_f1": 0.9963592671260534,
+      "eval_loss": 0.018705232068896294,
+      "eval_precision": 0.9962382568620628,
+      "eval_recall": 0.9964803067911693,
+      "eval_runtime": 9.9312,
+      "eval_samples_per_second": 30.409,
+      "eval_steps_per_second": 3.826,
+      "step": 1239
+    },
+    {
+      "epoch": 8.0,
+      "grad_norm": 0.6405406594276428,
+      "learning_rate": 6.666666666666667e-06,
+      "loss": 0.0162,
+      "step": 1416
+    },
+    {
+      "epoch": 8.0,
+      "eval_accuracy": 0.9943411113410596,
+      "eval_f1": 0.9965161599611229,
+      "eval_loss": 0.017182840034365654,
+      "eval_precision": 0.9965914240491781,
+      "eval_recall": 0.9964409072403241,
+      "eval_runtime": 8.8446,
+      "eval_samples_per_second": 34.145,
+      "eval_steps_per_second": 4.296,
+      "step": 1416
+    },
+    {
+      "epoch": 9.0,
+      "grad_norm": 0.8095843195915222,
+      "learning_rate": 5e-06,
+      "loss": 0.015,
+      "step": 1593
+    },
+    {
+      "epoch": 9.0,
+      "eval_accuracy": 0.9945998033940397,
+      "eval_f1": 0.9968834461401037,
+      "eval_loss": 0.016317149624228477,
+      "eval_precision": 0.9971093898841785,
+      "eval_recall": 0.9966576047699723,
+      "eval_runtime": 8.7858,
+      "eval_samples_per_second": 34.374,
+      "eval_steps_per_second": 4.325,
+      "step": 1593
+    },
+    {
+      "epoch": 10.0,
+      "grad_norm": 0.3927808701992035,
+      "learning_rate": 3.3333333333333333e-06,
+      "loss": 0.0141,
+      "step": 1770
+    },
+    {
+      "epoch": 10.0,
+      "eval_accuracy": 0.9948067570364238,
+      "eval_f1": 0.9970283537736623,
+      "eval_loss": 0.016839241608977318,
+      "eval_precision": 0.9971167550029884,
+      "eval_recall": 0.9969399682176957,
+      "eval_runtime": 9.7882,
+      "eval_samples_per_second": 30.853,
+      "eval_steps_per_second": 3.882,
+      "step": 1770
+    },
+    {
+      "epoch": 11.0,
+      "grad_norm": 0.5813747644424438,
+      "learning_rate": 1.6666666666666667e-06,
+      "loss": 0.0133,
+      "step": 1947
+    },
+    {
+      "epoch": 11.0,
+      "eval_accuracy": 0.9949037665562914,
+      "eval_f1": 0.9969725029716755,
+      "eval_loss": 0.0163129735738039,
+      "eval_precision": 0.9970707229928542,
+      "eval_recall": 0.9968743022996205,
+      "eval_runtime": 8.115,
+      "eval_samples_per_second": 37.215,
+      "eval_steps_per_second": 4.683,
+      "step": 1947
+    }
+  ],
+  "logging_steps": 500,
+  "max_steps": 2124,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 12,
+  "save_steps": 500,
+  "total_flos": 4166828801648640.0,
+  "train_batch_size": 8,
+  "trial_name": null,
+  "trial_params": null
+}

test_ner/checkpoint-2000/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:589411fcaa1011d1bc4a7f79bb7f19351dcf5e1ecdfe5e386f38e11ad600452f
+size 4920

test_ner/checkpoint-2000/vocab.json ADDED Viewed

The diff for this file is too large to render. See raw diff

test_ner/checkpoint-500/config.json ADDED Viewed

	@@ -0,0 +1,59 @@

+{
+  "_name_or_path": "roberta-base",
+  "architectures": [
+    "RobertaForTokenClassification"
+  ],
+  "attention_probs_dropout_prob": 0.1,
+  "bos_token_id": 0,
+  "classifier_dropout": null,
+  "eos_token_id": 2,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.1,
+  "hidden_size": 768,
+  "id2label": {
+    "0": "B-callsign",
+    "1": "B-condition conjunction",
+    "10": "I-instruction type",
+    "11": "I-instruction unit",
+    "12": "I-instruction value",
+    "13": "O",
+    "2": "B-condition requirement",
+    "3": "B-instruction qualifier",
+    "4": "B-instruction type",
+    "5": "B-instruction unit",
+    "6": "B-instruction value",
+    "7": "I-callsign",
+    "8": "I-condition requirement",
+    "9": "I-instruction qualifier"
+  },
+  "initializer_range": 0.02,
+  "intermediate_size": 3072,
+  "label2id": {
+    "B-callsign": "0",
+    "B-condition conjunction": "1",
+    "B-condition requirement": "2",
+    "B-instruction qualifier": "3",
+    "B-instruction type": "4",
+    "B-instruction unit": "5",
+    "B-instruction value": "6",
+    "I-callsign": "7",
+    "I-condition requirement": "8",
+    "I-instruction qualifier": "9",
+    "I-instruction type": "10",
+    "I-instruction unit": "11",
+    "I-instruction value": "12",
+    "O": "13"
+  },
+  "layer_norm_eps": 1e-05,
+  "max_position_embeddings": 514,
+  "model_type": "roberta",
+  "num_attention_heads": 12,
+  "num_hidden_layers": 12,
+  "pad_token_id": 1,
+  "position_embedding_type": "absolute",
+  "torch_dtype": "float32",
+  "transformers_version": "4.39.1",
+  "type_vocab_size": 1,
+  "use_cache": true,
+  "vocab_size": 50265
+}

test_ner/checkpoint-500/merges.txt ADDED Viewed

The diff for this file is too large to render. See raw diff

test_ner/checkpoint-500/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:60c25af67f5a0adae595836902c211e42a4c2002e24a9d44b84068ad16c572a7
+size 496287152

test_ner/checkpoint-500/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:d6005a81030b2410fd4894e22c78b4a539f6cc593fcacb69f8037836792b6bc4
+size 992692794

test_ner/checkpoint-500/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:28e4535b8c14579a7d5d4f4aa94c3b782c0fa4069392a0636498e5d337f93ba7
+size 14244

test_ner/checkpoint-500/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:1b7091ce6d9cd0c3bec5f24484d6956083f067a883a5198af4777d551490cd99
+size 1064

test_ner/checkpoint-500/special_tokens_map.json ADDED Viewed

	@@ -0,0 +1,51 @@

+{
+  "bos_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "cls_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "eos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "mask_token": {
+    "content": "<mask>",
+    "lstrip": true,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "pad_token": {
+    "content": "<pad>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "sep_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "unk_token": {
+    "content": "<unk>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  }
+}

test_ner/checkpoint-500/tokenizer_config.json ADDED Viewed

	@@ -0,0 +1,56 @@

+{
+  "add_prefix_space": false,
+  "added_tokens_decoder": {
+    "0": {
+      "content": "<s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "1": {
+      "content": "<pad>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "2": {
+      "content": "</s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "3": {
+      "content": "<unk>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "50264": {
+      "content": "<mask>",
+      "lstrip": true,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    }
+  },
+  "bos_token": "<s>",
+  "clean_up_tokenization_spaces": true,
+  "cls_token": "<s>",
+  "eos_token": "</s>",
+  "errors": "replace",
+  "mask_token": "<mask>",
+  "model_max_length": 512,
+  "pad_token": "<pad>",
+  "sep_token": "</s>",
+  "tokenizer_class": "RobertaTokenizer",
+  "unk_token": "<unk>"
+}

test_ner/checkpoint-500/trainer_state.json ADDED Viewed

	@@ -0,0 +1,59 @@

+{
+  "best_metric": null,
+  "best_model_checkpoint": null,
+  "epoch": 2.824858757062147,
+  "eval_steps": 500,
+  "global_step": 500,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 1.0,
+      "grad_norm": 0.5113261938095093,
+      "learning_rate": 1.8333333333333333e-05,
+      "loss": 0.1617,
+      "step": 177
+    },
+    {
+      "epoch": 1.0,
+      "eval_accuracy": 0.9871559395695364,
+      "eval_f1": 0.9942739560323971,
+      "eval_loss": 0.03775998204946518,
+      "eval_precision": 0.9954126025089182,
+      "eval_recall": 0.9931379115611415,
+      "eval_runtime": 9.8126,
+      "eval_samples_per_second": 30.777,
+      "eval_steps_per_second": 3.873,
+      "step": 177
+    },
+    {
+      "epoch": 2.0,
+      "grad_norm": 0.3615623414516449,
+      "learning_rate": 1.6666666666666667e-05,
+      "loss": 0.0372,
+      "step": 354
+    },
+    {
+      "epoch": 2.0,
+      "eval_accuracy": 0.9891608029801324,
+      "eval_f1": 0.9940221302774663,
+      "eval_loss": 0.03091522306203842,
+      "eval_precision": 0.9949474681420761,
+      "eval_recall": 0.9930985120102964,
+      "eval_runtime": 8.9145,
+      "eval_samples_per_second": 33.878,
+      "eval_steps_per_second": 4.263,
+      "step": 354
+    }
+  ],
+  "logging_steps": 500,
+  "max_steps": 2124,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 12,
+  "save_steps": 500,
+  "total_flos": 1042687169556480.0,
+  "train_batch_size": 8,
+  "trial_name": null,
+  "trial_params": null
+}

test_ner/checkpoint-500/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:589411fcaa1011d1bc4a7f79bb7f19351dcf5e1ecdfe5e386f38e11ad600452f
+size 4920

test_ner/checkpoint-500/vocab.json ADDED Viewed

The diff for this file is too large to render. See raw diff

tokenizer/merges.txt ADDED Viewed

The diff for this file is too large to render. See raw diff

tokenizer/special_tokens_map.json ADDED Viewed

	@@ -0,0 +1,51 @@

+{
+  "bos_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "cls_token": {
+    "content": "<s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "eos_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "mask_token": {
+    "content": "<mask>",
+    "lstrip": true,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "pad_token": {
+    "content": "<pad>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "sep_token": {
+    "content": "</s>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  },
+  "unk_token": {
+    "content": "<unk>",
+    "lstrip": false,
+    "normalized": true,
+    "rstrip": false,
+    "single_word": false
+  }
+}

tokenizer/tokenizer_config.json ADDED Viewed

	@@ -0,0 +1,56 @@

+{
+  "add_prefix_space": false,
+  "added_tokens_decoder": {
+    "0": {
+      "content": "<s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "1": {
+      "content": "<pad>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "2": {
+      "content": "</s>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "3": {
+      "content": "<unk>",
+      "lstrip": false,
+      "normalized": true,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "50264": {
+      "content": "<mask>",
+      "lstrip": true,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    }
+  },
+  "bos_token": "<s>",
+  "clean_up_tokenization_spaces": true,
+  "cls_token": "<s>",
+  "eos_token": "</s>",
+  "errors": "replace",
+  "mask_token": "<mask>",
+  "model_max_length": 512,
+  "pad_token": "<pad>",
+  "sep_token": "</s>",
+  "tokenizer_class": "RobertaTokenizer",
+  "unk_token": "<unk>"
+}

tokenizer/vocab.json ADDED Viewed

The diff for this file is too large to render. See raw diff