Upload folder using huggingface_hub

Browse files

Files changed (12) hide show

all_runs/checkpoint-2912/added_tokens.json +3 -0
all_runs/checkpoint-2912/config.json +38 -0
all_runs/checkpoint-2912/model.safetensors +3 -0
all_runs/checkpoint-2912/optimizer.pt +3 -0
all_runs/checkpoint-2912/rng_state.pth +3 -0
all_runs/checkpoint-2912/scheduler.pt +3 -0
all_runs/checkpoint-2912/special_tokens_map.json +13 -0
all_runs/checkpoint-2912/tokenizer.json +0 -0
all_runs/checkpoint-2912/tokenizer_config.json +63 -0
all_runs/checkpoint-2912/trainer_state.json +342 -0
all_runs/checkpoint-2912/training_args.bin +3 -0
all_runs/checkpoint-2912/vocab.txt +0 -0

all_runs/checkpoint-2912/added_tokens.json ADDED Viewed

	@@ -0,0 +1,3 @@

+{
+  "<pad>": 28996
+}

all_runs/checkpoint-2912/config.json ADDED Viewed

	@@ -0,0 +1,38 @@

+{
+  "_name_or_path": "distilbert/distilbert-base-cased",
+  "activation": "gelu",
+  "architectures": [
+    "DistilBertForSequenceClassification"
+  ],
+  "attention_dropout": 0.1,
+  "dim": 768,
+  "dropout": 0.1,
+  "hidden_dim": 3072,
+  "id2label": {
+    "0": "positive",
+    "1": "negative",
+    "2": "neutral",
+    "3": "rel_by_party"
+  },
+  "initializer_range": 0.02,
+  "label2id": {
+    "negative": 1,
+    "neutral": 2,
+    "positive": 0,
+    "rel_by_party": 3
+  },
+  "max_position_embeddings": 512,
+  "model_type": "distilbert",
+  "n_heads": 12,
+  "n_layers": 6,
+  "output_past": true,
+  "pad_token_id": 28996,
+  "problem_type": "single_label_classification",
+  "qa_dropout": 0.1,
+  "seq_classif_dropout": 0.2,
+  "sinusoidal_pos_embds": false,
+  "tie_weights_": true,
+  "torch_dtype": "float32",
+  "transformers_version": "4.40.2",
+  "vocab_size": 28997
+}

all_runs/checkpoint-2912/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:045813fb304375524765defb2314e02c317ce921eb8df69bc4608be4f93e63d6
+size 263153912

all_runs/checkpoint-2912/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:df454e256ed3598c4a80ec00ade3f8dbba1325c70c0169a865ef98d6c80f5e84
+size 526369978

all_runs/checkpoint-2912/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b64bf4b4c6b40fab1a3ada5363f5aca1e5a78ae939a935b290ef2b4446abed7e
+size 14244

all_runs/checkpoint-2912/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:afe6d0516788adb822b5c806c01f0510f4ff3b63f4d1dd7bff40c1c7f726b8cc
+size 1064

all_runs/checkpoint-2912/special_tokens_map.json ADDED Viewed

	@@ -0,0 +1,13 @@

+{
+  "cls_token": "[CLS]",
+  "mask_token": "[MASK]",
+  "pad_token": {
+    "content": "<pad>",
+    "lstrip": false,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "sep_token": "[SEP]",
+  "unk_token": "[UNK]"
+}

all_runs/checkpoint-2912/tokenizer.json ADDED Viewed

The diff for this file is too large to render. See raw diff

all_runs/checkpoint-2912/tokenizer_config.json ADDED Viewed

	@@ -0,0 +1,63 @@

+{
+  "added_tokens_decoder": {
+    "0": {
+      "content": "[PAD]",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "100": {
+      "content": "[UNK]",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "101": {
+      "content": "[CLS]",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "102": {
+      "content": "[SEP]",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "103": {
+      "content": "[MASK]",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "28996": {
+      "content": "<pad>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    }
+  },
+  "clean_up_tokenization_spaces": true,
+  "cls_token": "[CLS]",
+  "do_lower_case": false,
+  "mask_token": "[MASK]",
+  "model_max_length": 512,
+  "pad_token": "<pad>",
+  "sep_token": "[SEP]",
+  "strip_accents": null,
+  "tokenize_chinese_chars": true,
+  "tokenizer_class": "DistilBertTokenizer",
+  "unk_token": "[UNK]"
+}

all_runs/checkpoint-2912/trainer_state.json ADDED Viewed

	@@ -0,0 +1,342 @@

+{
+  "best_metric": 0.6301119928151375,
+  "best_model_checkpoint": "case-analysis-distilbert-base-cased/checkpoint-896",
+  "epoch": 13.0,
+  "eval_steps": 500,
+  "global_step": 2912,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 1.0,
+      "eval_accuracy": 0.7661469933184856,
+      "eval_f1_macro": 0.5270352134866867,
+      "eval_f1_micro": 0.7661469933184856,
+      "eval_f1_weighted": 0.7333313004442764,
+      "eval_loss": 0.7000867128372192,
+      "eval_macro_fpr": 0.1330263157894737,
+      "eval_macro_sensitivity": 0.5137440725676019,
+      "eval_macro_specificity": 0.8818942592408516,
+      "eval_precision": 0.7310834070149471,
+      "eval_precision_macro": 0.5790641299401408,
+      "eval_recall": 0.7661469933184856,
+      "eval_recall_macro": 0.5137440725676019,
+      "eval_runtime": 5.4998,
+      "eval_samples_per_second": 81.639,
+      "eval_steps_per_second": 10.364,
+      "eval_weighted_fpr": 0.09234828496042216,
+      "eval_weighted_sensitivity": 0.7661469933184856,
+      "eval_weighted_specificity": 0.761430043644921,
+      "step": 224
+    },
+    {
+      "epoch": 2.0,
+      "eval_accuracy": 0.7750556792873051,
+      "eval_f1_macro": 0.5486718521990608,
+      "eval_f1_micro": 0.775055679287305,
+      "eval_f1_weighted": 0.7492575717498114,
+      "eval_loss": 0.7387592792510986,
+      "eval_macro_fpr": 0.12078200823200373,
+      "eval_macro_sensitivity": 0.5464266787796199,
+      "eval_macro_specificity": 0.8914743027952345,
+      "eval_precision": 0.7315284458297402,
+      "eval_precision_macro": 0.5585311316366537,
+      "eval_recall": 0.7750556792873051,
+      "eval_recall_macro": 0.5464266787796199,
+      "eval_runtime": 23.5227,
+      "eval_samples_per_second": 19.088,
+      "eval_steps_per_second": 2.423,
+      "eval_weighted_fpr": 0.08820960698689956,
+      "eval_weighted_sensitivity": 0.7750556792873051,
+      "eval_weighted_specificity": 0.7908415318936333,
+      "step": 448
+    },
+    {
+      "epoch": 2.232142857142857,
+      "grad_norm": 22.91168785095215,
+      "learning_rate": 4.629464285714286e-05,
+      "loss": 0.7066,
+      "step": 500
+    },
+    {
+      "epoch": 3.0,
+      "eval_accuracy": 0.8017817371937639,
+      "eval_f1_macro": 0.576677451756589,
+      "eval_f1_micro": 0.8017817371937639,
+      "eval_f1_weighted": 0.7759761601356532,
+      "eval_loss": 0.7228724956512451,
+      "eval_macro_fpr": 0.10757194512338594,
+      "eval_macro_sensitivity": 0.5707859310800487,
+      "eval_macro_specificity": 0.9026901603449184,
+      "eval_precision": 0.7604834726234316,
+      "eval_precision_macro": 0.5932281353135314,
+      "eval_recall": 0.8017817371937639,
+      "eval_recall_macro": 0.5707859310800487,
+      "eval_runtime": 17.5142,
+      "eval_samples_per_second": 25.636,
+      "eval_steps_per_second": 3.254,
+      "eval_weighted_fpr": 0.07613344739093242,
+      "eval_weighted_sensitivity": 0.8017817371937639,
+      "eval_weighted_specificity": 0.8089789041859096,
+      "step": 672
+    },
+    {
+      "epoch": 4.0,
+      "eval_accuracy": 0.8062360801781737,
+      "eval_f1_macro": 0.6301119928151375,
+      "eval_f1_micro": 0.8062360801781738,
+      "eval_f1_weighted": 0.7933630533945198,
+      "eval_loss": 0.8331468105316162,
+      "eval_macro_fpr": 0.10175133159747105,
+      "eval_macro_sensitivity": 0.6114882070764424,
+      "eval_macro_specificity": 0.9069973738423197,
+      "eval_precision": 0.7896315051078991,
+      "eval_precision_macro": 0.6674639062867935,
+      "eval_recall": 0.8062360801781737,
+      "eval_recall_macro": 0.6114882070764424,
+      "eval_runtime": 17.9901,
+      "eval_samples_per_second": 24.958,
+      "eval_steps_per_second": 3.168,
+      "eval_weighted_fpr": 0.0741687979539642,
+      "eval_weighted_sensitivity": 0.8062360801781737,
+      "eval_weighted_specificity": 0.8217534151911048,
+      "step": 896
+    },
+    {
+      "epoch": 4.464285714285714,
+      "grad_norm": 0.23617026209831238,
+      "learning_rate": 4.258184523809524e-05,
+      "loss": 0.3654,
+      "step": 1000
+    },
+    {
+      "epoch": 5.0,
+      "eval_accuracy": 0.7683741648106904,
+      "eval_f1_macro": 0.5896043825978781,
+      "eval_f1_micro": 0.7683741648106904,
+      "eval_f1_weighted": 0.7610828501277613,
+      "eval_loss": 1.2299734354019165,
+      "eval_macro_fpr": 0.10662840460883276,
+      "eval_macro_sensitivity": 0.6130556645262528,
+      "eval_macro_specificity": 0.9056447032260023,
+      "eval_precision": 0.7698582566254396,
+      "eval_precision_macro": 0.6085394130060126,
+      "eval_recall": 0.7683741648106904,
+      "eval_recall_macro": 0.6130556645262528,
+      "eval_runtime": 19.5517,
+      "eval_samples_per_second": 22.965,
+      "eval_steps_per_second": 2.915,
+      "eval_weighted_fpr": 0.0913081650570676,
+      "eval_weighted_sensitivity": 0.7683741648106904,
+      "eval_weighted_specificity": 0.8542046480933186,
+      "step": 1120
+    },
+    {
+      "epoch": 6.0,
+      "eval_accuracy": 0.8129175946547884,
+      "eval_f1_macro": 0.6299577384875399,
+      "eval_f1_micro": 0.8129175946547884,
+      "eval_f1_weighted": 0.7972266629935387,
+      "eval_loss": 1.0698440074920654,
+      "eval_macro_fpr": 0.09572659519735909,
+      "eval_macro_sensitivity": 0.6152769461592991,
+      "eval_macro_specificity": 0.9133810019905357,
+      "eval_precision": 0.7940368363876591,
+      "eval_precision_macro": 0.6863588955891834,
+      "eval_recall": 0.8129175946547884,
+      "eval_recall_macro": 0.6152769461592991,
+      "eval_runtime": 21.7346,
+      "eval_samples_per_second": 20.658,
+      "eval_steps_per_second": 2.623,
+      "eval_weighted_fpr": 0.07124681933842239,
+      "eval_weighted_sensitivity": 0.8129175946547884,
+      "eval_weighted_specificity": 0.8406064133073544,
+      "step": 1344
+    },
+    {
+      "epoch": 6.696428571428571,
+      "grad_norm": 0.6412457823753357,
+      "learning_rate": 3.8869047619047625e-05,
+      "loss": 0.2047,
+      "step": 1500
+    },
+    {
+      "epoch": 7.0,
+      "eval_accuracy": 0.7884187082405345,
+      "eval_f1_macro": 0.6141215790585401,
+      "eval_f1_micro": 0.7884187082405345,
+      "eval_f1_weighted": 0.7892035783447391,
+      "eval_loss": 1.3299829959869385,
+      "eval_macro_fpr": 0.10442766929340637,
+      "eval_macro_sensitivity": 0.5958936400112871,
+      "eval_macro_specificity": 0.9076274830150074,
+      "eval_precision": 0.7959953084611945,
+      "eval_precision_macro": 0.6412251711254097,
+      "eval_recall": 0.7884187082405345,
+      "eval_recall_macro": 0.5958936400112871,
+      "eval_runtime": 19.4013,
+      "eval_samples_per_second": 23.143,
+      "eval_steps_per_second": 2.938,
+      "eval_weighted_fpr": 0.08210890233362143,
+      "eval_weighted_sensitivity": 0.7884187082405345,
+      "eval_weighted_specificity": 0.842091223819495,
+      "step": 1568
+    },
+    {
+      "epoch": 8.0,
+      "eval_accuracy": 0.8106904231625836,
+      "eval_f1_macro": 0.6163443598585857,
+      "eval_f1_micro": 0.8106904231625834,
+      "eval_f1_weighted": 0.7947158089605988,
+      "eval_loss": 1.3869845867156982,
+      "eval_macro_fpr": 0.09827643474073441,
+      "eval_macro_sensitivity": 0.6062894445247387,
+      "eval_macro_specificity": 0.9106173671247473,
+      "eval_precision": 0.7860704056527595,
+      "eval_precision_macro": 0.6466819479006202,
+      "eval_recall": 0.8106904231625836,
+      "eval_recall_macro": 0.6062894445247387,
+      "eval_runtime": 24.9242,
+      "eval_samples_per_second": 18.015,
+      "eval_steps_per_second": 2.287,
+      "eval_weighted_fpr": 0.07221750212404418,
+      "eval_weighted_sensitivity": 0.8106904231625836,
+      "eval_weighted_specificity": 0.8317790453364052,
+      "step": 1792
+    },
+    {
+      "epoch": 8.928571428571429,
+      "grad_norm": 0.009310582652688026,
+      "learning_rate": 3.5156250000000004e-05,
+      "loss": 0.0795,
+      "step": 2000
+    },
+    {
+      "epoch": 9.0,
+      "eval_accuracy": 0.7951002227171492,
+      "eval_f1_macro": 0.6036078586352096,
+      "eval_f1_micro": 0.7951002227171492,
+      "eval_f1_weighted": 0.7803481654390761,
+      "eval_loss": 1.5031198263168335,
+      "eval_macro_fpr": 0.10395014224349126,
+      "eval_macro_sensitivity": 0.596858890976538,
+      "eval_macro_specificity": 0.9067643380561508,
+      "eval_precision": 0.7719081858839341,
+      "eval_precision_macro": 0.6275149499476224,
+      "eval_recall": 0.7951002227171492,
+      "eval_recall_macro": 0.596858890976538,
+      "eval_runtime": 19.5528,
+      "eval_samples_per_second": 22.964,
+      "eval_steps_per_second": 2.915,
+      "eval_weighted_fpr": 0.07910576096302666,
+      "eval_weighted_sensitivity": 0.7951002227171492,
+      "eval_weighted_specificity": 0.8319571295074538,
+      "step": 2016
+    },
+    {
+      "epoch": 10.0,
+      "eval_accuracy": 0.7728285077951003,
+      "eval_f1_macro": 0.6196001194983027,
+      "eval_f1_micro": 0.7728285077951002,
+      "eval_f1_weighted": 0.7758603070332255,
+      "eval_loss": 1.6303768157958984,
+      "eval_macro_fpr": 0.10604441860615665,
+      "eval_macro_sensitivity": 0.6233043585984762,
+      "eval_macro_specificity": 0.9072269655447398,
+      "eval_precision": 0.7796278998362599,
+      "eval_precision_macro": 0.6171087696246884,
+      "eval_recall": 0.7728285077951003,
+      "eval_recall_macro": 0.6233043585984762,
+      "eval_runtime": 17.8727,
+      "eval_samples_per_second": 25.122,
+      "eval_steps_per_second": 3.189,
+      "eval_weighted_fpr": 0.08923884514435695,
+      "eval_weighted_sensitivity": 0.7728285077951003,
+      "eval_weighted_specificity": 0.8560793543838588,
+      "step": 2240
+    },
+    {
+      "epoch": 11.0,
+      "eval_accuracy": 0.8040089086859689,
+      "eval_f1_macro": 0.60971035256129,
+      "eval_f1_micro": 0.8040089086859689,
+      "eval_f1_weighted": 0.7884103774950618,
+      "eval_loss": 1.6553305387496948,
+      "eval_macro_fpr": 0.10029712404712406,
+      "eval_macro_sensitivity": 0.6047305900247076,
+      "eval_macro_specificity": 0.9093226487010472,
+      "eval_precision": 0.7801791198576906,
+      "eval_precision_macro": 0.6404694360494954,
+      "eval_recall": 0.8040089086859689,
+      "eval_recall_macro": 0.6047305900247076,
+      "eval_runtime": 18.7706,
+      "eval_samples_per_second": 23.92,
+      "eval_steps_per_second": 3.037,
+      "eval_weighted_fpr": 0.07514944491887275,
+      "eval_weighted_sensitivity": 0.8040089086859689,
+      "eval_weighted_specificity": 0.83328168611822,
+      "step": 2464
+    },
+    {
+      "epoch": 11.160714285714286,
+      "grad_norm": 0.003156836610287428,
+      "learning_rate": 3.143601190476191e-05,
+      "loss": 0.0309,
+      "step": 2500
+    },
+    {
+      "epoch": 12.0,
+      "eval_accuracy": 0.799554565701559,
+      "eval_f1_macro": 0.6072980420599631,
+      "eval_f1_micro": 0.799554565701559,
+      "eval_f1_weighted": 0.7860582530348104,
+      "eval_loss": 1.6668155193328857,
+      "eval_macro_fpr": 0.09988889279594411,
+      "eval_macro_sensitivity": 0.6084453437394614,
+      "eval_macro_specificity": 0.9106688993495651,
+      "eval_precision": 0.777569146196374,
+      "eval_precision_macro": 0.6247320881812615,
+      "eval_recall": 0.799554565701559,
+      "eval_recall_macro": 0.6084453437394614,
+      "eval_runtime": 17.8921,
+      "eval_samples_per_second": 25.095,
+      "eval_steps_per_second": 3.186,
+      "eval_weighted_fpr": 0.07712082262210797,
+      "eval_weighted_sensitivity": 0.799554565701559,
+      "eval_weighted_specificity": 0.8431210316967014,
+      "step": 2688
+    },
+    {
+      "epoch": 13.0,
+      "eval_accuracy": 0.8040089086859689,
+      "eval_f1_macro": 0.5912164538573286,
+      "eval_f1_micro": 0.8040089086859689,
+      "eval_f1_weighted": 0.7845547674905504,
+      "eval_loss": 1.7547632455825806,
+      "eval_macro_fpr": 0.10303078503610634,
+      "eval_macro_sensitivity": 0.5846762537939009,
+      "eval_macro_specificity": 0.9063991203807322,
+      "eval_precision": 0.7724328584664579,
+      "eval_precision_macro": 0.6059236646315017,
+      "eval_recall": 0.8040089086859689,
+      "eval_recall_macro": 0.5846762537939009,
+      "eval_runtime": 18.8418,
+      "eval_samples_per_second": 23.83,
+      "eval_steps_per_second": 3.025,
+      "eval_weighted_fpr": 0.07514944491887275,
+      "eval_weighted_sensitivity": 0.8040089086859689,
+      "eval_weighted_specificity": 0.8215875728369607,
+      "step": 2912
+    }
+  ],
+  "logging_steps": 500,
+  "max_steps": 6720,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 30,
+  "save_steps": 500,
+  "total_flos": 3086070586540032.0,
+  "train_batch_size": 8,
+  "trial_name": null,
+  "trial_params": null
+}

all_runs/checkpoint-2912/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:3168244efe16c0aeafe631cea29ca8c9c2bbb665a169c0d40c2e4d22eaca40d9
+size 5048

all_runs/checkpoint-2912/vocab.txt ADDED Viewed

The diff for this file is too large to render. See raw diff