thkim0305
/

feddat_baselines

Model card Files Files and versions Community

thkim0305 commited on 6 days ago

Commit

08c4bfe

verified ·

1 Parent(s): c6c0078

Upload folder using huggingface_hub

Browse files

This view is limited to 50 files because it contains too many changes. See raw diff

Files changed (50) hide show

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round10.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round12.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round15.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round17.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round2.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round20.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round5.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round7.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_trainer_state.json +392 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round10.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round12.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round15.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round17.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round2.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round20.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round5.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round7.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_trainer_state.json +392 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round10.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round12.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round15.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round17.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round2.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round20.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round5.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round7.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_trainer_state.json +392 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round10.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round12.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round15.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round17.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round2.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round20.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round5.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round7.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_trainer_state.json +392 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round10.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round12.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round15.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round17.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round2.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round20.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round5.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round7.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_trainer_state.json +392 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round10.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round12.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round15.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round17.pth +3 -0
client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round2.pth +3 -0

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round10.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:d7a4d0d6615d2510711f99c6b666e858a2598446d3263d37eed691a52c48cafa
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round12.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:8467983a8faf53ac385f579b43f293895165ec3553aa52dcb326de610583d6a0
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round15.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b5bf18123b293dbbba941833be776184ede92ebbb3304e9365d5bf968ecc50b6
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round17.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:35940a8c8eddd6b7454570d0e6c61016292d9d2e5197647f71eb2ddcdb093c33
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round2.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:ea4a6fb5a88281d0acef0944c1cc603e502dfe0190a9f8f36296a7c9476d566a
+size 184220842

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round20.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:468aaa38b2dbdf861f538b48b6969482f6d8913aeac15e921782031762a86c89
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round5.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:eed2f8b54154e62827fc7ccb130532f5449940421549b41b08b74e89ff8a3b4c
+size 184220842

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_client_model_round7.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:81889dbecd6a4ea0784812af1ca62a08caa07cf01b024f7335fd93dd392681c9
+size 184220842

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/0_trainer_state.json ADDED Viewed

	@@ -0,0 +1,392 @@

+{
+  "best_metric": null,
+  "best_model_checkpoint": null,
+  "epoch": 1.0,
+  "eval_steps": 500,
+  "global_step": 100,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.02,
+      "grad_norm": 1.4507830142974854,
+      "learning_rate": 2e-05,
+      "loss": 0.2925,
+      "step": 2
+    },
+    {
+      "epoch": 0.04,
+      "grad_norm": 3.2782809734344482,
+      "learning_rate": 2e-05,
+      "loss": 0.5226,
+      "step": 4
+    },
+    {
+      "epoch": 0.06,
+      "grad_norm": 3.6665804386138916,
+      "learning_rate": 2e-05,
+      "loss": 0.4469,
+      "step": 6
+    },
+    {
+      "epoch": 0.08,
+      "grad_norm": 6.7659735679626465,
+      "learning_rate": 2e-05,
+      "loss": 0.6084,
+      "step": 8
+    },
+    {
+      "epoch": 0.1,
+      "grad_norm": 2.461778163909912,
+      "learning_rate": 2e-05,
+      "loss": 0.6173,
+      "step": 10
+    },
+    {
+      "epoch": 0.12,
+      "grad_norm": 0.8903517723083496,
+      "learning_rate": 2e-05,
+      "loss": 0.095,
+      "step": 12
+    },
+    {
+      "epoch": 0.14,
+      "grad_norm": 4.321805000305176,
+      "learning_rate": 2e-05,
+      "loss": 0.4503,
+      "step": 14
+    },
+    {
+      "epoch": 0.16,
+      "grad_norm": 2.4119670391082764,
+      "learning_rate": 2e-05,
+      "loss": 0.3114,
+      "step": 16
+    },
+    {
+      "epoch": 0.18,
+      "grad_norm": 4.858500003814697,
+      "learning_rate": 2e-05,
+      "loss": 0.3571,
+      "step": 18
+    },
+    {
+      "epoch": 0.2,
+      "grad_norm": 3.7888195514678955,
+      "learning_rate": 2e-05,
+      "loss": 0.8946,
+      "step": 20
+    },
+    {
+      "epoch": 0.22,
+      "grad_norm": 0.9685637950897217,
+      "learning_rate": 2e-05,
+      "loss": 0.1218,
+      "step": 22
+    },
+    {
+      "epoch": 0.24,
+      "grad_norm": 6.1121015548706055,
+      "learning_rate": 2e-05,
+      "loss": 0.5919,
+      "step": 24
+    },
+    {
+      "epoch": 0.26,
+      "grad_norm": 5.337240219116211,
+      "learning_rate": 2e-05,
+      "loss": 0.366,
+      "step": 26
+    },
+    {
+      "epoch": 0.28,
+      "grad_norm": 4.253252983093262,
+      "learning_rate": 2e-05,
+      "loss": 0.4007,
+      "step": 28
+    },
+    {
+      "epoch": 0.3,
+      "grad_norm": 8.691818237304688,
+      "learning_rate": 2e-05,
+      "loss": 0.9219,
+      "step": 30
+    },
+    {
+      "epoch": 0.32,
+      "grad_norm": 4.221813201904297,
+      "learning_rate": 2e-05,
+      "loss": 0.3515,
+      "step": 32
+    },
+    {
+      "epoch": 0.34,
+      "grad_norm": 6.260042667388916,
+      "learning_rate": 2e-05,
+      "loss": 0.8002,
+      "step": 34
+    },
+    {
+      "epoch": 0.36,
+      "grad_norm": 11.410113334655762,
+      "learning_rate": 2e-05,
+      "loss": 1.451,
+      "step": 36
+    },
+    {
+      "epoch": 0.38,
+      "grad_norm": 3.6883702278137207,
+      "learning_rate": 2e-05,
+      "loss": 0.3644,
+      "step": 38
+    },
+    {
+      "epoch": 0.4,
+      "grad_norm": 2.033090353012085,
+      "learning_rate": 2e-05,
+      "loss": 0.2821,
+      "step": 40
+    },
+    {
+      "epoch": 0.42,
+      "grad_norm": 6.383613109588623,
+      "learning_rate": 2e-05,
+      "loss": 1.392,
+      "step": 42
+    },
+    {
+      "epoch": 0.44,
+      "grad_norm": 2.7196388244628906,
+      "learning_rate": 2e-05,
+      "loss": 0.1335,
+      "step": 44
+    },
+    {
+      "epoch": 0.46,
+      "grad_norm": 9.112273216247559,
+      "learning_rate": 2e-05,
+      "loss": 1.9183,
+      "step": 46
+    },
+    {
+      "epoch": 0.48,
+      "grad_norm": 4.017404556274414,
+      "learning_rate": 2e-05,
+      "loss": 0.5077,
+      "step": 48
+    },
+    {
+      "epoch": 0.5,
+      "grad_norm": 0.14292454719543457,
+      "learning_rate": 2e-05,
+      "loss": 0.323,
+      "step": 50
+    },
+    {
+      "epoch": 0.52,
+      "grad_norm": 2.870044469833374,
+      "learning_rate": 2e-05,
+      "loss": 0.679,
+      "step": 52
+    },
+    {
+      "epoch": 0.54,
+      "grad_norm": 7.838882923126221,
+      "learning_rate": 2e-05,
+      "loss": 0.5556,
+      "step": 54
+    },
+    {
+      "epoch": 0.56,
+      "grad_norm": 1.5267337560653687,
+      "learning_rate": 2e-05,
+      "loss": 0.6559,
+      "step": 56
+    },
+    {
+      "epoch": 0.58,
+      "grad_norm": 4.8004374504089355,
+      "learning_rate": 2e-05,
+      "loss": 1.1925,
+      "step": 58
+    },
+    {
+      "epoch": 0.6,
+      "grad_norm": 0.9164693355560303,
+      "learning_rate": 2e-05,
+      "loss": 0.3563,
+      "step": 60
+    },
+    {
+      "epoch": 0.62,
+      "grad_norm": 10.06078815460205,
+      "learning_rate": 2e-05,
+      "loss": 1.1676,
+      "step": 62
+    },
+    {
+      "epoch": 0.64,
+      "grad_norm": 4.685103416442871,
+      "learning_rate": 2e-05,
+      "loss": 0.4408,
+      "step": 64
+    },
+    {
+      "epoch": 0.66,
+      "grad_norm": 2.2955524921417236,
+      "learning_rate": 2e-05,
+      "loss": 0.1538,
+      "step": 66
+    },
+    {
+      "epoch": 0.68,
+      "grad_norm": 2.193854331970215,
+      "learning_rate": 2e-05,
+      "loss": 0.8281,
+      "step": 68
+    },
+    {
+      "epoch": 0.7,
+      "grad_norm": 0.9019300937652588,
+      "learning_rate": 2e-05,
+      "loss": 1.1189,
+      "step": 70
+    },
+    {
+      "epoch": 0.72,
+      "grad_norm": 10.440985679626465,
+      "learning_rate": 2e-05,
+      "loss": 2.1768,
+      "step": 72
+    },
+    {
+      "epoch": 0.74,
+      "grad_norm": 2.911909818649292,
+      "learning_rate": 2e-05,
+      "loss": 0.7279,
+      "step": 74
+    },
+    {
+      "epoch": 0.76,
+      "grad_norm": 0.03667999058961868,
+      "learning_rate": 2e-05,
+      "loss": 0.115,
+      "step": 76
+    },
+    {
+      "epoch": 0.78,
+      "grad_norm": 2.2721805572509766,
+      "learning_rate": 2e-05,
+      "loss": 0.1444,
+      "step": 78
+    },
+    {
+      "epoch": 0.8,
+      "grad_norm": 2.097175121307373,
+      "learning_rate": 2e-05,
+      "loss": 0.2108,
+      "step": 80
+    },
+    {
+      "epoch": 0.82,
+      "grad_norm": 0.7106596231460571,
+      "learning_rate": 2e-05,
+      "loss": 0.0699,
+      "step": 82
+    },
+    {
+      "epoch": 0.84,
+      "grad_norm": 2.563626766204834,
+      "learning_rate": 2e-05,
+      "loss": 0.1482,
+      "step": 84
+    },
+    {
+      "epoch": 0.86,
+      "grad_norm": 0.34837377071380615,
+      "learning_rate": 2e-05,
+      "loss": 0.0672,
+      "step": 86
+    },
+    {
+      "epoch": 0.88,
+      "grad_norm": 0.41047564148902893,
+      "learning_rate": 2e-05,
+      "loss": 0.3899,
+      "step": 88
+    },
+    {
+      "epoch": 0.9,
+      "grad_norm": 0.7772120833396912,
+      "learning_rate": 2e-05,
+      "loss": 0.0882,
+      "step": 90
+    },
+    {
+      "epoch": 0.92,
+      "grad_norm": 0.9385977387428284,
+      "learning_rate": 2e-05,
+      "loss": 1.0358,
+      "step": 92
+    },
+    {
+      "epoch": 0.94,
+      "grad_norm": 6.794859886169434,
+      "learning_rate": 2e-05,
+      "loss": 1.1388,
+      "step": 94
+    },
+    {
+      "epoch": 0.96,
+      "grad_norm": 8.23221492767334,
+      "learning_rate": 2e-05,
+      "loss": 0.3678,
+      "step": 96
+    },
+    {
+      "epoch": 0.98,
+      "grad_norm": 0.18338899314403534,
+      "learning_rate": 2e-05,
+      "loss": 0.2155,
+      "step": 98
+    },
+    {
+      "epoch": 1.0,
+      "grad_norm": 0.3215850591659546,
+      "learning_rate": 2e-05,
+      "loss": 0.0276,
+      "step": 100
+    },
+    {
+      "epoch": 1.0,
+      "step": 100,
+      "total_flos": 2053446886752256.0,
+      "train_loss": 0.5718875336647034,
+      "train_runtime": 100.3201,
+      "train_samples_per_second": 3.987,
+      "train_steps_per_second": 0.997
+    }
+  ],
+  "logging_steps": 2,
+  "max_steps": 100,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 1,
+  "save_steps": 500,
+  "stateful_callbacks": {
+    "TrainerControl": {
+      "args": {
+        "should_epoch_stop": false,
+        "should_evaluate": false,
+        "should_log": false,
+        "should_save": false,
+        "should_training_stop": false
+      },
+      "attributes": {}
+    }
+  },
+  "total_flos": 2053446886752256.0,
+  "train_batch_size": 1,
+  "trial_name": null,
+  "trial_params": null
+}

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round10.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b9983a1b6c779a4d52cdc627f04f956d61efac456204bcc4dabada42d9a3dfdd
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round12.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:f2de129e62beeb4971790b5e1f46c5a709dcf59503e9475b5787bf0cd581368e
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round15.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:24ed512b6dcd1a66d95d053edadd3e3fbdf255ba36752a7ade6a545f7a8c1654
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round17.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:a4219da9ea85c1442677e975ed2d3f527a357245f0998ca76a59bd078777e3fd
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round2.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:c1ceea20bd9bb93c4ec0fd7ee4511cfb48fbb6ab8dac82e3d4240b59dba7c865
+size 184220842

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round20.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:fac5c439ec99857d8e543ff416a2fd33e4648cf7a54164d4ff91a2487ca1202e
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round5.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:6ca3cc56d5d8ef6bf8ceb6673227c86c6fdfa5c11342ee85b31de747c9ee1296
+size 184220842

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_client_model_round7.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:bf892a9fd738f4567b9929fca404c0a7a73c02558fbe6ed6dc4303c2e51f42b8
+size 184220842

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/1_trainer_state.json ADDED Viewed

	@@ -0,0 +1,392 @@

+{
+  "best_metric": null,
+  "best_model_checkpoint": null,
+  "epoch": 1.0,
+  "eval_steps": 500,
+  "global_step": 100,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.02,
+      "grad_norm": 4.540980339050293,
+      "learning_rate": 2e-05,
+      "loss": 0.422,
+      "step": 2
+    },
+    {
+      "epoch": 0.04,
+      "grad_norm": 0.08287880569696426,
+      "learning_rate": 2e-05,
+      "loss": 0.0048,
+      "step": 4
+    },
+    {
+      "epoch": 0.06,
+      "grad_norm": 3.329127788543701,
+      "learning_rate": 2e-05,
+      "loss": 0.2607,
+      "step": 6
+    },
+    {
+      "epoch": 0.08,
+      "grad_norm": 0.11668016016483307,
+      "learning_rate": 2e-05,
+      "loss": 0.0061,
+      "step": 8
+    },
+    {
+      "epoch": 0.1,
+      "grad_norm": 1.266418218612671,
+      "learning_rate": 2e-05,
+      "loss": 0.0361,
+      "step": 10
+    },
+    {
+      "epoch": 0.12,
+      "grad_norm": 1.0858792066574097,
+      "learning_rate": 2e-05,
+      "loss": 0.0498,
+      "step": 12
+    },
+    {
+      "epoch": 0.14,
+      "grad_norm": 1.4955309629440308,
+      "learning_rate": 2e-05,
+      "loss": 0.0903,
+      "step": 14
+    },
+    {
+      "epoch": 0.16,
+      "grad_norm": 3.658975839614868,
+      "learning_rate": 2e-05,
+      "loss": 0.4419,
+      "step": 16
+    },
+    {
+      "epoch": 0.18,
+      "grad_norm": 0.029739608988165855,
+      "learning_rate": 2e-05,
+      "loss": 0.0057,
+      "step": 18
+    },
+    {
+      "epoch": 0.2,
+      "grad_norm": 0.04279458895325661,
+      "learning_rate": 2e-05,
+      "loss": 0.0027,
+      "step": 20
+    },
+    {
+      "epoch": 0.22,
+      "grad_norm": 1.1662931442260742,
+      "learning_rate": 2e-05,
+      "loss": 0.0642,
+      "step": 22
+    },
+    {
+      "epoch": 0.24,
+      "grad_norm": 1.0573233366012573,
+      "learning_rate": 2e-05,
+      "loss": 0.0731,
+      "step": 24
+    },
+    {
+      "epoch": 0.26,
+      "grad_norm": 4.016772747039795,
+      "learning_rate": 2e-05,
+      "loss": 0.3845,
+      "step": 26
+    },
+    {
+      "epoch": 0.28,
+      "grad_norm": 0.2739083766937256,
+      "learning_rate": 2e-05,
+      "loss": 0.0173,
+      "step": 28
+    },
+    {
+      "epoch": 0.3,
+      "grad_norm": 0.004112154711037874,
+      "learning_rate": 2e-05,
+      "loss": 0.5049,
+      "step": 30
+    },
+    {
+      "epoch": 0.32,
+      "grad_norm": 1.817938208580017,
+      "learning_rate": 2e-05,
+      "loss": 0.1084,
+      "step": 32
+    },
+    {
+      "epoch": 0.34,
+      "grad_norm": 0.040277149528265,
+      "learning_rate": 2e-05,
+      "loss": 0.0015,
+      "step": 34
+    },
+    {
+      "epoch": 0.36,
+      "grad_norm": 0.03433386608958244,
+      "learning_rate": 2e-05,
+      "loss": 0.0028,
+      "step": 36
+    },
+    {
+      "epoch": 0.38,
+      "grad_norm": 3.3714048862457275,
+      "learning_rate": 2e-05,
+      "loss": 0.1396,
+      "step": 38
+    },
+    {
+      "epoch": 0.4,
+      "grad_norm": 0.03902699798345566,
+      "learning_rate": 2e-05,
+      "loss": 0.0027,
+      "step": 40
+    },
+    {
+      "epoch": 0.42,
+      "grad_norm": 0.17097237706184387,
+      "learning_rate": 2e-05,
+      "loss": 0.006,
+      "step": 42
+    },
+    {
+      "epoch": 0.44,
+      "grad_norm": 0.004333522170782089,
+      "learning_rate": 2e-05,
+      "loss": 0.0081,
+      "step": 44
+    },
+    {
+      "epoch": 0.46,
+      "grad_norm": 0.13571485877037048,
+      "learning_rate": 2e-05,
+      "loss": 0.006,
+      "step": 46
+    },
+    {
+      "epoch": 0.48,
+      "grad_norm": 0.31877508759498596,
+      "learning_rate": 2e-05,
+      "loss": 0.0122,
+      "step": 48
+    },
+    {
+      "epoch": 0.5,
+      "grad_norm": 0.09019943326711655,
+      "learning_rate": 2e-05,
+      "loss": 0.0051,
+      "step": 50
+    },
+    {
+      "epoch": 0.52,
+      "grad_norm": 10.819501876831055,
+      "learning_rate": 2e-05,
+      "loss": 1.0651,
+      "step": 52
+    },
+    {
+      "epoch": 0.54,
+      "grad_norm": 0.5622828602790833,
+      "learning_rate": 2e-05,
+      "loss": 0.0183,
+      "step": 54
+    },
+    {
+      "epoch": 0.56,
+      "grad_norm": 0.3623190224170685,
+      "learning_rate": 2e-05,
+      "loss": 0.0462,
+      "step": 56
+    },
+    {
+      "epoch": 0.58,
+      "grad_norm": 0.40045422315597534,
+      "learning_rate": 2e-05,
+      "loss": 0.1874,
+      "step": 58
+    },
+    {
+      "epoch": 0.6,
+      "grad_norm": 0.0034316980745643377,
+      "learning_rate": 2e-05,
+      "loss": 0.0095,
+      "step": 60
+    },
+    {
+      "epoch": 0.62,
+      "grad_norm": 0.01208802405744791,
+      "learning_rate": 2e-05,
+      "loss": 0.0055,
+      "step": 62
+    },
+    {
+      "epoch": 0.64,
+      "grad_norm": 0.01345849223434925,
+      "learning_rate": 2e-05,
+      "loss": 0.0033,
+      "step": 64
+    },
+    {
+      "epoch": 0.66,
+      "grad_norm": 0.6658453941345215,
+      "learning_rate": 2e-05,
+      "loss": 0.0433,
+      "step": 66
+    },
+    {
+      "epoch": 0.68,
+      "grad_norm": 2.384672164916992,
+      "learning_rate": 2e-05,
+      "loss": 0.2239,
+      "step": 68
+    },
+    {
+      "epoch": 0.7,
+      "grad_norm": 0.07835771143436432,
+      "learning_rate": 2e-05,
+      "loss": 0.0073,
+      "step": 70
+    },
+    {
+      "epoch": 0.72,
+      "grad_norm": 1.4132821559906006,
+      "learning_rate": 2e-05,
+      "loss": 0.0383,
+      "step": 72
+    },
+    {
+      "epoch": 0.74,
+      "grad_norm": 0.9961208701133728,
+      "learning_rate": 2e-05,
+      "loss": 0.0747,
+      "step": 74
+    },
+    {
+      "epoch": 0.76,
+      "grad_norm": 0.9463048577308655,
+      "learning_rate": 2e-05,
+      "loss": 0.0433,
+      "step": 76
+    },
+    {
+      "epoch": 0.78,
+      "grad_norm": 0.01034417562186718,
+      "learning_rate": 2e-05,
+      "loss": 0.0328,
+      "step": 78
+    },
+    {
+      "epoch": 0.8,
+      "grad_norm": 0.0005425452254712582,
+      "learning_rate": 2e-05,
+      "loss": 0.3519,
+      "step": 80
+    },
+    {
+      "epoch": 0.82,
+      "grad_norm": 0.04632725194096565,
+      "learning_rate": 2e-05,
+      "loss": 0.0369,
+      "step": 82
+    },
+    {
+      "epoch": 0.84,
+      "grad_norm": 1.2183465957641602,
+      "learning_rate": 2e-05,
+      "loss": 0.0654,
+      "step": 84
+    },
+    {
+      "epoch": 0.86,
+      "grad_norm": 0.009153845719993114,
+      "learning_rate": 2e-05,
+      "loss": 0.0014,
+      "step": 86
+    },
+    {
+      "epoch": 0.88,
+      "grad_norm": 0.8759830594062805,
+      "learning_rate": 2e-05,
+      "loss": 0.0918,
+      "step": 88
+    },
+    {
+      "epoch": 0.9,
+      "grad_norm": 0.031464505940675735,
+      "learning_rate": 2e-05,
+      "loss": 0.0014,
+      "step": 90
+    },
+    {
+      "epoch": 0.92,
+      "grad_norm": 0.038530562072992325,
+      "learning_rate": 2e-05,
+      "loss": 0.0023,
+      "step": 92
+    },
+    {
+      "epoch": 0.94,
+      "grad_norm": 0.04050149768590927,
+      "learning_rate": 2e-05,
+      "loss": 0.0215,
+      "step": 94
+    },
+    {
+      "epoch": 0.96,
+      "grad_norm": 0.009601338766515255,
+      "learning_rate": 2e-05,
+      "loss": 0.001,
+      "step": 96
+    },
+    {
+      "epoch": 0.98,
+      "grad_norm": 0.02644410915672779,
+      "learning_rate": 2e-05,
+      "loss": 0.0018,
+      "step": 98
+    },
+    {
+      "epoch": 1.0,
+      "grad_norm": 13.793920516967773,
+      "learning_rate": 2e-05,
+      "loss": 0.8695,
+      "step": 100
+    },
+    {
+      "epoch": 1.0,
+      "step": 100,
+      "total_flos": 2069576665792512.0,
+      "train_loss": 0.11801103919744492,
+      "train_runtime": 100.2591,
+      "train_samples_per_second": 3.99,
+      "train_steps_per_second": 0.997
+    }
+  ],
+  "logging_steps": 2,
+  "max_steps": 100,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 1,
+  "save_steps": 500,
+  "stateful_callbacks": {
+    "TrainerControl": {
+      "args": {
+        "should_epoch_stop": false,
+        "should_evaluate": false,
+        "should_log": false,
+        "should_save": false,
+        "should_training_stop": false
+      },
+      "attributes": {}
+    }
+  },
+  "total_flos": 2069576665792512.0,
+  "train_batch_size": 1,
+  "trial_name": null,
+  "trial_params": null
+}

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round10.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:03582a65c5f942f662a8eafdf27eccb06167fe68a235376a577c83b61464520f
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round12.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:7f25cc37e7b0ba30193079fe56dc4c3aa9b011c90f9b100c4edb8af121e24a47
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round15.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:3e73eded9bd524f1dce2d82e0dcd45a995aec36460f360989c7f0a3633f9064b
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round17.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:4f015a9439fe81810ee686e3def97f0a5628eb03eeb6647f2361e14acb54c6f1
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round2.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:6f1d2a8a90b6e9f82b7cd6b9d41f2426100a7a948c8be73b9cd03822077c3984
+size 395786922

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round20.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:ff05ff0a2fd64497a4dc87555b334386e1340bf51e0cb26b9563e5605c8b120e
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round5.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:abb0d68b551454c4d09eebc6d9d9cedb828570c4d6224ed8d949afef34928fd5
+size 395786922

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_client_model_round7.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:2e31665b8c7d78dc560352ba149d087420a03bb9929818edc19a4016a5f1b8ba
+size 395786922

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/2_trainer_state.json ADDED Viewed

	@@ -0,0 +1,392 @@

+{
+  "best_metric": null,
+  "best_model_checkpoint": null,
+  "epoch": 1.0,
+  "eval_steps": 500,
+  "global_step": 100,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.02,
+      "grad_norm": 6.307283401489258,
+      "learning_rate": 2e-05,
+      "loss": 1.5954,
+      "step": 2
+    },
+    {
+      "epoch": 0.04,
+      "grad_norm": 1.8216760158538818,
+      "learning_rate": 2e-05,
+      "loss": 0.278,
+      "step": 4
+    },
+    {
+      "epoch": 0.06,
+      "grad_norm": 7.7118024826049805,
+      "learning_rate": 2e-05,
+      "loss": 1.2105,
+      "step": 6
+    },
+    {
+      "epoch": 0.08,
+      "grad_norm": 6.2828192710876465,
+      "learning_rate": 2e-05,
+      "loss": 1.0291,
+      "step": 8
+    },
+    {
+      "epoch": 0.1,
+      "grad_norm": 1.8280245065689087,
+      "learning_rate": 2e-05,
+      "loss": 0.3982,
+      "step": 10
+    },
+    {
+      "epoch": 0.12,
+      "grad_norm": 0.9868451356887817,
+      "learning_rate": 2e-05,
+      "loss": 1.2771,
+      "step": 12
+    },
+    {
+      "epoch": 0.14,
+      "grad_norm": 1.3482744693756104,
+      "learning_rate": 2e-05,
+      "loss": 0.6548,
+      "step": 14
+    },
+    {
+      "epoch": 0.16,
+      "grad_norm": 1.1375393867492676,
+      "learning_rate": 2e-05,
+      "loss": 0.6873,
+      "step": 16
+    },
+    {
+      "epoch": 0.18,
+      "grad_norm": 1.463499903678894,
+      "learning_rate": 2e-05,
+      "loss": 0.6526,
+      "step": 18
+    },
+    {
+      "epoch": 0.2,
+      "grad_norm": 5.554112911224365,
+      "learning_rate": 2e-05,
+      "loss": 1.2926,
+      "step": 20
+    },
+    {
+      "epoch": 0.22,
+      "grad_norm": 1.0732632875442505,
+      "learning_rate": 2e-05,
+      "loss": 0.461,
+      "step": 22
+    },
+    {
+      "epoch": 0.24,
+      "grad_norm": 2.5138278007507324,
+      "learning_rate": 2e-05,
+      "loss": 0.7348,
+      "step": 24
+    },
+    {
+      "epoch": 0.26,
+      "grad_norm": 2.534879446029663,
+      "learning_rate": 2e-05,
+      "loss": 0.8571,
+      "step": 26
+    },
+    {
+      "epoch": 0.28,
+      "grad_norm": 2.698505163192749,
+      "learning_rate": 2e-05,
+      "loss": 0.521,
+      "step": 28
+    },
+    {
+      "epoch": 0.3,
+      "grad_norm": 1.4479676485061646,
+      "learning_rate": 2e-05,
+      "loss": 0.3902,
+      "step": 30
+    },
+    {
+      "epoch": 0.32,
+      "grad_norm": 1.2816400527954102,
+      "learning_rate": 2e-05,
+      "loss": 0.4518,
+      "step": 32
+    },
+    {
+      "epoch": 0.34,
+      "grad_norm": 5.400059223175049,
+      "learning_rate": 2e-05,
+      "loss": 0.9999,
+      "step": 34
+    },
+    {
+      "epoch": 0.36,
+      "grad_norm": 2.5884220600128174,
+      "learning_rate": 2e-05,
+      "loss": 0.3547,
+      "step": 36
+    },
+    {
+      "epoch": 0.38,
+      "grad_norm": 2.3713040351867676,
+      "learning_rate": 2e-05,
+      "loss": 0.7269,
+      "step": 38
+    },
+    {
+      "epoch": 0.4,
+      "grad_norm": 0.25373563170433044,
+      "learning_rate": 2e-05,
+      "loss": 0.0746,
+      "step": 40
+    },
+    {
+      "epoch": 0.42,
+      "grad_norm": 4.246715068817139,
+      "learning_rate": 2e-05,
+      "loss": 0.6696,
+      "step": 42
+    },
+    {
+      "epoch": 0.44,
+      "grad_norm": 1.6761362552642822,
+      "learning_rate": 2e-05,
+      "loss": 0.6276,
+      "step": 44
+    },
+    {
+      "epoch": 0.46,
+      "grad_norm": 3.399017572402954,
+      "learning_rate": 2e-05,
+      "loss": 0.9067,
+      "step": 46
+    },
+    {
+      "epoch": 0.48,
+      "grad_norm": 0.692711591720581,
+      "learning_rate": 2e-05,
+      "loss": 0.1943,
+      "step": 48
+    },
+    {
+      "epoch": 0.5,
+      "grad_norm": 1.116909146308899,
+      "learning_rate": 2e-05,
+      "loss": 0.2336,
+      "step": 50
+    },
+    {
+      "epoch": 0.52,
+      "grad_norm": 1.456255555152893,
+      "learning_rate": 2e-05,
+      "loss": 0.1465,
+      "step": 52
+    },
+    {
+      "epoch": 0.54,
+      "grad_norm": 0.06800251454114914,
+      "learning_rate": 2e-05,
+      "loss": 0.2881,
+      "step": 54
+    },
+    {
+      "epoch": 0.56,
+      "grad_norm": 4.372195720672607,
+      "learning_rate": 2e-05,
+      "loss": 0.6529,
+      "step": 56
+    },
+    {
+      "epoch": 0.58,
+      "grad_norm": 4.281543254852295,
+      "learning_rate": 2e-05,
+      "loss": 1.313,
+      "step": 58
+    },
+    {
+      "epoch": 0.6,
+      "grad_norm": 3.5601418018341064,
+      "learning_rate": 2e-05,
+      "loss": 0.3216,
+      "step": 60
+    },
+    {
+      "epoch": 0.62,
+      "grad_norm": 1.4214577674865723,
+      "learning_rate": 2e-05,
+      "loss": 0.1358,
+      "step": 62
+    },
+    {
+      "epoch": 0.64,
+      "grad_norm": 2.7352545261383057,
+      "learning_rate": 2e-05,
+      "loss": 0.4594,
+      "step": 64
+    },
+    {
+      "epoch": 0.66,
+      "grad_norm": 3.6488208770751953,
+      "learning_rate": 2e-05,
+      "loss": 1.1297,
+      "step": 66
+    },
+    {
+      "epoch": 0.68,
+      "grad_norm": 0.18936391174793243,
+      "learning_rate": 2e-05,
+      "loss": 0.2297,
+      "step": 68
+    },
+    {
+      "epoch": 0.7,
+      "grad_norm": 0.24005119502544403,
+      "learning_rate": 2e-05,
+      "loss": 1.2341,
+      "step": 70
+    },
+    {
+      "epoch": 0.72,
+      "grad_norm": 0.6526658535003662,
+      "learning_rate": 2e-05,
+      "loss": 0.4384,
+      "step": 72
+    },
+    {
+      "epoch": 0.74,
+      "grad_norm": 1.2854243516921997,
+      "learning_rate": 2e-05,
+      "loss": 0.2658,
+      "step": 74
+    },
+    {
+      "epoch": 0.76,
+      "grad_norm": 1.8762297630310059,
+      "learning_rate": 2e-05,
+      "loss": 0.5192,
+      "step": 76
+    },
+    {
+      "epoch": 0.78,
+      "grad_norm": 8.563094139099121,
+      "learning_rate": 2e-05,
+      "loss": 0.3001,
+      "step": 78
+    },
+    {
+      "epoch": 0.8,
+      "grad_norm": 0.5608336329460144,
+      "learning_rate": 2e-05,
+      "loss": 0.2274,
+      "step": 80
+    },
+    {
+      "epoch": 0.82,
+      "grad_norm": 0.9091539978981018,
+      "learning_rate": 2e-05,
+      "loss": 0.2695,
+      "step": 82
+    },
+    {
+      "epoch": 0.84,
+      "grad_norm": 1.8625966310501099,
+      "learning_rate": 2e-05,
+      "loss": 0.2104,
+      "step": 84
+    },
+    {
+      "epoch": 0.86,
+      "grad_norm": 3.4447784423828125,
+      "learning_rate": 2e-05,
+      "loss": 0.5892,
+      "step": 86
+    },
+    {
+      "epoch": 0.88,
+      "grad_norm": 0.39084768295288086,
+      "learning_rate": 2e-05,
+      "loss": 0.2646,
+      "step": 88
+    },
+    {
+      "epoch": 0.9,
+      "grad_norm": 4.247977256774902,
+      "learning_rate": 2e-05,
+      "loss": 0.3688,
+      "step": 90
+    },
+    {
+      "epoch": 0.92,
+      "grad_norm": 0.8638454079627991,
+      "learning_rate": 2e-05,
+      "loss": 2.1514,
+      "step": 92
+    },
+    {
+      "epoch": 0.94,
+      "grad_norm": 0.26021599769592285,
+      "learning_rate": 2e-05,
+      "loss": 0.0341,
+      "step": 94
+    },
+    {
+      "epoch": 0.96,
+      "grad_norm": 2.017536163330078,
+      "learning_rate": 2e-05,
+      "loss": 0.2675,
+      "step": 96
+    },
+    {
+      "epoch": 0.98,
+      "grad_norm": 2.068211793899536,
+      "learning_rate": 2e-05,
+      "loss": 0.256,
+      "step": 98
+    },
+    {
+      "epoch": 1.0,
+      "grad_norm": 6.009552478790283,
+      "learning_rate": 2e-05,
+      "loss": 0.8954,
+      "step": 100
+    },
+    {
+      "epoch": 1.0,
+      "step": 100,
+      "total_flos": 4915713315700736.0,
+      "train_loss": 0.6049574661254883,
+      "train_runtime": 165.4178,
+      "train_samples_per_second": 2.418,
+      "train_steps_per_second": 0.605
+    }
+  ],
+  "logging_steps": 2,
+  "max_steps": 100,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 1,
+  "save_steps": 500,
+  "stateful_callbacks": {
+    "TrainerControl": {
+      "args": {
+        "should_epoch_stop": false,
+        "should_evaluate": false,
+        "should_log": false,
+        "should_save": false,
+        "should_training_stop": false
+      },
+      "attributes": {}
+    }
+  },
+  "total_flos": 4915713315700736.0,
+  "train_batch_size": 1,
+  "trial_name": null,
+  "trial_params": null
+}

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round10.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:e8ec9a76aa2a365afb2403325260e12dec27ad4b984f60c9e7f5a9f76ebbdad1
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round12.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:d0a23a2ed8e03fd3a4b21c1fea3e90f4eb1c0a3a99bedee884c388ca90b15211
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round15.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:70680ac43b83326240e7835655831bc4ceaf9f0de955840f5c6d0c1f4afcc2f1
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round17.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:8e4b81455da8eff19455dde4b74de4297a754f18d10b63e691a538c6b9946a3f
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round2.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:af9b733c0813536ef08508eb156501dcb5bd61a3091f43cb3f3f6010fe4b4917
+size 184220842

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round20.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:7e03eca3be62c25b2a2aa30e419a67ca025067a04b2c6b04bf385daaae97ddbd
+size 184221358

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round5.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:d3787e3f8abd12f49c6d80d3cdcdede3a2f53808976bc36599bbc4428eea38f7
+size 184220842

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_client_model_round7.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:a6adb60b55506bfdd98859d59018a85cefb09d6e024b8fa128b3beb888dc5315
+size 184220842

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/3_trainer_state.json ADDED Viewed

	@@ -0,0 +1,392 @@

+{
+  "best_metric": null,
+  "best_model_checkpoint": null,
+  "epoch": 1.0,
+  "eval_steps": 500,
+  "global_step": 100,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.02,
+      "grad_norm": 2.0921337604522705,
+      "learning_rate": 2e-05,
+      "loss": 0.6894,
+      "step": 2
+    },
+    {
+      "epoch": 0.04,
+      "grad_norm": 4.510809421539307,
+      "learning_rate": 2e-05,
+      "loss": 0.6862,
+      "step": 4
+    },
+    {
+      "epoch": 0.06,
+      "grad_norm": 4.531048774719238,
+      "learning_rate": 2e-05,
+      "loss": 1.2015,
+      "step": 6
+    },
+    {
+      "epoch": 0.08,
+      "grad_norm": 3.931663751602173,
+      "learning_rate": 2e-05,
+      "loss": 0.5979,
+      "step": 8
+    },
+    {
+      "epoch": 0.1,
+      "grad_norm": 6.292150020599365,
+      "learning_rate": 2e-05,
+      "loss": 1.058,
+      "step": 10
+    },
+    {
+      "epoch": 0.12,
+      "grad_norm": 4.606175422668457,
+      "learning_rate": 2e-05,
+      "loss": 0.8743,
+      "step": 12
+    },
+    {
+      "epoch": 0.14,
+      "grad_norm": 3.087507963180542,
+      "learning_rate": 2e-05,
+      "loss": 0.6243,
+      "step": 14
+    },
+    {
+      "epoch": 0.16,
+      "grad_norm": 8.593318939208984,
+      "learning_rate": 2e-05,
+      "loss": 0.4402,
+      "step": 16
+    },
+    {
+      "epoch": 0.18,
+      "grad_norm": 5.68522834777832,
+      "learning_rate": 2e-05,
+      "loss": 1.3279,
+      "step": 18
+    },
+    {
+      "epoch": 0.2,
+      "grad_norm": 1.9175809621810913,
+      "learning_rate": 2e-05,
+      "loss": 0.7962,
+      "step": 20
+    },
+    {
+      "epoch": 0.22,
+      "grad_norm": 8.656201362609863,
+      "learning_rate": 2e-05,
+      "loss": 2.0415,
+      "step": 22
+    },
+    {
+      "epoch": 0.24,
+      "grad_norm": 1.99509859085083,
+      "learning_rate": 2e-05,
+      "loss": 0.2472,
+      "step": 24
+    },
+    {
+      "epoch": 0.26,
+      "grad_norm": 7.396963119506836,
+      "learning_rate": 2e-05,
+      "loss": 0.8892,
+      "step": 26
+    },
+    {
+      "epoch": 0.28,
+      "grad_norm": 5.109688758850098,
+      "learning_rate": 2e-05,
+      "loss": 0.4696,
+      "step": 28
+    },
+    {
+      "epoch": 0.3,
+      "grad_norm": 3.3529930114746094,
+      "learning_rate": 2e-05,
+      "loss": 0.6545,
+      "step": 30
+    },
+    {
+      "epoch": 0.32,
+      "grad_norm": 1.4711360931396484,
+      "learning_rate": 2e-05,
+      "loss": 0.5218,
+      "step": 32
+    },
+    {
+      "epoch": 0.34,
+      "grad_norm": 4.621761322021484,
+      "learning_rate": 2e-05,
+      "loss": 0.9679,
+      "step": 34
+    },
+    {
+      "epoch": 0.36,
+      "grad_norm": 3.575629472732544,
+      "learning_rate": 2e-05,
+      "loss": 0.5973,
+      "step": 36
+    },
+    {
+      "epoch": 0.38,
+      "grad_norm": 9.701947212219238,
+      "learning_rate": 2e-05,
+      "loss": 1.4922,
+      "step": 38
+    },
+    {
+      "epoch": 0.4,
+      "grad_norm": 18.55413818359375,
+      "learning_rate": 2e-05,
+      "loss": 1.1465,
+      "step": 40
+    },
+    {
+      "epoch": 0.42,
+      "grad_norm": 7.169260025024414,
+      "learning_rate": 2e-05,
+      "loss": 0.9151,
+      "step": 42
+    },
+    {
+      "epoch": 0.44,
+      "grad_norm": 7.758701324462891,
+      "learning_rate": 2e-05,
+      "loss": 1.3213,
+      "step": 44
+    },
+    {
+      "epoch": 0.46,
+      "grad_norm": 7.772892475128174,
+      "learning_rate": 2e-05,
+      "loss": 0.4431,
+      "step": 46
+    },
+    {
+      "epoch": 0.48,
+      "grad_norm": 3.169400215148926,
+      "learning_rate": 2e-05,
+      "loss": 0.9307,
+      "step": 48
+    },
+    {
+      "epoch": 0.5,
+      "grad_norm": 6.446079730987549,
+      "learning_rate": 2e-05,
+      "loss": 1.4162,
+      "step": 50
+    },
+    {
+      "epoch": 0.52,
+      "grad_norm": 4.463912487030029,
+      "learning_rate": 2e-05,
+      "loss": 0.8901,
+      "step": 52
+    },
+    {
+      "epoch": 0.54,
+      "grad_norm": 7.208362102508545,
+      "learning_rate": 2e-05,
+      "loss": 1.4832,
+      "step": 54
+    },
+    {
+      "epoch": 0.56,
+      "grad_norm": 11.086746215820312,
+      "learning_rate": 2e-05,
+      "loss": 2.0512,
+      "step": 56
+    },
+    {
+      "epoch": 0.58,
+      "grad_norm": 6.340665340423584,
+      "learning_rate": 2e-05,
+      "loss": 1.0799,
+      "step": 58
+    },
+    {
+      "epoch": 0.6,
+      "grad_norm": 2.8643109798431396,
+      "learning_rate": 2e-05,
+      "loss": 0.5789,
+      "step": 60
+    },
+    {
+      "epoch": 0.62,
+      "grad_norm": 7.802653789520264,
+      "learning_rate": 2e-05,
+      "loss": 1.8293,
+      "step": 62
+    },
+    {
+      "epoch": 0.64,
+      "grad_norm": 4.388473033905029,
+      "learning_rate": 2e-05,
+      "loss": 1.0891,
+      "step": 64
+    },
+    {
+      "epoch": 0.66,
+      "grad_norm": 4.431455612182617,
+      "learning_rate": 2e-05,
+      "loss": 0.9788,
+      "step": 66
+    },
+    {
+      "epoch": 0.68,
+      "grad_norm": 0.8305065035820007,
+      "learning_rate": 2e-05,
+      "loss": 0.6982,
+      "step": 68
+    },
+    {
+      "epoch": 0.7,
+      "grad_norm": 14.678071975708008,
+      "learning_rate": 2e-05,
+      "loss": 1.9248,
+      "step": 70
+    },
+    {
+      "epoch": 0.72,
+      "grad_norm": 2.8914413452148438,
+      "learning_rate": 2e-05,
+      "loss": 0.5398,
+      "step": 72
+    },
+    {
+      "epoch": 0.74,
+      "grad_norm": 2.2980284690856934,
+      "learning_rate": 2e-05,
+      "loss": 1.6722,
+      "step": 74
+    },
+    {
+      "epoch": 0.76,
+      "grad_norm": 4.637665271759033,
+      "learning_rate": 2e-05,
+      "loss": 1.3349,
+      "step": 76
+    },
+    {
+      "epoch": 0.78,
+      "grad_norm": 2.5008809566497803,
+      "learning_rate": 2e-05,
+      "loss": 1.134,
+      "step": 78
+    },
+    {
+      "epoch": 0.8,
+      "grad_norm": 2.6805694103240967,
+      "learning_rate": 2e-05,
+      "loss": 0.935,
+      "step": 80
+    },
+    {
+      "epoch": 0.82,
+      "grad_norm": 7.456270694732666,
+      "learning_rate": 2e-05,
+      "loss": 1.5703,
+      "step": 82
+    },
+    {
+      "epoch": 0.84,
+      "grad_norm": 3.0763790607452393,
+      "learning_rate": 2e-05,
+      "loss": 0.3613,
+      "step": 84
+    },
+    {
+      "epoch": 0.86,
+      "grad_norm": 8.599203109741211,
+      "learning_rate": 2e-05,
+      "loss": 0.9858,
+      "step": 86
+    },
+    {
+      "epoch": 0.88,
+      "grad_norm": 7.865464687347412,
+      "learning_rate": 2e-05,
+      "loss": 1.5265,
+      "step": 88
+    },
+    {
+      "epoch": 0.9,
+      "grad_norm": 7.330792427062988,
+      "learning_rate": 2e-05,
+      "loss": 1.392,
+      "step": 90
+    },
+    {
+      "epoch": 0.92,
+      "grad_norm": 5.383084774017334,
+      "learning_rate": 2e-05,
+      "loss": 1.248,
+      "step": 92
+    },
+    {
+      "epoch": 0.94,
+      "grad_norm": 6.0959649085998535,
+      "learning_rate": 2e-05,
+      "loss": 1.9657,
+      "step": 94
+    },
+    {
+      "epoch": 0.96,
+      "grad_norm": 2.155146598815918,
+      "learning_rate": 2e-05,
+      "loss": 0.8844,
+      "step": 96
+    },
+    {
+      "epoch": 0.98,
+      "grad_norm": 5.614543437957764,
+      "learning_rate": 2e-05,
+      "loss": 1.4389,
+      "step": 98
+    },
+    {
+      "epoch": 1.0,
+      "grad_norm": 8.140727043151855,
+      "learning_rate": 2e-05,
+      "loss": 1.3601,
+      "step": 100
+    },
+    {
+      "epoch": 1.0,
+      "step": 100,
+      "total_flos": 2098644891205632.0,
+      "train_loss": 1.066049919128418,
+      "train_runtime": 99.4099,
+      "train_samples_per_second": 4.024,
+      "train_steps_per_second": 1.006
+    }
+  ],
+  "logging_steps": 2,
+  "max_steps": 100,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 1,
+  "save_steps": 500,
+  "stateful_callbacks": {
+    "TrainerControl": {
+      "args": {
+        "should_epoch_stop": false,
+        "should_evaluate": false,
+        "should_log": false,
+        "should_save": false,
+        "should_training_stop": false
+      },
+      "attributes": {}
+    }
+  },
+  "total_flos": 2098644891205632.0,
+  "train_batch_size": 1,
+  "trial_name": null,
+  "trial_params": null
+}

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round10.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:3506ffc3670759125f1d1c08b6420c1bf38b2f186b977f9cbb77ec8fcbeea88e
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round12.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:7be4b6efdf8aeda1d55eab73770ec3ff6a9a14501a2aa60e833ec969ed086533
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round15.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:90585364faf7ecfbee025db3a036cc013caf849e1bed9b8c5d1c4570c6065777
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round17.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:9236b8e15ebe274a58931ff42727de3f819bbb0f8493426399ff78877af9de2b
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round2.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:a161db119e3dd4b0ad54e2dc5dae4212100d532c0ec87749b3eb4d37f395bf48
+size 395786922

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round20.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:16b3859505775fae6ab29fd2053ab49c87ca8a84e54cda0d5304f7c72b066afd
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round5.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:05e363377b0c5548371d96debaaf6fff6fa705a7ca1321530510e181d3556b7e
+size 395786922

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_client_model_round7.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:9cd95080fae073060aa659888b415d2135edd62af172653cfed0f99ab94464f6
+size 395786922

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/4_trainer_state.json ADDED Viewed

	@@ -0,0 +1,392 @@

+{
+  "best_metric": null,
+  "best_model_checkpoint": null,
+  "epoch": 1.0,
+  "eval_steps": 500,
+  "global_step": 100,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.02,
+      "grad_norm": 3.6383607387542725,
+      "learning_rate": 2e-05,
+      "loss": 0.9771,
+      "step": 2
+    },
+    {
+      "epoch": 0.04,
+      "grad_norm": 1.4260591268539429,
+      "learning_rate": 2e-05,
+      "loss": 0.5006,
+      "step": 4
+    },
+    {
+      "epoch": 0.06,
+      "grad_norm": 1.6014289855957031,
+      "learning_rate": 2e-05,
+      "loss": 0.782,
+      "step": 6
+    },
+    {
+      "epoch": 0.08,
+      "grad_norm": 2.321310043334961,
+      "learning_rate": 2e-05,
+      "loss": 0.3546,
+      "step": 8
+    },
+    {
+      "epoch": 0.1,
+      "grad_norm": 1.937113881111145,
+      "learning_rate": 2e-05,
+      "loss": 1.2421,
+      "step": 10
+    },
+    {
+      "epoch": 0.12,
+      "grad_norm": 2.4271795749664307,
+      "learning_rate": 2e-05,
+      "loss": 1.005,
+      "step": 12
+    },
+    {
+      "epoch": 0.14,
+      "grad_norm": 0.9630257487297058,
+      "learning_rate": 2e-05,
+      "loss": 0.635,
+      "step": 14
+    },
+    {
+      "epoch": 0.16,
+      "grad_norm": 2.273303985595703,
+      "learning_rate": 2e-05,
+      "loss": 0.9471,
+      "step": 16
+    },
+    {
+      "epoch": 0.18,
+      "grad_norm": 1.193511724472046,
+      "learning_rate": 2e-05,
+      "loss": 0.6021,
+      "step": 18
+    },
+    {
+      "epoch": 0.2,
+      "grad_norm": 2.983036518096924,
+      "learning_rate": 2e-05,
+      "loss": 0.6765,
+      "step": 20
+    },
+    {
+      "epoch": 0.22,
+      "grad_norm": 1.626178503036499,
+      "learning_rate": 2e-05,
+      "loss": 1.0259,
+      "step": 22
+    },
+    {
+      "epoch": 0.24,
+      "grad_norm": 1.8325883150100708,
+      "learning_rate": 2e-05,
+      "loss": 0.5989,
+      "step": 24
+    },
+    {
+      "epoch": 0.26,
+      "grad_norm": 2.876636266708374,
+      "learning_rate": 2e-05,
+      "loss": 0.8092,
+      "step": 26
+    },
+    {
+      "epoch": 0.28,
+      "grad_norm": 2.8380074501037598,
+      "learning_rate": 2e-05,
+      "loss": 0.5194,
+      "step": 28
+    },
+    {
+      "epoch": 0.3,
+      "grad_norm": 2.227553129196167,
+      "learning_rate": 2e-05,
+      "loss": 0.6971,
+      "step": 30
+    },
+    {
+      "epoch": 0.32,
+      "grad_norm": 2.7015953063964844,
+      "learning_rate": 2e-05,
+      "loss": 0.6297,
+      "step": 32
+    },
+    {
+      "epoch": 0.34,
+      "grad_norm": 3.0312774181365967,
+      "learning_rate": 2e-05,
+      "loss": 1.3067,
+      "step": 34
+    },
+    {
+      "epoch": 0.36,
+      "grad_norm": 2.7130300998687744,
+      "learning_rate": 2e-05,
+      "loss": 0.702,
+      "step": 36
+    },
+    {
+      "epoch": 0.38,
+      "grad_norm": 0.3681621849536896,
+      "learning_rate": 2e-05,
+      "loss": 0.1352,
+      "step": 38
+    },
+    {
+      "epoch": 0.4,
+      "grad_norm": 0.8578549027442932,
+      "learning_rate": 2e-05,
+      "loss": 0.1746,
+      "step": 40
+    },
+    {
+      "epoch": 0.42,
+      "grad_norm": 1.2145777940750122,
+      "learning_rate": 2e-05,
+      "loss": 0.62,
+      "step": 42
+    },
+    {
+      "epoch": 0.44,
+      "grad_norm": 0.8366961479187012,
+      "learning_rate": 2e-05,
+      "loss": 0.237,
+      "step": 44
+    },
+    {
+      "epoch": 0.46,
+      "grad_norm": 3.8259220123291016,
+      "learning_rate": 2e-05,
+      "loss": 1.1652,
+      "step": 46
+    },
+    {
+      "epoch": 0.48,
+      "grad_norm": 2.451016426086426,
+      "learning_rate": 2e-05,
+      "loss": 0.2307,
+      "step": 48
+    },
+    {
+      "epoch": 0.5,
+      "grad_norm": 7.296032905578613,
+      "learning_rate": 2e-05,
+      "loss": 0.6684,
+      "step": 50
+    },
+    {
+      "epoch": 0.52,
+      "grad_norm": 2.7998406887054443,
+      "learning_rate": 2e-05,
+      "loss": 0.5629,
+      "step": 52
+    },
+    {
+      "epoch": 0.54,
+      "grad_norm": 1.9942561388015747,
+      "learning_rate": 2e-05,
+      "loss": 0.4002,
+      "step": 54
+    },
+    {
+      "epoch": 0.56,
+      "grad_norm": 3.880875587463379,
+      "learning_rate": 2e-05,
+      "loss": 0.5188,
+      "step": 56
+    },
+    {
+      "epoch": 0.58,
+      "grad_norm": 5.010158538818359,
+      "learning_rate": 2e-05,
+      "loss": 0.6704,
+      "step": 58
+    },
+    {
+      "epoch": 0.6,
+      "grad_norm": 6.04047155380249,
+      "learning_rate": 2e-05,
+      "loss": 0.8029,
+      "step": 60
+    },
+    {
+      "epoch": 0.62,
+      "grad_norm": 3.4900665283203125,
+      "learning_rate": 2e-05,
+      "loss": 0.9319,
+      "step": 62
+    },
+    {
+      "epoch": 0.64,
+      "grad_norm": 1.4386566877365112,
+      "learning_rate": 2e-05,
+      "loss": 0.392,
+      "step": 64
+    },
+    {
+      "epoch": 0.66,
+      "grad_norm": 2.075533866882324,
+      "learning_rate": 2e-05,
+      "loss": 1.0757,
+      "step": 66
+    },
+    {
+      "epoch": 0.68,
+      "grad_norm": 5.302359104156494,
+      "learning_rate": 2e-05,
+      "loss": 1.017,
+      "step": 68
+    },
+    {
+      "epoch": 0.7,
+      "grad_norm": 3.4823062419891357,
+      "learning_rate": 2e-05,
+      "loss": 1.1879,
+      "step": 70
+    },
+    {
+      "epoch": 0.72,
+      "grad_norm": 0.5839654803276062,
+      "learning_rate": 2e-05,
+      "loss": 0.1357,
+      "step": 72
+    },
+    {
+      "epoch": 0.74,
+      "grad_norm": 3.582629442214966,
+      "learning_rate": 2e-05,
+      "loss": 1.5566,
+      "step": 74
+    },
+    {
+      "epoch": 0.76,
+      "grad_norm": 1.8023282289505005,
+      "learning_rate": 2e-05,
+      "loss": 0.513,
+      "step": 76
+    },
+    {
+      "epoch": 0.78,
+      "grad_norm": 0.7795921564102173,
+      "learning_rate": 2e-05,
+      "loss": 0.8818,
+      "step": 78
+    },
+    {
+      "epoch": 0.8,
+      "grad_norm": 2.052372932434082,
+      "learning_rate": 2e-05,
+      "loss": 0.6126,
+      "step": 80
+    },
+    {
+      "epoch": 0.82,
+      "grad_norm": 1.606740117073059,
+      "learning_rate": 2e-05,
+      "loss": 0.5911,
+      "step": 82
+    },
+    {
+      "epoch": 0.84,
+      "grad_norm": 1.955881953239441,
+      "learning_rate": 2e-05,
+      "loss": 0.6584,
+      "step": 84
+    },
+    {
+      "epoch": 0.86,
+      "grad_norm": 2.623976469039917,
+      "learning_rate": 2e-05,
+      "loss": 0.5529,
+      "step": 86
+    },
+    {
+      "epoch": 0.88,
+      "grad_norm": 2.0439250469207764,
+      "learning_rate": 2e-05,
+      "loss": 0.9415,
+      "step": 88
+    },
+    {
+      "epoch": 0.9,
+      "grad_norm": 0.6250275373458862,
+      "learning_rate": 2e-05,
+      "loss": 0.1703,
+      "step": 90
+    },
+    {
+      "epoch": 0.92,
+      "grad_norm": 2.0065391063690186,
+      "learning_rate": 2e-05,
+      "loss": 0.6163,
+      "step": 92
+    },
+    {
+      "epoch": 0.94,
+      "grad_norm": 3.4686758518218994,
+      "learning_rate": 2e-05,
+      "loss": 1.1005,
+      "step": 94
+    },
+    {
+      "epoch": 0.96,
+      "grad_norm": 2.2346303462982178,
+      "learning_rate": 2e-05,
+      "loss": 0.8502,
+      "step": 96
+    },
+    {
+      "epoch": 0.98,
+      "grad_norm": 3.8489227294921875,
+      "learning_rate": 2e-05,
+      "loss": 1.3295,
+      "step": 98
+    },
+    {
+      "epoch": 1.0,
+      "grad_norm": 2.55889892578125,
+      "learning_rate": 2e-05,
+      "loss": 0.634,
+      "step": 100
+    },
+    {
+      "epoch": 1.0,
+      "step": 100,
+      "total_flos": 5692822418096128.0,
+      "train_loss": 0.71892333984375,
+      "train_runtime": 165.0653,
+      "train_samples_per_second": 2.423,
+      "train_steps_per_second": 0.606
+    }
+  ],
+  "logging_steps": 2,
+  "max_steps": 100,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 1,
+  "save_steps": 500,
+  "stateful_callbacks": {
+    "TrainerControl": {
+      "args": {
+        "should_epoch_stop": false,
+        "should_evaluate": false,
+        "should_log": false,
+        "should_save": false,
+        "should_training_stop": false
+      },
+      "attributes": {}
+    }
+  },
+  "total_flos": 5692822418096128.0,
+  "train_batch_size": 1,
+  "trial_name": null,
+  "trial_params": null
+}

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round10.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:04c033bed86fd20d1bf5f45a017a7235285089bde6b845487e1d24f22528cb78
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round12.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:3aa0ede5f53ed6efb703e4de0c88d026168e8444ff6938342da4a8d4b540d5df
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round15.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:5c172229e49be46b6d28ec7d39d0dec151b6a3955e703aca7df6e3bab423f73b
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round17.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:1781b39f8ac95a428751a6de041f2ef6a523a42fcaff84daefa48b7c5e687690
+size 395787774

client_states_fedMultipqfullfreeze_homoAgg_NOCONT_bs4_saveoptim_lr2e-5_5e-5_sc315_4tasks_5rounds_fixitr100_T0125_decay099_SEED2/5_client_model_round2.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:204e4484268b051e95249cd0b0d80d5fc1c8b309c758d33fca781ee24da8090f
+size 395786922