giannisan commited on May 15, 2024

Commit

573f02e

verified ·

1 Parent(s): 7264c72

Upload folder using huggingface_hub

Browse files

Files changed (38) hide show

README.md +6 -6
all_results.json +5 -5
checkpoint-100/config.json +50 -0
checkpoint-100/model.safetensors +3 -0
checkpoint-100/optimizer.pt +3 -0
checkpoint-100/preprocessor_config.json +42 -0
checkpoint-100/rng_state.pth +3 -0
checkpoint-100/scheduler.pt +3 -0
checkpoint-100/trainer_state.json +109 -0
checkpoint-100/training_args.bin +3 -0
checkpoint-150/config.json +50 -0
checkpoint-150/model.safetensors +3 -0
checkpoint-150/optimizer.pt +3 -0
checkpoint-150/preprocessor_config.json +42 -0
checkpoint-150/rng_state.pth +3 -0
checkpoint-150/scheduler.pt +3 -0
checkpoint-150/trainer_state.json +153 -0
checkpoint-150/training_args.bin +3 -0
checkpoint-200/config.json +50 -0
checkpoint-200/model.safetensors +3 -0
checkpoint-200/optimizer.pt +3 -0
checkpoint-200/preprocessor_config.json +42 -0
checkpoint-200/rng_state.pth +3 -0
checkpoint-200/scheduler.pt +3 -0
checkpoint-200/trainer_state.json +197 -0
checkpoint-200/training_args.bin +3 -0
checkpoint-50/config.json +50 -0
checkpoint-50/model.safetensors +3 -0
checkpoint-50/optimizer.pt +3 -0
checkpoint-50/preprocessor_config.json +42 -0
checkpoint-50/rng_state.pth +3 -0
checkpoint-50/scheduler.pt +3 -0
checkpoint-50/trainer_state.json +65 -0
checkpoint-50/training_args.bin +3 -0
model.safetensors +1 -1
test_results.json +5 -5
trainer_state.json +73 -73
training_args.bin +1 -1

README.md CHANGED Viewed

@@ -17,8 +17,8 @@ should probably proofread and complete it, then remove this comment. -->
 This model is a fine-tuned version of [facebook/timesformer-base-finetuned-k400](https://huggingface.co/facebook/timesformer-base-finetuned-k400) on an unknown dataset.
 It achieves the following results on the evaluation set:
-- Loss: 0.1032
-- Accuracy: 0.9654
 ## Model description
@@ -50,10 +50,10 @@ The following hyperparameters were used during training:
 | Training Loss | Epoch | Step | Validation Loss | Accuracy |
 |:-------------:|:-----:|:----:|:---------------:|:--------:|
-| 0.1339        | 0.25  | 50   | 0.0661          | 1.0      |
-| 0.0302        | 1.25  | 100  | 0.0160          | 1.0      |
-| 0.0119        | 2.25  | 150  | 0.0213          | 1.0      |
-| 0.0028        | 3.25  | 200  | 0.0252          | 0.9933   |
 ### Framework versions

 This model is a fine-tuned version of [facebook/timesformer-base-finetuned-k400](https://huggingface.co/facebook/timesformer-base-finetuned-k400) on an unknown dataset.
 It achieves the following results on the evaluation set:
+- Loss: 0.0878
+- Accuracy: 1.0
 ## Model description
 | Training Loss | Epoch | Step | Validation Loss | Accuracy |
 |:-------------:|:-----:|:----:|:---------------:|:--------:|
+| 0.1523        | 0.25  | 50   | 0.0735          | 1.0      |
+| 0.024         | 1.25  | 100  | 0.0470          | 0.9866   |
+| 0.0583        | 2.25  | 150  | 0.0302          | 0.9866   |
+| 0.0036        | 3.25  | 200  | 0.0297          | 0.9866   |
 ### Framework versions

all_results.json CHANGED Viewed

@@ -1,8 +1,8 @@
 {
     "epoch": 3.25,
-    "eval_accuracy": 0.9654178674351584,
-    "eval_loss": 0.10321669280529022,
-    "eval_runtime": 81.3764,
-    "eval_samples_per_second": 4.264,
-    "eval_steps_per_second": 0.713
 }

 {
     "epoch": 3.25,
+    "eval_accuracy": 1.0,
+    "eval_loss": 0.08780594170093536,
+    "eval_runtime": 76.2242,
+    "eval_samples_per_second": 4.552,
+    "eval_steps_per_second": 0.761
 }

checkpoint-100/config.json ADDED Viewed

	@@ -0,0 +1,50 @@

+{
+  "_name_or_path": "facebook/timesformer-base-finetuned-k400",
+  "architectures": [
+    "TimesformerForVideoClassification"
+  ],
+  "attention_probs_dropout_prob": 0.0,
+  "attention_type": "divided_space_time",
+  "drop_path_rate": 0,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.0,
+  "hidden_size": 768,
+  "id2label": {
+    "0": "ApplyEyeMakeup",
+    "1": "ApplyLipstick",
+    "2": "Archery",
+    "3": "BabyCrawling",
+    "4": "BalanceBeam",
+    "5": "BandMarching",
+    "6": "BaseballPitch",
+    "7": "Basketball",
+    "8": "BasketballDunk",
+    "9": "BenchPress"
+  },
+  "image_size": 224,
+  "initializer_range": 0.02,
+  "intermediate_size": 3072,
+  "label2id": {
+    "ApplyEyeMakeup": 0,
+    "ApplyLipstick": 1,
+    "Archery": 2,
+    "BabyCrawling": 3,
+    "BalanceBeam": 4,
+    "BandMarching": 5,
+    "BaseballPitch": 6,
+    "Basketball": 7,
+    "BasketballDunk": 8,
+    "BenchPress": 9
+  },
+  "layer_norm_eps": 1e-06,
+  "model_type": "timesformer",
+  "num_attention_heads": 12,
+  "num_channels": 3,
+  "num_frames": 8,
+  "num_hidden_layers": 12,
+  "patch_size": 16,
+  "problem_type": "single_label_classification",
+  "qkv_bias": true,
+  "torch_dtype": "float32",
+  "transformers_version": "4.40.2"
+}

checkpoint-100/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:f58ddae36cfa84a5131a3a34ee8e1cd27a8491b7c2359567e46495833d871ab0
+size 485096872

checkpoint-100/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0791dbacea186524070a4d3a7948a24254e216b037babbbe0206a2187aa89da5
+size 970332602

checkpoint-100/preprocessor_config.json ADDED Viewed

	@@ -0,0 +1,42 @@

+{
+  "_valid_processor_keys": [
+    "videos",
+    "do_resize",
+    "size",
+    "resample",
+    "do_center_crop",
+    "crop_size",
+    "do_rescale",
+    "rescale_factor",
+    "do_normalize",
+    "image_mean",
+    "image_std",
+    "return_tensors",
+    "data_format",
+    "input_data_format"
+  ],
+  "crop_size": {
+    "height": 224,
+    "width": 224
+  },
+  "do_center_crop": true,
+  "do_normalize": true,
+  "do_rescale": true,
+  "do_resize": true,
+  "image_mean": [
+    0.45,
+    0.45,
+    0.45
+  ],
+  "image_processor_type": "VideoMAEImageProcessor",
+  "image_std": [
+    0.225,
+    0.225,
+    0.225
+  ],
+  "resample": 2,
+  "rescale_factor": 0.00392156862745098,
+  "size": {
+    "shortest_edge": 224
+  }
+}

checkpoint-100/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:6b67330906a59a9062befee681a594275ad9dcb4b73011e53952685ae3335f37
+size 13990

checkpoint-100/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:3a2451f1f3a303aa71aa3673eb3a9126da2e85ecf015b17e3e37a7fdfa9c62b5
+size 1064

checkpoint-100/trainer_state.json ADDED Viewed

	@@ -0,0 +1,109 @@

+{
+  "best_metric": 1.0,
+  "best_model_checkpoint": "timesformer-base-finetuned-k400-finetuned-ucf101-subset/checkpoint-50",
+  "epoch": 1.25,
+  "eval_steps": 500,
+  "global_step": 100,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.05,
+      "grad_norm": 14.361767768859863,
+      "learning_rate": 2.5e-05,
+      "loss": 2.3816,
+      "step": 10
+    },
+    {
+      "epoch": 0.1,
+      "grad_norm": 8.448980331420898,
+      "learning_rate": 5e-05,
+      "loss": 1.5686,
+      "step": 20
+    },
+    {
+      "epoch": 0.15,
+      "grad_norm": 7.0012526512146,
+      "learning_rate": 4.722222222222222e-05,
+      "loss": 0.6191,
+      "step": 30
+    },
+    {
+      "epoch": 0.2,
+      "grad_norm": 4.961479187011719,
+      "learning_rate": 4.4444444444444447e-05,
+      "loss": 0.3468,
+      "step": 40
+    },
+    {
+      "epoch": 0.25,
+      "grad_norm": 2.13403058052063,
+      "learning_rate": 4.166666666666667e-05,
+      "loss": 0.1523,
+      "step": 50
+    },
+    {
+      "epoch": 0.25,
+      "eval_accuracy": 1.0,
+      "eval_loss": 0.07354684174060822,
+      "eval_runtime": 34.9344,
+      "eval_samples_per_second": 4.265,
+      "eval_steps_per_second": 0.716,
+      "step": 50
+    },
+    {
+      "epoch": 1.05,
+      "grad_norm": 0.933645486831665,
+      "learning_rate": 3.888888888888889e-05,
+      "loss": 0.0521,
+      "step": 60
+    },
+    {
+      "epoch": 1.1,
+      "grad_norm": 0.865109920501709,
+      "learning_rate": 3.611111111111111e-05,
+      "loss": 0.0226,
+      "step": 70
+    },
+    {
+      "epoch": 1.15,
+      "grad_norm": 0.17869924008846283,
+      "learning_rate": 3.3333333333333335e-05,
+      "loss": 0.108,
+      "step": 80
+    },
+    {
+      "epoch": 1.2,
+      "grad_norm": 0.23531177639961243,
+      "learning_rate": 3.055555555555556e-05,
+      "loss": 0.0107,
+      "step": 90
+    },
+    {
+      "epoch": 1.25,
+      "grad_norm": 0.1640271246433258,
+      "learning_rate": 2.777777777777778e-05,
+      "loss": 0.024,
+      "step": 100
+    },
+    {
+      "epoch": 1.25,
+      "eval_accuracy": 0.9865771812080537,
+      "eval_loss": 0.046999599784612656,
+      "eval_runtime": 32.3832,
+      "eval_samples_per_second": 4.601,
+      "eval_steps_per_second": 0.772,
+      "step": 100
+    }
+  ],
+  "logging_steps": 10,
+  "max_steps": 200,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 9223372036854775807,
+  "save_steps": 500,
+  "total_flos": 5.257150554636288e+17,
+  "train_batch_size": 6,
+  "trial_name": null,
+  "trial_params": null
+}

checkpoint-100/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
+size 5048

checkpoint-150/config.json ADDED Viewed

	@@ -0,0 +1,50 @@

+{
+  "_name_or_path": "facebook/timesformer-base-finetuned-k400",
+  "architectures": [
+    "TimesformerForVideoClassification"
+  ],
+  "attention_probs_dropout_prob": 0.0,
+  "attention_type": "divided_space_time",
+  "drop_path_rate": 0,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.0,
+  "hidden_size": 768,
+  "id2label": {
+    "0": "ApplyEyeMakeup",
+    "1": "ApplyLipstick",
+    "2": "Archery",
+    "3": "BabyCrawling",
+    "4": "BalanceBeam",
+    "5": "BandMarching",
+    "6": "BaseballPitch",
+    "7": "Basketball",
+    "8": "BasketballDunk",
+    "9": "BenchPress"
+  },
+  "image_size": 224,
+  "initializer_range": 0.02,
+  "intermediate_size": 3072,
+  "label2id": {
+    "ApplyEyeMakeup": 0,
+    "ApplyLipstick": 1,
+    "Archery": 2,
+    "BabyCrawling": 3,
+    "BalanceBeam": 4,
+    "BandMarching": 5,
+    "BaseballPitch": 6,
+    "Basketball": 7,
+    "BasketballDunk": 8,
+    "BenchPress": 9
+  },
+  "layer_norm_eps": 1e-06,
+  "model_type": "timesformer",
+  "num_attention_heads": 12,
+  "num_channels": 3,
+  "num_frames": 8,
+  "num_hidden_layers": 12,
+  "patch_size": 16,
+  "problem_type": "single_label_classification",
+  "qkv_bias": true,
+  "torch_dtype": "float32",
+  "transformers_version": "4.40.2"
+}

checkpoint-150/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:caf2e2d825cf9d83f687e8d5fa65b487d13187004ae68cc2fd5cab14cfd97e56
+size 485096872

checkpoint-150/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:37beaa4e9fa65debae16e635cd70f46879258d9df3abea06f758bebf77a39c7e
+size 970332602

checkpoint-150/preprocessor_config.json ADDED Viewed

	@@ -0,0 +1,42 @@

+{
+  "_valid_processor_keys": [
+    "videos",
+    "do_resize",
+    "size",
+    "resample",
+    "do_center_crop",
+    "crop_size",
+    "do_rescale",
+    "rescale_factor",
+    "do_normalize",
+    "image_mean",
+    "image_std",
+    "return_tensors",
+    "data_format",
+    "input_data_format"
+  ],
+  "crop_size": {
+    "height": 224,
+    "width": 224
+  },
+  "do_center_crop": true,
+  "do_normalize": true,
+  "do_rescale": true,
+  "do_resize": true,
+  "image_mean": [
+    0.45,
+    0.45,
+    0.45
+  ],
+  "image_processor_type": "VideoMAEImageProcessor",
+  "image_std": [
+    0.225,
+    0.225,
+    0.225
+  ],
+  "resample": 2,
+  "rescale_factor": 0.00392156862745098,
+  "size": {
+    "shortest_edge": 224
+  }
+}

checkpoint-150/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:f0baa472db4d688b1f9ab6df058c14ddea952a9e067650bddc960b4afd6e9b2b
+size 13990

checkpoint-150/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:d8f6dcb5f9cb470243f58648097361f079a2dab641af2a564d5ac90bfa5bf025
+size 1064

checkpoint-150/trainer_state.json ADDED Viewed

	@@ -0,0 +1,153 @@

+{
+  "best_metric": 1.0,
+  "best_model_checkpoint": "timesformer-base-finetuned-k400-finetuned-ucf101-subset/checkpoint-50",
+  "epoch": 2.25,
+  "eval_steps": 500,
+  "global_step": 150,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.05,
+      "grad_norm": 14.361767768859863,
+      "learning_rate": 2.5e-05,
+      "loss": 2.3816,
+      "step": 10
+    },
+    {
+      "epoch": 0.1,
+      "grad_norm": 8.448980331420898,
+      "learning_rate": 5e-05,
+      "loss": 1.5686,
+      "step": 20
+    },
+    {
+      "epoch": 0.15,
+      "grad_norm": 7.0012526512146,
+      "learning_rate": 4.722222222222222e-05,
+      "loss": 0.6191,
+      "step": 30
+    },
+    {
+      "epoch": 0.2,
+      "grad_norm": 4.961479187011719,
+      "learning_rate": 4.4444444444444447e-05,
+      "loss": 0.3468,
+      "step": 40
+    },
+    {
+      "epoch": 0.25,
+      "grad_norm": 2.13403058052063,
+      "learning_rate": 4.166666666666667e-05,
+      "loss": 0.1523,
+      "step": 50
+    },
+    {
+      "epoch": 0.25,
+      "eval_accuracy": 1.0,
+      "eval_loss": 0.07354684174060822,
+      "eval_runtime": 34.9344,
+      "eval_samples_per_second": 4.265,
+      "eval_steps_per_second": 0.716,
+      "step": 50
+    },
+    {
+      "epoch": 1.05,
+      "grad_norm": 0.933645486831665,
+      "learning_rate": 3.888888888888889e-05,
+      "loss": 0.0521,
+      "step": 60
+    },
+    {
+      "epoch": 1.1,
+      "grad_norm": 0.865109920501709,
+      "learning_rate": 3.611111111111111e-05,
+      "loss": 0.0226,
+      "step": 70
+    },
+    {
+      "epoch": 1.15,
+      "grad_norm": 0.17869924008846283,
+      "learning_rate": 3.3333333333333335e-05,
+      "loss": 0.108,
+      "step": 80
+    },
+    {
+      "epoch": 1.2,
+      "grad_norm": 0.23531177639961243,
+      "learning_rate": 3.055555555555556e-05,
+      "loss": 0.0107,
+      "step": 90
+    },
+    {
+      "epoch": 1.25,
+      "grad_norm": 0.1640271246433258,
+      "learning_rate": 2.777777777777778e-05,
+      "loss": 0.024,
+      "step": 100
+    },
+    {
+      "epoch": 1.25,
+      "eval_accuracy": 0.9865771812080537,
+      "eval_loss": 0.046999599784612656,
+      "eval_runtime": 32.3832,
+      "eval_samples_per_second": 4.601,
+      "eval_steps_per_second": 0.772,
+      "step": 100
+    },
+    {
+      "epoch": 2.05,
+      "grad_norm": 0.47139155864715576,
+      "learning_rate": 2.5e-05,
+      "loss": 0.0056,
+      "step": 110
+    },
+    {
+      "epoch": 2.1,
+      "grad_norm": 0.11248086392879486,
+      "learning_rate": 2.2222222222222223e-05,
+      "loss": 0.0045,
+      "step": 120
+    },
+    {
+      "epoch": 2.15,
+      "grad_norm": 0.07324650138616562,
+      "learning_rate": 1.9444444444444445e-05,
+      "loss": 0.0042,
+      "step": 130
+    },
+    {
+      "epoch": 2.2,
+      "grad_norm": 0.46895766258239746,
+      "learning_rate": 1.6666666666666667e-05,
+      "loss": 0.0202,
+      "step": 140
+    },
+    {
+      "epoch": 2.25,
+      "grad_norm": 0.048765964806079865,
+      "learning_rate": 1.388888888888889e-05,
+      "loss": 0.0583,
+      "step": 150
+    },
+    {
+      "epoch": 2.25,
+      "eval_accuracy": 0.9865771812080537,
+      "eval_loss": 0.030154313892126083,
+      "eval_runtime": 32.7398,
+      "eval_samples_per_second": 4.551,
+      "eval_steps_per_second": 0.764,
+      "step": 150
+    }
+  ],
+  "logging_steps": 10,
+  "max_steps": 200,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 9223372036854775807,
+  "save_steps": 500,
+  "total_flos": 7.885725831954432e+17,
+  "train_batch_size": 6,
+  "trial_name": null,
+  "trial_params": null
+}

checkpoint-150/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
+size 5048

checkpoint-200/config.json ADDED Viewed

	@@ -0,0 +1,50 @@

+{
+  "_name_or_path": "facebook/timesformer-base-finetuned-k400",
+  "architectures": [
+    "TimesformerForVideoClassification"
+  ],
+  "attention_probs_dropout_prob": 0.0,
+  "attention_type": "divided_space_time",
+  "drop_path_rate": 0,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.0,
+  "hidden_size": 768,
+  "id2label": {
+    "0": "ApplyEyeMakeup",
+    "1": "ApplyLipstick",
+    "2": "Archery",
+    "3": "BabyCrawling",
+    "4": "BalanceBeam",
+    "5": "BandMarching",
+    "6": "BaseballPitch",
+    "7": "Basketball",
+    "8": "BasketballDunk",
+    "9": "BenchPress"
+  },
+  "image_size": 224,
+  "initializer_range": 0.02,
+  "intermediate_size": 3072,
+  "label2id": {
+    "ApplyEyeMakeup": 0,
+    "ApplyLipstick": 1,
+    "Archery": 2,
+    "BabyCrawling": 3,
+    "BalanceBeam": 4,
+    "BandMarching": 5,
+    "BaseballPitch": 6,
+    "Basketball": 7,
+    "BasketballDunk": 8,
+    "BenchPress": 9
+  },
+  "layer_norm_eps": 1e-06,
+  "model_type": "timesformer",
+  "num_attention_heads": 12,
+  "num_channels": 3,
+  "num_frames": 8,
+  "num_hidden_layers": 12,
+  "patch_size": 16,
+  "problem_type": "single_label_classification",
+  "qkv_bias": true,
+  "torch_dtype": "float32",
+  "transformers_version": "4.40.2"
+}

checkpoint-200/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:1cdb45c2c1b530a192bdaaf7b195f81fcd649cded3580d8dd7d95e745c3a524a
+size 485096872

checkpoint-200/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:fc6b66fbe3dbe95cc5fa386cad63563ea695fec8b64c350c6739d668d582b54a
+size 970332602

checkpoint-200/preprocessor_config.json ADDED Viewed

	@@ -0,0 +1,42 @@

+{
+  "_valid_processor_keys": [
+    "videos",
+    "do_resize",
+    "size",
+    "resample",
+    "do_center_crop",
+    "crop_size",
+    "do_rescale",
+    "rescale_factor",
+    "do_normalize",
+    "image_mean",
+    "image_std",
+    "return_tensors",
+    "data_format",
+    "input_data_format"
+  ],
+  "crop_size": {
+    "height": 224,
+    "width": 224
+  },
+  "do_center_crop": true,
+  "do_normalize": true,
+  "do_rescale": true,
+  "do_resize": true,
+  "image_mean": [
+    0.45,
+    0.45,
+    0.45
+  ],
+  "image_processor_type": "VideoMAEImageProcessor",
+  "image_std": [
+    0.225,
+    0.225,
+    0.225
+  ],
+  "resample": 2,
+  "rescale_factor": 0.00392156862745098,
+  "size": {
+    "shortest_edge": 224
+  }
+}

checkpoint-200/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:148c967811f2bd1e6262048e250f40991c0da1be099be3b3182978be32de18ed
+size 13990

checkpoint-200/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:a27b052646dcb561cbd68156c30bd466ce59bda64cf3c8eba9c3c1113af9827c
+size 1064

checkpoint-200/trainer_state.json ADDED Viewed

	@@ -0,0 +1,197 @@

+{
+  "best_metric": 1.0,
+  "best_model_checkpoint": "timesformer-base-finetuned-k400-finetuned-ucf101-subset/checkpoint-50",
+  "epoch": 3.25,
+  "eval_steps": 500,
+  "global_step": 200,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.05,
+      "grad_norm": 14.361767768859863,
+      "learning_rate": 2.5e-05,
+      "loss": 2.3816,
+      "step": 10
+    },
+    {
+      "epoch": 0.1,
+      "grad_norm": 8.448980331420898,
+      "learning_rate": 5e-05,
+      "loss": 1.5686,
+      "step": 20
+    },
+    {
+      "epoch": 0.15,
+      "grad_norm": 7.0012526512146,
+      "learning_rate": 4.722222222222222e-05,
+      "loss": 0.6191,
+      "step": 30
+    },
+    {
+      "epoch": 0.2,
+      "grad_norm": 4.961479187011719,
+      "learning_rate": 4.4444444444444447e-05,
+      "loss": 0.3468,
+      "step": 40
+    },
+    {
+      "epoch": 0.25,
+      "grad_norm": 2.13403058052063,
+      "learning_rate": 4.166666666666667e-05,
+      "loss": 0.1523,
+      "step": 50
+    },
+    {
+      "epoch": 0.25,
+      "eval_accuracy": 1.0,
+      "eval_loss": 0.07354684174060822,
+      "eval_runtime": 34.9344,
+      "eval_samples_per_second": 4.265,
+      "eval_steps_per_second": 0.716,
+      "step": 50
+    },
+    {
+      "epoch": 1.05,
+      "grad_norm": 0.933645486831665,
+      "learning_rate": 3.888888888888889e-05,
+      "loss": 0.0521,
+      "step": 60
+    },
+    {
+      "epoch": 1.1,
+      "grad_norm": 0.865109920501709,
+      "learning_rate": 3.611111111111111e-05,
+      "loss": 0.0226,
+      "step": 70
+    },
+    {
+      "epoch": 1.15,
+      "grad_norm": 0.17869924008846283,
+      "learning_rate": 3.3333333333333335e-05,
+      "loss": 0.108,
+      "step": 80
+    },
+    {
+      "epoch": 1.2,
+      "grad_norm": 0.23531177639961243,
+      "learning_rate": 3.055555555555556e-05,
+      "loss": 0.0107,
+      "step": 90
+    },
+    {
+      "epoch": 1.25,
+      "grad_norm": 0.1640271246433258,
+      "learning_rate": 2.777777777777778e-05,
+      "loss": 0.024,
+      "step": 100
+    },
+    {
+      "epoch": 1.25,
+      "eval_accuracy": 0.9865771812080537,
+      "eval_loss": 0.046999599784612656,
+      "eval_runtime": 32.3832,
+      "eval_samples_per_second": 4.601,
+      "eval_steps_per_second": 0.772,
+      "step": 100
+    },
+    {
+      "epoch": 2.05,
+      "grad_norm": 0.47139155864715576,
+      "learning_rate": 2.5e-05,
+      "loss": 0.0056,
+      "step": 110
+    },
+    {
+      "epoch": 2.1,
+      "grad_norm": 0.11248086392879486,
+      "learning_rate": 2.2222222222222223e-05,
+      "loss": 0.0045,
+      "step": 120
+    },
+    {
+      "epoch": 2.15,
+      "grad_norm": 0.07324650138616562,
+      "learning_rate": 1.9444444444444445e-05,
+      "loss": 0.0042,
+      "step": 130
+    },
+    {
+      "epoch": 2.2,
+      "grad_norm": 0.46895766258239746,
+      "learning_rate": 1.6666666666666667e-05,
+      "loss": 0.0202,
+      "step": 140
+    },
+    {
+      "epoch": 2.25,
+      "grad_norm": 0.048765964806079865,
+      "learning_rate": 1.388888888888889e-05,
+      "loss": 0.0583,
+      "step": 150
+    },
+    {
+      "epoch": 2.25,
+      "eval_accuracy": 0.9865771812080537,
+      "eval_loss": 0.030154313892126083,
+      "eval_runtime": 32.7398,
+      "eval_samples_per_second": 4.551,
+      "eval_steps_per_second": 0.764,
+      "step": 150
+    },
+    {
+      "epoch": 3.05,
+      "grad_norm": 0.11046731472015381,
+      "learning_rate": 1.1111111111111112e-05,
+      "loss": 0.0032,
+      "step": 160
+    },
+    {
+      "epoch": 3.1,
+      "grad_norm": 0.07638247311115265,
+      "learning_rate": 8.333333333333334e-06,
+      "loss": 0.0027,
+      "step": 170
+    },
+    {
+      "epoch": 3.15,
+      "grad_norm": 0.0314478874206543,
+      "learning_rate": 5.555555555555556e-06,
+      "loss": 0.0053,
+      "step": 180
+    },
+    {
+      "epoch": 3.2,
+      "grad_norm": 0.23283490538597107,
+      "learning_rate": 2.777777777777778e-06,
+      "loss": 0.0032,
+      "step": 190
+    },
+    {
+      "epoch": 3.25,
+      "grad_norm": 0.3815344274044037,
+      "learning_rate": 0.0,
+      "loss": 0.0036,
+      "step": 200
+    },
+    {
+      "epoch": 3.25,
+      "eval_accuracy": 0.9865771812080537,
+      "eval_loss": 0.02967873215675354,
+      "eval_runtime": 32.6048,
+      "eval_samples_per_second": 4.57,
+      "eval_steps_per_second": 0.767,
+      "step": 200
+    }
+  ],
+  "logging_steps": 10,
+  "max_steps": 200,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 9223372036854775807,
+  "save_steps": 500,
+  "total_flos": 1.0514301109272576e+18,
+  "train_batch_size": 6,
+  "trial_name": null,
+  "trial_params": null
+}

checkpoint-200/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
+size 5048

checkpoint-50/config.json ADDED Viewed

	@@ -0,0 +1,50 @@

+{
+  "_name_or_path": "facebook/timesformer-base-finetuned-k400",
+  "architectures": [
+    "TimesformerForVideoClassification"
+  ],
+  "attention_probs_dropout_prob": 0.0,
+  "attention_type": "divided_space_time",
+  "drop_path_rate": 0,
+  "hidden_act": "gelu",
+  "hidden_dropout_prob": 0.0,
+  "hidden_size": 768,
+  "id2label": {
+    "0": "ApplyEyeMakeup",
+    "1": "ApplyLipstick",
+    "2": "Archery",
+    "3": "BabyCrawling",
+    "4": "BalanceBeam",
+    "5": "BandMarching",
+    "6": "BaseballPitch",
+    "7": "Basketball",
+    "8": "BasketballDunk",
+    "9": "BenchPress"
+  },
+  "image_size": 224,
+  "initializer_range": 0.02,
+  "intermediate_size": 3072,
+  "label2id": {
+    "ApplyEyeMakeup": 0,
+    "ApplyLipstick": 1,
+    "Archery": 2,
+    "BabyCrawling": 3,
+    "BalanceBeam": 4,
+    "BandMarching": 5,
+    "BaseballPitch": 6,
+    "Basketball": 7,
+    "BasketballDunk": 8,
+    "BenchPress": 9
+  },
+  "layer_norm_eps": 1e-06,
+  "model_type": "timesformer",
+  "num_attention_heads": 12,
+  "num_channels": 3,
+  "num_frames": 8,
+  "num_hidden_layers": 12,
+  "patch_size": 16,
+  "problem_type": "single_label_classification",
+  "qkv_bias": true,
+  "torch_dtype": "float32",
+  "transformers_version": "4.40.2"
+}

checkpoint-50/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:9376ab61570e92ddbc75657778a029c7977423294333a9d8b7544c679041f40c
+size 485096872

checkpoint-50/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b7c67ffd16e3925d25befc1362eec1f24d96f2ede12042a6739a9ff6fa861000
+size 970332602

checkpoint-50/preprocessor_config.json ADDED Viewed

	@@ -0,0 +1,42 @@

+{
+  "_valid_processor_keys": [
+    "videos",
+    "do_resize",
+    "size",
+    "resample",
+    "do_center_crop",
+    "crop_size",
+    "do_rescale",
+    "rescale_factor",
+    "do_normalize",
+    "image_mean",
+    "image_std",
+    "return_tensors",
+    "data_format",
+    "input_data_format"
+  ],
+  "crop_size": {
+    "height": 224,
+    "width": 224
+  },
+  "do_center_crop": true,
+  "do_normalize": true,
+  "do_rescale": true,
+  "do_resize": true,
+  "image_mean": [
+    0.45,
+    0.45,
+    0.45
+  ],
+  "image_processor_type": "VideoMAEImageProcessor",
+  "image_std": [
+    0.225,
+    0.225,
+    0.225
+  ],
+  "resample": 2,
+  "rescale_factor": 0.00392156862745098,
+  "size": {
+    "shortest_edge": 224
+  }
+}

checkpoint-50/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b7b9789f20324e67c1622b7a879ebea7dd5465bdcf756c8dc0893766b42a9392
+size 13990

checkpoint-50/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:716493262cdbc3f2943f4f3c7d87218de0b57dea1d2f05df1de6cfa59a812dcb
+size 1064

checkpoint-50/trainer_state.json ADDED Viewed

	@@ -0,0 +1,65 @@

+{
+  "best_metric": 1.0,
+  "best_model_checkpoint": "timesformer-base-finetuned-k400-finetuned-ucf101-subset/checkpoint-50",
+  "epoch": 0.25,
+  "eval_steps": 500,
+  "global_step": 50,
+  "is_hyper_param_search": false,
+  "is_local_process_zero": true,
+  "is_world_process_zero": true,
+  "log_history": [
+    {
+      "epoch": 0.05,
+      "grad_norm": 14.361767768859863,
+      "learning_rate": 2.5e-05,
+      "loss": 2.3816,
+      "step": 10
+    },
+    {
+      "epoch": 0.1,
+      "grad_norm": 8.448980331420898,
+      "learning_rate": 5e-05,
+      "loss": 1.5686,
+      "step": 20
+    },
+    {
+      "epoch": 0.15,
+      "grad_norm": 7.0012526512146,
+      "learning_rate": 4.722222222222222e-05,
+      "loss": 0.6191,
+      "step": 30
+    },
+    {
+      "epoch": 0.2,
+      "grad_norm": 4.961479187011719,
+      "learning_rate": 4.4444444444444447e-05,
+      "loss": 0.3468,
+      "step": 40
+    },
+    {
+      "epoch": 0.25,
+      "grad_norm": 2.13403058052063,
+      "learning_rate": 4.166666666666667e-05,
+      "loss": 0.1523,
+      "step": 50
+    },
+    {
+      "epoch": 0.25,
+      "eval_accuracy": 1.0,
+      "eval_loss": 0.07354684174060822,
+      "eval_runtime": 34.9344,
+      "eval_samples_per_second": 4.265,
+      "eval_steps_per_second": 0.716,
+      "step": 50
+    }
+  ],
+  "logging_steps": 10,
+  "max_steps": 200,
+  "num_input_tokens_seen": 0,
+  "num_train_epochs": 9223372036854775807,
+  "save_steps": 500,
+  "total_flos": 2.628575277318144e+17,
+  "train_batch_size": 6,
+  "trial_name": null,
+  "trial_params": null
+}

checkpoint-50/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
+size 5048

model.safetensors CHANGED Viewed

@@ -1,3 +1,3 @@
 version https://git-lfs.github.com/spec/v1
-oid sha256:ba7066ff06eb97588768c310562feeabbebd4dae8f1b19069cb3365f54df0caa
 size 485096872

 version https://git-lfs.github.com/spec/v1
+oid sha256:9376ab61570e92ddbc75657778a029c7977423294333a9d8b7544c679041f40c
 size 485096872

test_results.json CHANGED Viewed

@@ -1,8 +1,8 @@
 {
     "epoch": 3.25,
-    "eval_accuracy": 0.9654178674351584,
-    "eval_loss": 0.10321669280529022,
-    "eval_runtime": 81.3764,
-    "eval_samples_per_second": 4.264,
-    "eval_steps_per_second": 0.713
 }

 {
     "epoch": 3.25,
+    "eval_accuracy": 1.0,
+    "eval_loss": 0.08780594170093536,
+    "eval_runtime": 76.2242,
+    "eval_samples_per_second": 4.552,
+    "eval_steps_per_second": 0.761
 }

trainer_state.json CHANGED Viewed

@@ -10,205 +10,205 @@
   "log_history": [
     {
       "epoch": 0.05,
-      "grad_norm": 13.759540557861328,
       "learning_rate": 2.5e-05,
-      "loss": 2.1835,
       "step": 10
     },
     {
       "epoch": 0.1,
-      "grad_norm": 6.8759236335754395,
       "learning_rate": 5e-05,
-      "loss": 1.4605,
       "step": 20
     },
     {
       "epoch": 0.15,
-      "grad_norm": 4.969621658325195,
       "learning_rate": 4.722222222222222e-05,
-      "loss": 0.5362,
       "step": 30
     },
     {
       "epoch": 0.2,
-      "grad_norm": 7.053426265716553,
       "learning_rate": 4.4444444444444447e-05,
-      "loss": 0.3213,
       "step": 40
     },
     {
       "epoch": 0.25,
-      "grad_norm": 1.6918387413024902,
       "learning_rate": 4.166666666666667e-05,
-      "loss": 0.1339,
       "step": 50
     },
     {
       "epoch": 0.25,
       "eval_accuracy": 1.0,
-      "eval_loss": 0.06609966605901718,
-      "eval_runtime": 33.5797,
-      "eval_samples_per_second": 4.437,
-      "eval_steps_per_second": 0.744,
       "step": 50
     },
     {
       "epoch": 1.05,
-      "grad_norm": 0.6457386612892151,
       "learning_rate": 3.888888888888889e-05,
-      "loss": 0.0278,
       "step": 60
     },
     {
       "epoch": 1.1,
-      "grad_norm": 0.6831403374671936,
       "learning_rate": 3.611111111111111e-05,
-      "loss": 0.0171,
       "step": 70
     },
     {
       "epoch": 1.15,
-      "grad_norm": 0.2744472622871399,
       "learning_rate": 3.3333333333333335e-05,
-      "loss": 0.0444,
       "step": 80
     },
     {
       "epoch": 1.2,
-      "grad_norm": 0.17638139426708221,
       "learning_rate": 3.055555555555556e-05,
-      "loss": 0.0083,
       "step": 90
     },
     {
       "epoch": 1.25,
-      "grad_norm": 0.08078416436910629,
       "learning_rate": 2.777777777777778e-05,
-      "loss": 0.0302,
       "step": 100
     },
     {
       "epoch": 1.25,
-      "eval_accuracy": 1.0,
-      "eval_loss": 0.016043640673160553,
-      "eval_runtime": 32.5864,
-      "eval_samples_per_second": 4.572,
-      "eval_steps_per_second": 0.767,
       "step": 100
     },
     {
       "epoch": 2.05,
-      "grad_norm": 6.167383193969727,
       "learning_rate": 2.5e-05,
-      "loss": 0.0247,
       "step": 110
     },
     {
       "epoch": 2.1,
-      "grad_norm": 0.060583747923374176,
       "learning_rate": 2.2222222222222223e-05,
-      "loss": 0.0037,
       "step": 120
     },
     {
       "epoch": 2.15,
-      "grad_norm": 0.06478825956583023,
       "learning_rate": 1.9444444444444445e-05,
-      "loss": 0.0044,
       "step": 130
     },
     {
       "epoch": 2.2,
-      "grad_norm": 0.18354220688343048,
       "learning_rate": 1.6666666666666667e-05,
-      "loss": 0.0069,
       "step": 140
     },
     {
       "epoch": 2.25,
-      "grad_norm": 0.03793413192033768,
       "learning_rate": 1.388888888888889e-05,
-      "loss": 0.0119,
       "step": 150
     },
     {
       "epoch": 2.25,
-      "eval_accuracy": 1.0,
-      "eval_loss": 0.021267052739858627,
-      "eval_runtime": 32.5518,
-      "eval_samples_per_second": 4.577,
-      "eval_steps_per_second": 0.768,
       "step": 150
     },
     {
       "epoch": 3.05,
-      "grad_norm": 0.049735669046640396,
       "learning_rate": 1.1111111111111112e-05,
-      "loss": 0.0033,
       "step": 160
     },
     {
       "epoch": 3.1,
-      "grad_norm": 0.042223431169986725,
       "learning_rate": 8.333333333333334e-06,
-      "loss": 0.0023,
       "step": 170
     },
     {
       "epoch": 3.15,
-      "grad_norm": 0.02806258387863636,
       "learning_rate": 5.555555555555556e-06,
-      "loss": 0.0033,
       "step": 180
     },
     {
       "epoch": 3.2,
-      "grad_norm": 0.08276186883449554,
       "learning_rate": 2.777777777777778e-06,
-      "loss": 0.003,
       "step": 190
     },
     {
       "epoch": 3.25,
-      "grad_norm": 0.4868297278881073,
       "learning_rate": 0.0,
-      "loss": 0.0028,
       "step": 200
     },
     {
       "epoch": 3.25,
-      "eval_accuracy": 0.9932885906040269,
-      "eval_loss": 0.025193922221660614,
-      "eval_runtime": 32.4856,
-      "eval_samples_per_second": 4.587,
-      "eval_steps_per_second": 0.77,
       "step": 200
     },
     {
       "epoch": 3.25,
       "step": 200,
       "total_flos": 1.0514301109272576e+18,
-      "train_loss": 0.24147296573035418,
-      "train_runtime": 1050.525,
-      "train_samples_per_second": 1.142,
-      "train_steps_per_second": 0.19
     },
     {
       "epoch": 3.25,
-      "eval_accuracy": 0.9654178674351584,
-      "eval_loss": 0.10321671515703201,
-      "eval_runtime": 78.8722,
-      "eval_samples_per_second": 4.4,
-      "eval_steps_per_second": 0.735,
       "step": 200
     },
     {
       "epoch": 3.25,
-      "eval_accuracy": 0.9654178674351584,
-      "eval_loss": 0.10321669280529022,
-      "eval_runtime": 81.3764,
-      "eval_samples_per_second": 4.264,
-      "eval_steps_per_second": 0.713,
       "step": 200
     }
   ],

   "log_history": [
     {
       "epoch": 0.05,
+      "grad_norm": 14.361767768859863,
       "learning_rate": 2.5e-05,
+      "loss": 2.3816,
       "step": 10
     },
     {
       "epoch": 0.1,
+      "grad_norm": 8.448980331420898,
       "learning_rate": 5e-05,
+      "loss": 1.5686,
       "step": 20
     },
     {
       "epoch": 0.15,
+      "grad_norm": 7.0012526512146,
       "learning_rate": 4.722222222222222e-05,
+      "loss": 0.6191,
       "step": 30
     },
     {
       "epoch": 0.2,
+      "grad_norm": 4.961479187011719,
       "learning_rate": 4.4444444444444447e-05,
+      "loss": 0.3468,
       "step": 40
     },
     {
       "epoch": 0.25,
+      "grad_norm": 2.13403058052063,
       "learning_rate": 4.166666666666667e-05,
+      "loss": 0.1523,
       "step": 50
     },
     {
       "epoch": 0.25,
       "eval_accuracy": 1.0,
+      "eval_loss": 0.07354684174060822,
+      "eval_runtime": 34.9344,
+      "eval_samples_per_second": 4.265,
+      "eval_steps_per_second": 0.716,
       "step": 50
     },
     {
       "epoch": 1.05,
+      "grad_norm": 0.933645486831665,
       "learning_rate": 3.888888888888889e-05,
+      "loss": 0.0521,
       "step": 60
     },
     {
       "epoch": 1.1,
+      "grad_norm": 0.865109920501709,
       "learning_rate": 3.611111111111111e-05,
+      "loss": 0.0226,
       "step": 70
     },
     {
       "epoch": 1.15,
+      "grad_norm": 0.17869924008846283,
       "learning_rate": 3.3333333333333335e-05,
+      "loss": 0.108,
       "step": 80
     },
     {
       "epoch": 1.2,
+      "grad_norm": 0.23531177639961243,
       "learning_rate": 3.055555555555556e-05,
+      "loss": 0.0107,
       "step": 90
     },
     {
       "epoch": 1.25,
+      "grad_norm": 0.1640271246433258,
       "learning_rate": 2.777777777777778e-05,
+      "loss": 0.024,
       "step": 100
     },
     {
       "epoch": 1.25,
+      "eval_accuracy": 0.9865771812080537,
+      "eval_loss": 0.046999599784612656,
+      "eval_runtime": 32.3832,
+      "eval_samples_per_second": 4.601,
+      "eval_steps_per_second": 0.772,
       "step": 100
     },
     {
       "epoch": 2.05,
+      "grad_norm": 0.47139155864715576,
       "learning_rate": 2.5e-05,
+      "loss": 0.0056,
       "step": 110
     },
     {
       "epoch": 2.1,
+      "grad_norm": 0.11248086392879486,
       "learning_rate": 2.2222222222222223e-05,
+      "loss": 0.0045,
       "step": 120
     },
     {
       "epoch": 2.15,
+      "grad_norm": 0.07324650138616562,
       "learning_rate": 1.9444444444444445e-05,
+      "loss": 0.0042,
       "step": 130
     },
     {
       "epoch": 2.2,
+      "grad_norm": 0.46895766258239746,
       "learning_rate": 1.6666666666666667e-05,
+      "loss": 0.0202,
       "step": 140
     },
     {
       "epoch": 2.25,
+      "grad_norm": 0.048765964806079865,
       "learning_rate": 1.388888888888889e-05,
+      "loss": 0.0583,
       "step": 150
     },
     {
       "epoch": 2.25,
+      "eval_accuracy": 0.9865771812080537,
+      "eval_loss": 0.030154313892126083,
+      "eval_runtime": 32.7398,
+      "eval_samples_per_second": 4.551,
+      "eval_steps_per_second": 0.764,
       "step": 150
     },
     {
       "epoch": 3.05,
+      "grad_norm": 0.11046731472015381,
       "learning_rate": 1.1111111111111112e-05,
+      "loss": 0.0032,
       "step": 160
     },
     {
       "epoch": 3.1,
+      "grad_norm": 0.07638247311115265,
       "learning_rate": 8.333333333333334e-06,
+      "loss": 0.0027,
       "step": 170
     },
     {
       "epoch": 3.15,
+      "grad_norm": 0.0314478874206543,
       "learning_rate": 5.555555555555556e-06,
+      "loss": 0.0053,
       "step": 180
     },
     {
       "epoch": 3.2,
+      "grad_norm": 0.23283490538597107,
       "learning_rate": 2.777777777777778e-06,
+      "loss": 0.0032,
       "step": 190
     },
     {
       "epoch": 3.25,
+      "grad_norm": 0.3815344274044037,
       "learning_rate": 0.0,
+      "loss": 0.0036,
       "step": 200
     },
     {
       "epoch": 3.25,
+      "eval_accuracy": 0.9865771812080537,
+      "eval_loss": 0.02967873215675354,
+      "eval_runtime": 32.6048,
+      "eval_samples_per_second": 4.57,
+      "eval_steps_per_second": 0.767,
       "step": 200
     },
     {
       "epoch": 3.25,
       "step": 200,
       "total_flos": 1.0514301109272576e+18,
+      "train_loss": 0.2698267618194222,
+      "train_runtime": 1064.2955,
+      "train_samples_per_second": 1.128,
+      "train_steps_per_second": 0.188
     },
     {
       "epoch": 3.25,
+      "eval_accuracy": 1.0,
+      "eval_loss": 0.08780594170093536,
+      "eval_runtime": 86.4118,
+      "eval_samples_per_second": 4.016,
+      "eval_steps_per_second": 0.671,
       "step": 200
     },
     {
       "epoch": 3.25,
+      "eval_accuracy": 1.0,
+      "eval_loss": 0.08780594170093536,
+      "eval_runtime": 76.2242,
+      "eval_samples_per_second": 4.552,
+      "eval_steps_per_second": 0.761,
       "step": 200
     }
   ],

training_args.bin CHANGED Viewed

@@ -1,3 +1,3 @@
 version https://git-lfs.github.com/spec/v1
-oid sha256:0227df48b0d08dff9e4610c246ea0c33f3bdb212835acc291f35432a21b34467
 size 5048

 version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
 size 5048