giannisan commited on May 15

Commit

573f02e

•

1 Parent(s): 7264c72

Upload folder using huggingface_hub

Browse files

Files changed (38) hide show

README.md +6 -6
all_results.json +5 -5
checkpoint-100/config.json +50 -0
checkpoint-100/model.safetensors +3 -0
checkpoint-100/optimizer.pt +3 -0
checkpoint-100/preprocessor_config.json +42 -0
checkpoint-100/rng_state.pth +3 -0
checkpoint-100/scheduler.pt +3 -0
checkpoint-100/trainer_state.json +109 -0
checkpoint-100/training_args.bin +3 -0
checkpoint-150/config.json +50 -0
checkpoint-150/model.safetensors +3 -0
checkpoint-150/optimizer.pt +3 -0
checkpoint-150/preprocessor_config.json +42 -0
checkpoint-150/rng_state.pth +3 -0
checkpoint-150/scheduler.pt +3 -0
checkpoint-150/trainer_state.json +153 -0
checkpoint-150/training_args.bin +3 -0
checkpoint-200/config.json +50 -0
checkpoint-200/model.safetensors +3 -0
checkpoint-200/optimizer.pt +3 -0
checkpoint-200/preprocessor_config.json +42 -0
checkpoint-200/rng_state.pth +3 -0
checkpoint-200/scheduler.pt +3 -0
checkpoint-200/trainer_state.json +197 -0
checkpoint-200/training_args.bin +3 -0
checkpoint-50/config.json +50 -0
checkpoint-50/model.safetensors +3 -0
checkpoint-50/optimizer.pt +3 -0
checkpoint-50/preprocessor_config.json +42 -0
checkpoint-50/rng_state.pth +3 -0
checkpoint-50/scheduler.pt +3 -0
checkpoint-50/trainer_state.json +65 -0
checkpoint-50/training_args.bin +3 -0
model.safetensors +1 -1
test_results.json +5 -5
trainer_state.json +73 -73
training_args.bin +1 -1

README.md CHANGED Viewed

@@ -17,8 +17,8 @@ should probably proofread and complete it, then remove this comment. -->
 This model is a fine-tuned version of [facebook/timesformer-base-finetuned-k400](https://huggingface.co/facebook/timesformer-base-finetuned-k400) on an unknown dataset.
 It achieves the following results on the evaluation set:
-- Loss: 0.1032
-- Accuracy: 0.9654
 ## Model description
@@ -50,10 +50,10 @@ The following hyperparameters were used during training:
 | Training Loss | Epoch | Step | Validation Loss | Accuracy |
 |:-------------:|:-----:|:----:|:---------------:|:--------:|
-| 0.1339 | 0.25 | 50 | 0.0661 | 1.0 |
-| 0.0302 | 1.25 | 100 | 0.0160 | 1.0 |
-| 0.0119 | 2.25 | 150 | 0.0213 | 1.0 |
-| 0.0028 | 3.25 | 200 | 0.0252 | 0.9933 |
 ### Framework versions

 This model is a fine-tuned version of [facebook/timesformer-base-finetuned-k400](https://huggingface.co/facebook/timesformer-base-finetuned-k400) on an unknown dataset.
 It achieves the following results on the evaluation set:
+- Loss: 0.0878
+- Accuracy: 1.0
 ## Model description
 | Training Loss | Epoch | Step | Validation Loss | Accuracy |
 |:-------------:|:-----:|:----:|:---------------:|:--------:|
+| 0.1523 | 0.25 | 50 | 0.0735 | 1.0 |
+| 0.024 | 1.25 | 100 | 0.0470 | 0.9866 |
+| 0.0583 | 2.25 | 150 | 0.0302 | 0.9866 |
+| 0.0036 | 3.25 | 200 | 0.0297 | 0.9866 |
 ### Framework versions

all_results.json CHANGED Viewed

@@ -1,8 +1,8 @@
 {
  "epoch": 3.25,
- "eval_accuracy": 0.9654178674351584,
- "eval_loss": 0.10321669280529022,
- "eval_runtime": 81.3764,
- "eval_samples_per_second": 4.264,
- "eval_steps_per_second": 0.713
 }

 {
  "epoch": 3.25,
+ "eval_accuracy": 1.0,
+ "eval_loss": 0.08780594170093536,
+ "eval_runtime": 76.2242,
+ "eval_samples_per_second": 4.552,
+ "eval_steps_per_second": 0.761
 }

checkpoint-100/config.json ADDED Viewed

	@@ -0,0 +1,50 @@

+{
+ "_name_or_path": "facebook/timesformer-base-finetuned-k400",
+ "architectures": [
+ "TimesformerForVideoClassification"
+ ],
+ "attention_probs_dropout_prob": 0.0,
+ "attention_type": "divided_space_time",
+ "drop_path_rate": 0,
+ "hidden_act": "gelu",
+ "hidden_dropout_prob": 0.0,
+ "hidden_size": 768,
+ "id2label": {
+ "0": "ApplyEyeMakeup",
+ "1": "ApplyLipstick",
+ "2": "Archery",
+ "3": "BabyCrawling",
+ "4": "BalanceBeam",
+ "5": "BandMarching",
+ "6": "BaseballPitch",
+ "7": "Basketball",
+ "8": "BasketballDunk",
+ "9": "BenchPress"
+ },
+ "image_size": 224,
+ "initializer_range": 0.02,
+ "intermediate_size": 3072,
+ "label2id": {
+ "ApplyEyeMakeup": 0,
+ "ApplyLipstick": 1,
+ "Archery": 2,
+ "BabyCrawling": 3,
+ "BalanceBeam": 4,
+ "BandMarching": 5,
+ "BaseballPitch": 6,
+ "Basketball": 7,
+ "BasketballDunk": 8,
+ "BenchPress": 9
+ },
+ "layer_norm_eps": 1e-06,
+ "model_type": "timesformer",
+ "num_attention_heads": 12,
+ "num_channels": 3,
+ "num_frames": 8,
+ "num_hidden_layers": 12,
+ "patch_size": 16,
+ "problem_type": "single_label_classification",
+ "qkv_bias": true,
+ "torch_dtype": "float32",
+ "transformers_version": "4.40.2"
+}

checkpoint-100/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:f58ddae36cfa84a5131a3a34ee8e1cd27a8491b7c2359567e46495833d871ab0
+size 485096872

checkpoint-100/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0791dbacea186524070a4d3a7948a24254e216b037babbbe0206a2187aa89da5
+size 970332602

checkpoint-100/preprocessor_config.json ADDED Viewed

	@@ -0,0 +1,42 @@

+{
+ "_valid_processor_keys": [
+ "videos",
+ "do_resize",
+ "size",
+ "resample",
+ "do_center_crop",
+ "crop_size",
+ "do_rescale",
+ "rescale_factor",
+ "do_normalize",
+ "image_mean",
+ "image_std",
+ "return_tensors",
+ "data_format",
+ "input_data_format"
+ ],
+ "crop_size": {
+ "height": 224,
+ "width": 224
+ },
+ "do_center_crop": true,
+ "do_normalize": true,
+ "do_rescale": true,
+ "do_resize": true,
+ "image_mean": [
+ 0.45,
+ 0.45,
+ 0.45
+ ],
+ "image_processor_type": "VideoMAEImageProcessor",
+ "image_std": [
+ 0.225,
+ 0.225,
+ 0.225
+ ],
+ "resample": 2,
+ "rescale_factor": 0.00392156862745098,
+ "size": {
+ "shortest_edge": 224
+ }
+}

checkpoint-100/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:6b67330906a59a9062befee681a594275ad9dcb4b73011e53952685ae3335f37
+size 13990

checkpoint-100/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:3a2451f1f3a303aa71aa3673eb3a9126da2e85ecf015b17e3e37a7fdfa9c62b5
+size 1064

checkpoint-100/trainer_state.json ADDED Viewed

	@@ -0,0 +1,109 @@

+{
+ "best_metric": 1.0,
+ "best_model_checkpoint": "timesformer-base-finetuned-k400-finetuned-ucf101-subset/checkpoint-50",
+ "epoch": 1.25,
+ "eval_steps": 500,
+ "global_step": 100,
+ "is_hyper_param_search": false,
+ "is_local_process_zero": true,
+ "is_world_process_zero": true,
+ "log_history": [
+ {
+ "epoch": 0.05,
+ "grad_norm": 14.361767768859863,
+ "learning_rate": 2.5e-05,
+ "loss": 2.3816,
+ "step": 10
+ },
+ {
+ "epoch": 0.1,
+ "grad_norm": 8.448980331420898,
+ "learning_rate": 5e-05,
+ "loss": 1.5686,
+ "step": 20
+ },
+ {
+ "epoch": 0.15,
+ "grad_norm": 7.0012526512146,
+ "learning_rate": 4.722222222222222e-05,
+ "loss": 0.6191,
+ "step": 30
+ },
+ {
+ "epoch": 0.2,
+ "grad_norm": 4.961479187011719,
+ "learning_rate": 4.4444444444444447e-05,
+ "loss": 0.3468,
+ "step": 40
+ },
+ {
+ "epoch": 0.25,
+ "grad_norm": 2.13403058052063,
+ "learning_rate": 4.166666666666667e-05,
+ "loss": 0.1523,
+ "step": 50
+ },
+ {
+ "epoch": 0.25,
+ "eval_accuracy": 1.0,
+ "eval_loss": 0.07354684174060822,
+ "eval_runtime": 34.9344,
+ "eval_samples_per_second": 4.265,
+ "eval_steps_per_second": 0.716,
+ "step": 50
+ },
+ {
+ "epoch": 1.05,
+ "grad_norm": 0.933645486831665,
+ "learning_rate": 3.888888888888889e-05,
+ "loss": 0.0521,
+ "step": 60
+ },
+ {
+ "epoch": 1.1,
+ "grad_norm": 0.865109920501709,
+ "learning_rate": 3.611111111111111e-05,
+ "loss": 0.0226,
+ "step": 70
+ },
+ {
+ "epoch": 1.15,
+ "grad_norm": 0.17869924008846283,
+ "learning_rate": 3.3333333333333335e-05,
+ "loss": 0.108,
+ "step": 80
+ },
+ {
+ "epoch": 1.2,
+ "grad_norm": 0.23531177639961243,
+ "learning_rate": 3.055555555555556e-05,
+ "loss": 0.0107,
+ "step": 90
+ },
+ {
+ "epoch": 1.25,
+ "grad_norm": 0.1640271246433258,
+ "learning_rate": 2.777777777777778e-05,
+ "loss": 0.024,
+ "step": 100
+ },
+ {
+ "epoch": 1.25,
+ "eval_accuracy": 0.9865771812080537,
+ "eval_loss": 0.046999599784612656,
+ "eval_runtime": 32.3832,
+ "eval_samples_per_second": 4.601,
+ "eval_steps_per_second": 0.772,
+ "step": 100
+ }
+ ],
+ "logging_steps": 10,
+ "max_steps": 200,
+ "num_input_tokens_seen": 0,
+ "num_train_epochs": 9223372036854775807,
+ "save_steps": 500,
+ "total_flos": 5.257150554636288e+17,
+ "train_batch_size": 6,
+ "trial_name": null,
+ "trial_params": null
+}

checkpoint-100/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
+size 5048

checkpoint-150/config.json ADDED Viewed

	@@ -0,0 +1,50 @@

+{
+ "_name_or_path": "facebook/timesformer-base-finetuned-k400",
+ "architectures": [
+ "TimesformerForVideoClassification"
+ ],
+ "attention_probs_dropout_prob": 0.0,
+ "attention_type": "divided_space_time",
+ "drop_path_rate": 0,
+ "hidden_act": "gelu",
+ "hidden_dropout_prob": 0.0,
+ "hidden_size": 768,
+ "id2label": {
+ "0": "ApplyEyeMakeup",
+ "1": "ApplyLipstick",
+ "2": "Archery",
+ "3": "BabyCrawling",
+ "4": "BalanceBeam",
+ "5": "BandMarching",
+ "6": "BaseballPitch",
+ "7": "Basketball",
+ "8": "BasketballDunk",
+ "9": "BenchPress"
+ },
+ "image_size": 224,
+ "initializer_range": 0.02,
+ "intermediate_size": 3072,
+ "label2id": {
+ "ApplyEyeMakeup": 0,
+ "ApplyLipstick": 1,
+ "Archery": 2,
+ "BabyCrawling": 3,
+ "BalanceBeam": 4,
+ "BandMarching": 5,
+ "BaseballPitch": 6,
+ "Basketball": 7,
+ "BasketballDunk": 8,
+ "BenchPress": 9
+ },
+ "layer_norm_eps": 1e-06,
+ "model_type": "timesformer",
+ "num_attention_heads": 12,
+ "num_channels": 3,
+ "num_frames": 8,
+ "num_hidden_layers": 12,
+ "patch_size": 16,
+ "problem_type": "single_label_classification",
+ "qkv_bias": true,
+ "torch_dtype": "float32",
+ "transformers_version": "4.40.2"
+}

checkpoint-150/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:caf2e2d825cf9d83f687e8d5fa65b487d13187004ae68cc2fd5cab14cfd97e56
+size 485096872

checkpoint-150/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:37beaa4e9fa65debae16e635cd70f46879258d9df3abea06f758bebf77a39c7e
+size 970332602

checkpoint-150/preprocessor_config.json ADDED Viewed

	@@ -0,0 +1,42 @@

+{
+ "_valid_processor_keys": [
+ "videos",
+ "do_resize",
+ "size",
+ "resample",
+ "do_center_crop",
+ "crop_size",
+ "do_rescale",
+ "rescale_factor",
+ "do_normalize",
+ "image_mean",
+ "image_std",
+ "return_tensors",
+ "data_format",
+ "input_data_format"
+ ],
+ "crop_size": {
+ "height": 224,
+ "width": 224
+ },
+ "do_center_crop": true,
+ "do_normalize": true,
+ "do_rescale": true,
+ "do_resize": true,
+ "image_mean": [
+ 0.45,
+ 0.45,
+ 0.45
+ ],
+ "image_processor_type": "VideoMAEImageProcessor",
+ "image_std": [
+ 0.225,
+ 0.225,
+ 0.225
+ ],
+ "resample": 2,
+ "rescale_factor": 0.00392156862745098,
+ "size": {
+ "shortest_edge": 224
+ }
+}

checkpoint-150/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:f0baa472db4d688b1f9ab6df058c14ddea952a9e067650bddc960b4afd6e9b2b
+size 13990

checkpoint-150/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:d8f6dcb5f9cb470243f58648097361f079a2dab641af2a564d5ac90bfa5bf025
+size 1064

checkpoint-150/trainer_state.json ADDED Viewed

	@@ -0,0 +1,153 @@

+{
+ "best_metric": 1.0,
+ "best_model_checkpoint": "timesformer-base-finetuned-k400-finetuned-ucf101-subset/checkpoint-50",
+ "epoch": 2.25,
+ "eval_steps": 500,
+ "global_step": 150,
+ "is_hyper_param_search": false,
+ "is_local_process_zero": true,
+ "is_world_process_zero": true,
+ "log_history": [
+ {
+ "epoch": 0.05,
+ "grad_norm": 14.361767768859863,
+ "learning_rate": 2.5e-05,
+ "loss": 2.3816,
+ "step": 10
+ },
+ {
+ "epoch": 0.1,
+ "grad_norm": 8.448980331420898,
+ "learning_rate": 5e-05,
+ "loss": 1.5686,
+ "step": 20
+ },
+ {
+ "epoch": 0.15,
+ "grad_norm": 7.0012526512146,
+ "learning_rate": 4.722222222222222e-05,
+ "loss": 0.6191,
+ "step": 30
+ },
+ {
+ "epoch": 0.2,
+ "grad_norm": 4.961479187011719,
+ "learning_rate": 4.4444444444444447e-05,
+ "loss": 0.3468,
+ "step": 40
+ },
+ {
+ "epoch": 0.25,
+ "grad_norm": 2.13403058052063,
+ "learning_rate": 4.166666666666667e-05,
+ "loss": 0.1523,
+ "step": 50
+ },
+ {
+ "epoch": 0.25,
+ "eval_accuracy": 1.0,
+ "eval_loss": 0.07354684174060822,
+ "eval_runtime": 34.9344,
+ "eval_samples_per_second": 4.265,
+ "eval_steps_per_second": 0.716,
+ "step": 50
+ },
+ {
+ "epoch": 1.05,
+ "grad_norm": 0.933645486831665,
+ "learning_rate": 3.888888888888889e-05,
+ "loss": 0.0521,
+ "step": 60
+ },
+ {
+ "epoch": 1.1,
+ "grad_norm": 0.865109920501709,
+ "learning_rate": 3.611111111111111e-05,
+ "loss": 0.0226,
+ "step": 70
+ },
+ {
+ "epoch": 1.15,
+ "grad_norm": 0.17869924008846283,
+ "learning_rate": 3.3333333333333335e-05,
+ "loss": 0.108,
+ "step": 80
+ },
+ {
+ "epoch": 1.2,
+ "grad_norm": 0.23531177639961243,
+ "learning_rate": 3.055555555555556e-05,
+ "loss": 0.0107,
+ "step": 90
+ },
+ {
+ "epoch": 1.25,
+ "grad_norm": 0.1640271246433258,
+ "learning_rate": 2.777777777777778e-05,
+ "loss": 0.024,
+ "step": 100
+ },
+ {
+ "epoch": 1.25,
+ "eval_accuracy": 0.9865771812080537,
+ "eval_loss": 0.046999599784612656,
+ "eval_runtime": 32.3832,
+ "eval_samples_per_second": 4.601,
+ "eval_steps_per_second": 0.772,
+ "step": 100
+ },
+ {
+ "epoch": 2.05,
+ "grad_norm": 0.47139155864715576,
+ "learning_rate": 2.5e-05,
+ "loss": 0.0056,
+ "step": 110
+ },
+ {
+ "epoch": 2.1,
+ "grad_norm": 0.11248086392879486,
+ "learning_rate": 2.2222222222222223e-05,
+ "loss": 0.0045,
+ "step": 120
+ },
+ {
+ "epoch": 2.15,
+ "grad_norm": 0.07324650138616562,
+ "learning_rate": 1.9444444444444445e-05,
+ "loss": 0.0042,
+ "step": 130
+ },
+ {
+ "epoch": 2.2,
+ "grad_norm": 0.46895766258239746,
+ "learning_rate": 1.6666666666666667e-05,
+ "loss": 0.0202,
+ "step": 140
+ },
+ {
+ "epoch": 2.25,
+ "grad_norm": 0.048765964806079865,
+ "learning_rate": 1.388888888888889e-05,
+ "loss": 0.0583,
+ "step": 150
+ },
+ {
+ "epoch": 2.25,
+ "eval_accuracy": 0.9865771812080537,
+ "eval_loss": 0.030154313892126083,
+ "eval_runtime": 32.7398,
+ "eval_samples_per_second": 4.551,
+ "eval_steps_per_second": 0.764,
+ "step": 150
+ }
+ ],
+ "logging_steps": 10,
+ "max_steps": 200,
+ "num_input_tokens_seen": 0,
+ "num_train_epochs": 9223372036854775807,
+ "save_steps": 500,
+ "total_flos": 7.885725831954432e+17,
+ "train_batch_size": 6,
+ "trial_name": null,
+ "trial_params": null
+}

checkpoint-150/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
+size 5048

checkpoint-200/config.json ADDED Viewed

	@@ -0,0 +1,50 @@

+{
+ "_name_or_path": "facebook/timesformer-base-finetuned-k400",
+ "architectures": [
+ "TimesformerForVideoClassification"
+ ],
+ "attention_probs_dropout_prob": 0.0,
+ "attention_type": "divided_space_time",
+ "drop_path_rate": 0,
+ "hidden_act": "gelu",
+ "hidden_dropout_prob": 0.0,
+ "hidden_size": 768,
+ "id2label": {
+ "0": "ApplyEyeMakeup",
+ "1": "ApplyLipstick",
+ "2": "Archery",
+ "3": "BabyCrawling",
+ "4": "BalanceBeam",
+ "5": "BandMarching",
+ "6": "BaseballPitch",
+ "7": "Basketball",
+ "8": "BasketballDunk",
+ "9": "BenchPress"
+ },
+ "image_size": 224,
+ "initializer_range": 0.02,
+ "intermediate_size": 3072,
+ "label2id": {
+ "ApplyEyeMakeup": 0,
+ "ApplyLipstick": 1,
+ "Archery": 2,
+ "BabyCrawling": 3,
+ "BalanceBeam": 4,
+ "BandMarching": 5,
+ "BaseballPitch": 6,
+ "Basketball": 7,
+ "BasketballDunk": 8,
+ "BenchPress": 9
+ },
+ "layer_norm_eps": 1e-06,
+ "model_type": "timesformer",
+ "num_attention_heads": 12,
+ "num_channels": 3,
+ "num_frames": 8,
+ "num_hidden_layers": 12,
+ "patch_size": 16,
+ "problem_type": "single_label_classification",
+ "qkv_bias": true,
+ "torch_dtype": "float32",
+ "transformers_version": "4.40.2"
+}

checkpoint-200/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:1cdb45c2c1b530a192bdaaf7b195f81fcd649cded3580d8dd7d95e745c3a524a
+size 485096872

checkpoint-200/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:fc6b66fbe3dbe95cc5fa386cad63563ea695fec8b64c350c6739d668d582b54a
+size 970332602

checkpoint-200/preprocessor_config.json ADDED Viewed

	@@ -0,0 +1,42 @@

+{
+ "_valid_processor_keys": [
+ "videos",
+ "do_resize",
+ "size",
+ "resample",
+ "do_center_crop",
+ "crop_size",
+ "do_rescale",
+ "rescale_factor",
+ "do_normalize",
+ "image_mean",
+ "image_std",
+ "return_tensors",
+ "data_format",
+ "input_data_format"
+ ],
+ "crop_size": {
+ "height": 224,
+ "width": 224
+ },
+ "do_center_crop": true,
+ "do_normalize": true,
+ "do_rescale": true,
+ "do_resize": true,
+ "image_mean": [
+ 0.45,
+ 0.45,
+ 0.45
+ ],
+ "image_processor_type": "VideoMAEImageProcessor",
+ "image_std": [
+ 0.225,
+ 0.225,
+ 0.225
+ ],
+ "resample": 2,
+ "rescale_factor": 0.00392156862745098,
+ "size": {
+ "shortest_edge": 224
+ }
+}

checkpoint-200/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:148c967811f2bd1e6262048e250f40991c0da1be099be3b3182978be32de18ed
+size 13990

checkpoint-200/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:a27b052646dcb561cbd68156c30bd466ce59bda64cf3c8eba9c3c1113af9827c
+size 1064

checkpoint-200/trainer_state.json ADDED Viewed

	@@ -0,0 +1,197 @@

+{
+ "best_metric": 1.0,
+ "best_model_checkpoint": "timesformer-base-finetuned-k400-finetuned-ucf101-subset/checkpoint-50",
+ "epoch": 3.25,
+ "eval_steps": 500,
+ "global_step": 200,
+ "is_hyper_param_search": false,
+ "is_local_process_zero": true,
+ "is_world_process_zero": true,
+ "log_history": [
+ {
+ "epoch": 0.05,
+ "grad_norm": 14.361767768859863,
+ "learning_rate": 2.5e-05,
+ "loss": 2.3816,
+ "step": 10
+ },
+ {
+ "epoch": 0.1,
+ "grad_norm": 8.448980331420898,
+ "learning_rate": 5e-05,
+ "loss": 1.5686,
+ "step": 20
+ },
+ {
+ "epoch": 0.15,
+ "grad_norm": 7.0012526512146,
+ "learning_rate": 4.722222222222222e-05,
+ "loss": 0.6191,
+ "step": 30
+ },
+ {
+ "epoch": 0.2,
+ "grad_norm": 4.961479187011719,
+ "learning_rate": 4.4444444444444447e-05,
+ "loss": 0.3468,
+ "step": 40
+ },
+ {
+ "epoch": 0.25,
+ "grad_norm": 2.13403058052063,
+ "learning_rate": 4.166666666666667e-05,
+ "loss": 0.1523,
+ "step": 50
+ },
+ {
+ "epoch": 0.25,
+ "eval_accuracy": 1.0,
+ "eval_loss": 0.07354684174060822,
+ "eval_runtime": 34.9344,
+ "eval_samples_per_second": 4.265,
+ "eval_steps_per_second": 0.716,
+ "step": 50
+ },
+ {
+ "epoch": 1.05,
+ "grad_norm": 0.933645486831665,
+ "learning_rate": 3.888888888888889e-05,
+ "loss": 0.0521,
+ "step": 60
+ },
+ {
+ "epoch": 1.1,
+ "grad_norm": 0.865109920501709,
+ "learning_rate": 3.611111111111111e-05,
+ "loss": 0.0226,
+ "step": 70
+ },
+ {
+ "epoch": 1.15,
+ "grad_norm": 0.17869924008846283,
+ "learning_rate": 3.3333333333333335e-05,
+ "loss": 0.108,
+ "step": 80
+ },
+ {
+ "epoch": 1.2,
+ "grad_norm": 0.23531177639961243,
+ "learning_rate": 3.055555555555556e-05,
+ "loss": 0.0107,
+ "step": 90
+ },
+ {
+ "epoch": 1.25,
+ "grad_norm": 0.1640271246433258,
+ "learning_rate": 2.777777777777778e-05,
+ "loss": 0.024,
+ "step": 100
+ },
+ {
+ "epoch": 1.25,
+ "eval_accuracy": 0.9865771812080537,
+ "eval_loss": 0.046999599784612656,
+ "eval_runtime": 32.3832,
+ "eval_samples_per_second": 4.601,
+ "eval_steps_per_second": 0.772,
+ "step": 100
+ },
+ {
+ "epoch": 2.05,
+ "grad_norm": 0.47139155864715576,
+ "learning_rate": 2.5e-05,
+ "loss": 0.0056,
+ "step": 110
+ },
+ {
+ "epoch": 2.1,
+ "grad_norm": 0.11248086392879486,
+ "learning_rate": 2.2222222222222223e-05,
+ "loss": 0.0045,
+ "step": 120
+ },
+ {
+ "epoch": 2.15,
+ "grad_norm": 0.07324650138616562,
+ "learning_rate": 1.9444444444444445e-05,
+ "loss": 0.0042,
+ "step": 130
+ },
+ {
+ "epoch": 2.2,
+ "grad_norm": 0.46895766258239746,
+ "learning_rate": 1.6666666666666667e-05,
+ "loss": 0.0202,
+ "step": 140
+ },
+ {
+ "epoch": 2.25,
+ "grad_norm": 0.048765964806079865,
+ "learning_rate": 1.388888888888889e-05,
+ "loss": 0.0583,
+ "step": 150
+ },
+ {
+ "epoch": 2.25,
+ "eval_accuracy": 0.9865771812080537,
+ "eval_loss": 0.030154313892126083,
+ "eval_runtime": 32.7398,
+ "eval_samples_per_second": 4.551,
+ "eval_steps_per_second": 0.764,
+ "step": 150
+ },
+ {
+ "epoch": 3.05,
+ "grad_norm": 0.11046731472015381,
+ "learning_rate": 1.1111111111111112e-05,
+ "loss": 0.0032,
+ "step": 160
+ },
+ {
+ "epoch": 3.1,
+ "grad_norm": 0.07638247311115265,
+ "learning_rate": 8.333333333333334e-06,
+ "loss": 0.0027,
+ "step": 170
+ },
+ {
+ "epoch": 3.15,
+ "grad_norm": 0.0314478874206543,
+ "learning_rate": 5.555555555555556e-06,
+ "loss": 0.0053,
+ "step": 180
+ },
+ {
+ "epoch": 3.2,
+ "grad_norm": 0.23283490538597107,
+ "learning_rate": 2.777777777777778e-06,
+ "loss": 0.0032,
+ "step": 190
+ },
+ {
+ "epoch": 3.25,
+ "grad_norm": 0.3815344274044037,
+ "learning_rate": 0.0,
+ "loss": 0.0036,
+ "step": 200
+ },
+ {
+ "epoch": 3.25,
+ "eval_accuracy": 0.9865771812080537,
+ "eval_loss": 0.02967873215675354,
+ "eval_runtime": 32.6048,
+ "eval_samples_per_second": 4.57,
+ "eval_steps_per_second": 0.767,
+ "step": 200
+ }
+ ],
+ "logging_steps": 10,
+ "max_steps": 200,
+ "num_input_tokens_seen": 0,
+ "num_train_epochs": 9223372036854775807,
+ "save_steps": 500,
+ "total_flos": 1.0514301109272576e+18,
+ "train_batch_size": 6,
+ "trial_name": null,
+ "trial_params": null
+}

checkpoint-200/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
+size 5048

checkpoint-50/config.json ADDED Viewed

	@@ -0,0 +1,50 @@

+{
+ "_name_or_path": "facebook/timesformer-base-finetuned-k400",
+ "architectures": [
+ "TimesformerForVideoClassification"
+ ],
+ "attention_probs_dropout_prob": 0.0,
+ "attention_type": "divided_space_time",
+ "drop_path_rate": 0,
+ "hidden_act": "gelu",
+ "hidden_dropout_prob": 0.0,
+ "hidden_size": 768,
+ "id2label": {
+ "0": "ApplyEyeMakeup",
+ "1": "ApplyLipstick",
+ "2": "Archery",
+ "3": "BabyCrawling",
+ "4": "BalanceBeam",
+ "5": "BandMarching",
+ "6": "BaseballPitch",
+ "7": "Basketball",
+ "8": "BasketballDunk",
+ "9": "BenchPress"
+ },
+ "image_size": 224,
+ "initializer_range": 0.02,
+ "intermediate_size": 3072,
+ "label2id": {
+ "ApplyEyeMakeup": 0,
+ "ApplyLipstick": 1,
+ "Archery": 2,
+ "BabyCrawling": 3,
+ "BalanceBeam": 4,
+ "BandMarching": 5,
+ "BaseballPitch": 6,
+ "Basketball": 7,
+ "BasketballDunk": 8,
+ "BenchPress": 9
+ },
+ "layer_norm_eps": 1e-06,
+ "model_type": "timesformer",
+ "num_attention_heads": 12,
+ "num_channels": 3,
+ "num_frames": 8,
+ "num_hidden_layers": 12,
+ "patch_size": 16,
+ "problem_type": "single_label_classification",
+ "qkv_bias": true,
+ "torch_dtype": "float32",
+ "transformers_version": "4.40.2"
+}

checkpoint-50/model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:9376ab61570e92ddbc75657778a029c7977423294333a9d8b7544c679041f40c
+size 485096872

checkpoint-50/optimizer.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b7c67ffd16e3925d25befc1362eec1f24d96f2ede12042a6739a9ff6fa861000
+size 970332602

checkpoint-50/preprocessor_config.json ADDED Viewed

	@@ -0,0 +1,42 @@

+{
+ "_valid_processor_keys": [
+ "videos",
+ "do_resize",
+ "size",
+ "resample",
+ "do_center_crop",
+ "crop_size",
+ "do_rescale",
+ "rescale_factor",
+ "do_normalize",
+ "image_mean",
+ "image_std",
+ "return_tensors",
+ "data_format",
+ "input_data_format"
+ ],
+ "crop_size": {
+ "height": 224,
+ "width": 224
+ },
+ "do_center_crop": true,
+ "do_normalize": true,
+ "do_rescale": true,
+ "do_resize": true,
+ "image_mean": [
+ 0.45,
+ 0.45,
+ 0.45
+ ],
+ "image_processor_type": "VideoMAEImageProcessor",
+ "image_std": [
+ 0.225,
+ 0.225,
+ 0.225
+ ],
+ "resample": 2,
+ "rescale_factor": 0.00392156862745098,
+ "size": {
+ "shortest_edge": 224
+ }
+}

checkpoint-50/rng_state.pth ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:b7b9789f20324e67c1622b7a879ebea7dd5465bdcf756c8dc0893766b42a9392
+size 13990

checkpoint-50/scheduler.pt ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:716493262cdbc3f2943f4f3c7d87218de0b57dea1d2f05df1de6cfa59a812dcb
+size 1064

checkpoint-50/trainer_state.json ADDED Viewed

	@@ -0,0 +1,65 @@

+{
+ "best_metric": 1.0,
+ "best_model_checkpoint": "timesformer-base-finetuned-k400-finetuned-ucf101-subset/checkpoint-50",
+ "epoch": 0.25,
+ "eval_steps": 500,
+ "global_step": 50,
+ "is_hyper_param_search": false,
+ "is_local_process_zero": true,
+ "is_world_process_zero": true,
+ "log_history": [
+ {
+ "epoch": 0.05,
+ "grad_norm": 14.361767768859863,
+ "learning_rate": 2.5e-05,
+ "loss": 2.3816,
+ "step": 10
+ },
+ {
+ "epoch": 0.1,
+ "grad_norm": 8.448980331420898,
+ "learning_rate": 5e-05,
+ "loss": 1.5686,
+ "step": 20
+ },
+ {
+ "epoch": 0.15,
+ "grad_norm": 7.0012526512146,
+ "learning_rate": 4.722222222222222e-05,
+ "loss": 0.6191,
+ "step": 30
+ },
+ {
+ "epoch": 0.2,
+ "grad_norm": 4.961479187011719,
+ "learning_rate": 4.4444444444444447e-05,
+ "loss": 0.3468,
+ "step": 40
+ },
+ {
+ "epoch": 0.25,
+ "grad_norm": 2.13403058052063,
+ "learning_rate": 4.166666666666667e-05,
+ "loss": 0.1523,
+ "step": 50
+ },
+ {
+ "epoch": 0.25,
+ "eval_accuracy": 1.0,
+ "eval_loss": 0.07354684174060822,
+ "eval_runtime": 34.9344,
+ "eval_samples_per_second": 4.265,
+ "eval_steps_per_second": 0.716,
+ "step": 50
+ }
+ ],
+ "logging_steps": 10,
+ "max_steps": 200,
+ "num_input_tokens_seen": 0,
+ "num_train_epochs": 9223372036854775807,
+ "save_steps": 500,
+ "total_flos": 2.628575277318144e+17,
+ "train_batch_size": 6,
+ "trial_name": null,
+ "trial_params": null
+}

checkpoint-50/training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
+size 5048

model.safetensors CHANGED Viewed

@@ -1,3 +1,3 @@
 version https://git-lfs.github.com/spec/v1
-oid sha256:ba7066ff06eb97588768c310562feeabbebd4dae8f1b19069cb3365f54df0caa
 size 485096872

 version https://git-lfs.github.com/spec/v1
+oid sha256:9376ab61570e92ddbc75657778a029c7977423294333a9d8b7544c679041f40c
 size 485096872

test_results.json CHANGED Viewed

@@ -1,8 +1,8 @@
 {
  "epoch": 3.25,
- "eval_accuracy": 0.9654178674351584,
- "eval_loss": 0.10321669280529022,
- "eval_runtime": 81.3764,
- "eval_samples_per_second": 4.264,
- "eval_steps_per_second": 0.713
 }

 {
  "epoch": 3.25,
+ "eval_accuracy": 1.0,
+ "eval_loss": 0.08780594170093536,
+ "eval_runtime": 76.2242,
+ "eval_samples_per_second": 4.552,
+ "eval_steps_per_second": 0.761
 }

trainer_state.json CHANGED Viewed

@@ -10,205 +10,205 @@
  "log_history": [
  {
  "epoch": 0.05,
- "grad_norm": 13.759540557861328,
  "learning_rate": 2.5e-05,
- "loss": 2.1835,
  "step": 10
  },
  {
  "epoch": 0.1,
- "grad_norm": 6.8759236335754395,
  "learning_rate": 5e-05,
- "loss": 1.4605,
  "step": 20
  },
  {
  "epoch": 0.15,
- "grad_norm": 4.969621658325195,
  "learning_rate": 4.722222222222222e-05,
- "loss": 0.5362,
  "step": 30
  },
  {
  "epoch": 0.2,
- "grad_norm": 7.053426265716553,
  "learning_rate": 4.4444444444444447e-05,
- "loss": 0.3213,
  "step": 40
  },
  {
  "epoch": 0.25,
- "grad_norm": 1.6918387413024902,
  "learning_rate": 4.166666666666667e-05,
- "loss": 0.1339,
  "step": 50
  },
  {
  "epoch": 0.25,
  "eval_accuracy": 1.0,
- "eval_loss": 0.06609966605901718,
- "eval_runtime": 33.5797,
- "eval_samples_per_second": 4.437,
- "eval_steps_per_second": 0.744,
  "step": 50
  },
  {
  "epoch": 1.05,
- "grad_norm": 0.6457386612892151,
  "learning_rate": 3.888888888888889e-05,
- "loss": 0.0278,
  "step": 60
  },
  {
  "epoch": 1.1,
- "grad_norm": 0.6831403374671936,
  "learning_rate": 3.611111111111111e-05,
- "loss": 0.0171,
  "step": 70
  },
  {
  "epoch": 1.15,
- "grad_norm": 0.2744472622871399,
  "learning_rate": 3.3333333333333335e-05,
- "loss": 0.0444,
  "step": 80
  },
  {
  "epoch": 1.2,
- "grad_norm": 0.17638139426708221,
  "learning_rate": 3.055555555555556e-05,
- "loss": 0.0083,
  "step": 90
  },
  {
  "epoch": 1.25,
- "grad_norm": 0.08078416436910629,
  "learning_rate": 2.777777777777778e-05,
- "loss": 0.0302,
  "step": 100
  },
  {
  "epoch": 1.25,
- "eval_accuracy": 1.0,
- "eval_loss": 0.016043640673160553,
- "eval_runtime": 32.5864,
- "eval_samples_per_second": 4.572,
- "eval_steps_per_second": 0.767,
  "step": 100
  },
  {
  "epoch": 2.05,
- "grad_norm": 6.167383193969727,
  "learning_rate": 2.5e-05,
- "loss": 0.0247,
  "step": 110
  },
  {
  "epoch": 2.1,
- "grad_norm": 0.060583747923374176,
  "learning_rate": 2.2222222222222223e-05,
- "loss": 0.0037,
  "step": 120
  },
  {
  "epoch": 2.15,
- "grad_norm": 0.06478825956583023,
  "learning_rate": 1.9444444444444445e-05,
- "loss": 0.0044,
  "step": 130
  },
  {
  "epoch": 2.2,
- "grad_norm": 0.18354220688343048,
  "learning_rate": 1.6666666666666667e-05,
- "loss": 0.0069,
  "step": 140
  },
  {
  "epoch": 2.25,
- "grad_norm": 0.03793413192033768,
  "learning_rate": 1.388888888888889e-05,
- "loss": 0.0119,
  "step": 150
  },
  {
  "epoch": 2.25,
- "eval_accuracy": 1.0,
- "eval_loss": 0.021267052739858627,
- "eval_runtime": 32.5518,
- "eval_samples_per_second": 4.577,
- "eval_steps_per_second": 0.768,
  "step": 150
  },
  {
  "epoch": 3.05,
- "grad_norm": 0.049735669046640396,
  "learning_rate": 1.1111111111111112e-05,
- "loss": 0.0033,
  "step": 160
  },
  {
  "epoch": 3.1,
- "grad_norm": 0.042223431169986725,
  "learning_rate": 8.333333333333334e-06,
- "loss": 0.0023,
  "step": 170
  },
  {
  "epoch": 3.15,
- "grad_norm": 0.02806258387863636,
  "learning_rate": 5.555555555555556e-06,
- "loss": 0.0033,
  "step": 180
  },
  {
  "epoch": 3.2,
- "grad_norm": 0.08276186883449554,
  "learning_rate": 2.777777777777778e-06,
- "loss": 0.003,
  "step": 190
  },
  {
  "epoch": 3.25,
- "grad_norm": 0.4868297278881073,
  "learning_rate": 0.0,
- "loss": 0.0028,
  "step": 200
  },
  {
  "epoch": 3.25,
- "eval_accuracy": 0.9932885906040269,
- "eval_loss": 0.025193922221660614,
- "eval_runtime": 32.4856,
- "eval_samples_per_second": 4.587,
- "eval_steps_per_second": 0.77,
  "step": 200
  },
  {
  "epoch": 3.25,
  "step": 200,
  "total_flos": 1.0514301109272576e+18,
- "train_loss": 0.24147296573035418,
- "train_runtime": 1050.525,
- "train_samples_per_second": 1.142,
- "train_steps_per_second": 0.19
  },
  {
  "epoch": 3.25,
- "eval_accuracy": 0.9654178674351584,
- "eval_loss": 0.10321671515703201,
- "eval_runtime": 78.8722,
- "eval_samples_per_second": 4.4,
- "eval_steps_per_second": 0.735,
  "step": 200
  },
  {
  "epoch": 3.25,
- "eval_accuracy": 0.9654178674351584,
- "eval_loss": 0.10321669280529022,
- "eval_runtime": 81.3764,
- "eval_samples_per_second": 4.264,
- "eval_steps_per_second": 0.713,
  "step": 200
  }
  ],

  "log_history": [
  {
  "epoch": 0.05,
+ "grad_norm": 14.361767768859863,
  "learning_rate": 2.5e-05,
+ "loss": 2.3816,
  "step": 10
  },
  {
  "epoch": 0.1,
+ "grad_norm": 8.448980331420898,
  "learning_rate": 5e-05,
+ "loss": 1.5686,
  "step": 20
  },
  {
  "epoch": 0.15,
+ "grad_norm": 7.0012526512146,
  "learning_rate": 4.722222222222222e-05,
+ "loss": 0.6191,
  "step": 30
  },
  {
  "epoch": 0.2,
+ "grad_norm": 4.961479187011719,
  "learning_rate": 4.4444444444444447e-05,
+ "loss": 0.3468,
  "step": 40
  },
  {
  "epoch": 0.25,
+ "grad_norm": 2.13403058052063,
  "learning_rate": 4.166666666666667e-05,
+ "loss": 0.1523,
  "step": 50
  },
  {
  "epoch": 0.25,
  "eval_accuracy": 1.0,
+ "eval_loss": 0.07354684174060822,
+ "eval_runtime": 34.9344,
+ "eval_samples_per_second": 4.265,
+ "eval_steps_per_second": 0.716,
  "step": 50
  },
  {
  "epoch": 1.05,
+ "grad_norm": 0.933645486831665,
  "learning_rate": 3.888888888888889e-05,
+ "loss": 0.0521,
  "step": 60
  },
  {
  "epoch": 1.1,
+ "grad_norm": 0.865109920501709,
  "learning_rate": 3.611111111111111e-05,
+ "loss": 0.0226,
  "step": 70
  },
  {
  "epoch": 1.15,
+ "grad_norm": 0.17869924008846283,
  "learning_rate": 3.3333333333333335e-05,
+ "loss": 0.108,
  "step": 80
  },
  {
  "epoch": 1.2,
+ "grad_norm": 0.23531177639961243,
  "learning_rate": 3.055555555555556e-05,
+ "loss": 0.0107,
  "step": 90
  },
  {
  "epoch": 1.25,
+ "grad_norm": 0.1640271246433258,
  "learning_rate": 2.777777777777778e-05,
+ "loss": 0.024,
  "step": 100
  },
  {
  "epoch": 1.25,
+ "eval_accuracy": 0.9865771812080537,
+ "eval_loss": 0.046999599784612656,
+ "eval_runtime": 32.3832,
+ "eval_samples_per_second": 4.601,
+ "eval_steps_per_second": 0.772,
  "step": 100
  },
  {
  "epoch": 2.05,
+ "grad_norm": 0.47139155864715576,
  "learning_rate": 2.5e-05,
+ "loss": 0.0056,
  "step": 110
  },
  {
  "epoch": 2.1,
+ "grad_norm": 0.11248086392879486,
  "learning_rate": 2.2222222222222223e-05,
+ "loss": 0.0045,
  "step": 120
  },
  {
  "epoch": 2.15,
+ "grad_norm": 0.07324650138616562,
  "learning_rate": 1.9444444444444445e-05,
+ "loss": 0.0042,
  "step": 130
  },
  {
  "epoch": 2.2,
+ "grad_norm": 0.46895766258239746,
  "learning_rate": 1.6666666666666667e-05,
+ "loss": 0.0202,
  "step": 140
  },
  {
  "epoch": 2.25,
+ "grad_norm": 0.048765964806079865,
  "learning_rate": 1.388888888888889e-05,
+ "loss": 0.0583,
  "step": 150
  },
  {
  "epoch": 2.25,
+ "eval_accuracy": 0.9865771812080537,
+ "eval_loss": 0.030154313892126083,
+ "eval_runtime": 32.7398,
+ "eval_samples_per_second": 4.551,
+ "eval_steps_per_second": 0.764,
  "step": 150
  },
  {
  "epoch": 3.05,
+ "grad_norm": 0.11046731472015381,
  "learning_rate": 1.1111111111111112e-05,
+ "loss": 0.0032,
  "step": 160
  },
  {
  "epoch": 3.1,
+ "grad_norm": 0.07638247311115265,
  "learning_rate": 8.333333333333334e-06,
+ "loss": 0.0027,
  "step": 170
  },
  {
  "epoch": 3.15,
+ "grad_norm": 0.0314478874206543,
  "learning_rate": 5.555555555555556e-06,
+ "loss": 0.0053,
  "step": 180
  },
  {
  "epoch": 3.2,
+ "grad_norm": 0.23283490538597107,
  "learning_rate": 2.777777777777778e-06,
+ "loss": 0.0032,
  "step": 190
  },
  {
  "epoch": 3.25,
+ "grad_norm": 0.3815344274044037,
  "learning_rate": 0.0,
+ "loss": 0.0036,
  "step": 200
  },
  {
  "epoch": 3.25,
+ "eval_accuracy": 0.9865771812080537,
+ "eval_loss": 0.02967873215675354,
+ "eval_runtime": 32.6048,
+ "eval_samples_per_second": 4.57,
+ "eval_steps_per_second": 0.767,
  "step": 200
  },
  {
  "epoch": 3.25,
  "step": 200,
  "total_flos": 1.0514301109272576e+18,
+ "train_loss": 0.2698267618194222,
+ "train_runtime": 1064.2955,
+ "train_samples_per_second": 1.128,
+ "train_steps_per_second": 0.188
  },
  {
  "epoch": 3.25,
+ "eval_accuracy": 1.0,
+ "eval_loss": 0.08780594170093536,
+ "eval_runtime": 86.4118,
+ "eval_samples_per_second": 4.016,
+ "eval_steps_per_second": 0.671,
  "step": 200
  },
  {
  "epoch": 3.25,
+ "eval_accuracy": 1.0,
+ "eval_loss": 0.08780594170093536,
+ "eval_runtime": 76.2242,
+ "eval_samples_per_second": 4.552,
+ "eval_steps_per_second": 0.761,
  "step": 200
  }
  ],

training_args.bin CHANGED Viewed

@@ -1,3 +1,3 @@
 version https://git-lfs.github.com/spec/v1
-oid sha256:0227df48b0d08dff9e4610c246ea0c33f3bdb212835acc291f35432a21b34467
 size 5048

 version https://git-lfs.github.com/spec/v1
+oid sha256:0976022ff1e3e4b6c6ed3d4b9f4fbf236be50b91b6fc1edad006409b3e04fd11
 size 5048