File size: 3,222 Bytes

e30beec
 
 
0c4664b
7aeaae7
0c4664b
e30beec
 
 
 
 
da43db1
f2e65c9
7aeaae7
da43db1
e30beec
 
 
da43db1
 
f2e65c9
 
 
e30beec
7aeaae7
 
da43db1
f2e65c9
7aeaae7
da43db1
7aeaae7
 
 
da43db1
f2e65c9
7aeaae7
da43db1
7aeaae7
 
8d3381d
da43db1
 
f2e65c9
 
 
53ddeb5
591db01
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
32cb950
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
0c4664b
 
 
 
 
 
 
e30beec
 
 
7aeaae7
e30beec
 
7aeaae7
e30beec
 
 
 
 
 
 
0c4664b
e30beec
 
 
 
0c4664b
7aeaae7
e30beec

{
  "best_metric": null,
  "best_model_checkpoint": null,
  "epoch": 0.005608524957936063,
  "eval_steps": 3,
  "global_step": 10,
  "is_hyper_param_search": false,
  "is_local_process_zero": true,
  "is_world_process_zero": true,
  "log_history": [
    {
      "epoch": 0.0005608524957936063,
      "grad_norm": 0.015017175115644932,
      "learning_rate": 2e-05,
      "loss": 11.9315,
      "step": 1
    },
    {
      "epoch": 0.0005608524957936063,
      "eval_loss": 11.931306838989258,
      "eval_runtime": 2.741,
      "eval_samples_per_second": 273.986,
      "eval_steps_per_second": 137.176,
      "step": 1
    },
    {
      "epoch": 0.0011217049915872126,
      "grad_norm": 0.008692055940628052,
      "learning_rate": 4e-05,
      "loss": 11.9304,
      "step": 2
    },
    {
      "epoch": 0.0016825574873808188,
      "grad_norm": 0.012978250160813332,
      "learning_rate": 6e-05,
      "loss": 11.9319,
      "step": 3
    },
    {
      "epoch": 0.0016825574873808188,
      "eval_loss": 11.931302070617676,
      "eval_runtime": 2.7886,
      "eval_samples_per_second": 269.31,
      "eval_steps_per_second": 134.834,
      "step": 3
    },
    {
      "epoch": 0.002243409983174425,
      "grad_norm": 0.01647368259727955,
      "learning_rate": 8e-05,
      "loss": 11.9328,
      "step": 4
    },
    {
      "epoch": 0.0028042624789680315,
      "grad_norm": 0.018929986283183098,
      "learning_rate": 0.0001,
      "loss": 11.9248,
      "step": 5
    },
    {
      "epoch": 0.0033651149747616375,
      "grad_norm": 0.008768893778324127,
      "learning_rate": 0.00012,
      "loss": 11.926,
      "step": 6
    },
    {
      "epoch": 0.0033651149747616375,
      "eval_loss": 11.93128776550293,
      "eval_runtime": 2.844,
      "eval_samples_per_second": 264.062,
      "eval_steps_per_second": 132.207,
      "step": 6
    },
    {
      "epoch": 0.003925967470555244,
      "grad_norm": 0.011632150039076805,
      "learning_rate": 0.00014,
      "loss": 11.9324,
      "step": 7
    },
    {
      "epoch": 0.00448681996634885,
      "grad_norm": 0.00711103156208992,
      "learning_rate": 0.00016,
      "loss": 11.935,
      "step": 8
    },
    {
      "epoch": 0.005047672462142457,
      "grad_norm": 0.013323415070772171,
      "learning_rate": 0.00018,
      "loss": 11.9287,
      "step": 9
    },
    {
      "epoch": 0.005047672462142457,
      "eval_loss": 11.93126106262207,
      "eval_runtime": 2.7772,
      "eval_samples_per_second": 270.417,
      "eval_steps_per_second": 135.389,
      "step": 9
    },
    {
      "epoch": 0.005608524957936063,
      "grad_norm": 0.008568677119910717,
      "learning_rate": 0.0002,
      "loss": 11.9335,
      "step": 10
    }
  ],
  "logging_steps": 1,
  "max_steps": 10,
  "num_input_tokens_seen": 0,
  "num_train_epochs": 1,
  "save_steps": 3,
  "stateful_callbacks": {
    "TrainerControl": {
      "args": {
        "should_epoch_stop": false,
        "should_evaluate": false,
        "should_log": false,
        "should_save": true,
        "should_training_stop": true
      },
      "attributes": {}
    }
  },
  "total_flos": 1211154432.0,
  "train_batch_size": 2,
  "trial_name": null,
  "trial_params": null
}