File size: 3,225 Bytes

e30beec
 
 
e0892ea
7aeaae7
e0892ea
e30beec
 
 
 
 
da43db1
a569556
7aeaae7
da43db1
e30beec
 
 
da43db1
 
a569556
 
 
e30beec
7aeaae7
 
da43db1
a569556
7aeaae7
da43db1
7aeaae7
 
 
da43db1
a569556
7aeaae7
da43db1
7aeaae7
 
8d3381d
da43db1
a569556
 
 
 
53ddeb5
2b33153
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
22b44ac
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
e0892ea
 
 
 
 
 
 
e30beec
 
 
7aeaae7
e30beec
 
7aeaae7
e30beec
 
 
 
 
 
 
e0892ea
e30beec
 
 
 
e0892ea
7aeaae7
e30beec

{
  "best_metric": null,
  "best_model_checkpoint": null,
  "epoch": 0.005608524957936063,
  "eval_steps": 3,
  "global_step": 10,
  "is_hyper_param_search": false,
  "is_local_process_zero": true,
  "is_world_process_zero": true,
  "log_history": [
    {
      "epoch": 0.0005608524957936063,
      "grad_norm": 0.014755763113498688,
      "learning_rate": 2e-05,
      "loss": 11.9315,
      "step": 1
    },
    {
      "epoch": 0.0005608524957936063,
      "eval_loss": 11.931306838989258,
      "eval_runtime": 2.7544,
      "eval_samples_per_second": 272.651,
      "eval_steps_per_second": 136.507,
      "step": 1
    },
    {
      "epoch": 0.0011217049915872126,
      "grad_norm": 0.008283632807433605,
      "learning_rate": 4e-05,
      "loss": 11.9304,
      "step": 2
    },
    {
      "epoch": 0.0016825574873808188,
      "grad_norm": 0.016088014468550682,
      "learning_rate": 6e-05,
      "loss": 11.9319,
      "step": 3
    },
    {
      "epoch": 0.0016825574873808188,
      "eval_loss": 11.931303977966309,
      "eval_runtime": 2.8104,
      "eval_samples_per_second": 267.223,
      "eval_steps_per_second": 133.789,
      "step": 3
    },
    {
      "epoch": 0.002243409983174425,
      "grad_norm": 0.015639644116163254,
      "learning_rate": 8e-05,
      "loss": 11.9328,
      "step": 4
    },
    {
      "epoch": 0.0028042624789680315,
      "grad_norm": 0.0180886872112751,
      "learning_rate": 0.0001,
      "loss": 11.9248,
      "step": 5
    },
    {
      "epoch": 0.0033651149747616375,
      "grad_norm": 0.009673113003373146,
      "learning_rate": 0.00012,
      "loss": 11.926,
      "step": 6
    },
    {
      "epoch": 0.0033651149747616375,
      "eval_loss": 11.931286811828613,
      "eval_runtime": 2.8583,
      "eval_samples_per_second": 262.745,
      "eval_steps_per_second": 131.548,
      "step": 6
    },
    {
      "epoch": 0.003925967470555244,
      "grad_norm": 0.009378250688314438,
      "learning_rate": 0.00014,
      "loss": 11.9324,
      "step": 7
    },
    {
      "epoch": 0.00448681996634885,
      "grad_norm": 0.006758395582437515,
      "learning_rate": 0.00016,
      "loss": 11.935,
      "step": 8
    },
    {
      "epoch": 0.005047672462142457,
      "grad_norm": 0.01104277279227972,
      "learning_rate": 0.00018,
      "loss": 11.9287,
      "step": 9
    },
    {
      "epoch": 0.005047672462142457,
      "eval_loss": 11.93126392364502,
      "eval_runtime": 2.7781,
      "eval_samples_per_second": 270.333,
      "eval_steps_per_second": 135.347,
      "step": 9
    },
    {
      "epoch": 0.005608524957936063,
      "grad_norm": 0.007968397811055183,
      "learning_rate": 0.0002,
      "loss": 11.9334,
      "step": 10
    }
  ],
  "logging_steps": 1,
  "max_steps": 10,
  "num_input_tokens_seen": 0,
  "num_train_epochs": 1,
  "save_steps": 3,
  "stateful_callbacks": {
    "TrainerControl": {
      "args": {
        "should_epoch_stop": false,
        "should_evaluate": false,
        "should_log": false,
        "should_save": true,
        "should_training_stop": true
      },
      "attributes": {}
    }
  },
  "total_flos": 1211154432.0,
  "train_batch_size": 2,
  "trial_name": null,
  "trial_params": null
}