100%|████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████| 855/855 [2:29:18<00:00, 10.48s/it] {'loss': inf, 'grad_norm': nan, 'learning_rate': 2e-05, 'epoch': 2.92} {'train_runtime': 8960.1161, 'train_samples_per_second': 6.117, 'train_steps_per_second': 0.095, 'train_loss': nan, 'epoch': 4.99}