100%|████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████████| 990/990 [3:07:35<00:00, 11.37s/it] {'loss': inf, 'grad_norm': nan, 'learning_rate': 2e-05, 'epoch': 2.52} {'train_runtime': 11256.003, 'train_samples_per_second': 5.649, 'train_steps_per_second': 0.088, 'train_loss': nan, 'epoch': 4.98}