Running Complete LLM Pretraining Pipeline (100M params, Single GPU) 🚀 Train a 100M‑parameter language model on a single GPU