eca7ca3428
PEFTTrainer with production-grade training loop: - PyTorch DDP multi-GPU via torchrun - Mixed-precision training (fp16/bf16) with GradScaler - Gradient checkpointing for long contexts - Cosine-with-warmup LR schedule - MSE loss + optional pinball quantile loss (9 channels) - Early stopping on validation loss - Adapter-only checkpointing (safetensors) - W&B logging (rank-0 only) - Differentiable training forward that replicates the 2.5 patch -> RevIN -> transformer -> output-head -> un-RevIN path