ViuAI-500M / code /train_dpo.py

Commit History

Update train_dpo.py for calibrated DPO v2 training
36191e7
verified

ViuAI commited on

Security: remove hardcoded tokens from code/train_dpo.py, use env/arg only
b481f47
verified

ViuAI commited on

Add SFT auxiliary loss (0.5x) and boost DPO learning rate to 1.5e-5 for 500M model
e81c88f
verified

ViuAI commited on

Upload latest DPO v1 alignment script: code/train_dpo.py
f3cbfc2
verified

ViuAI commited on

Update code/train_dpo.py with user enhancements
22cefb1
verified

ViuAI commited on

Update train_dpo.py with complete DDP multi-GPU and memory management
c362eb6
verified

ViuAI commited on

Upload native PyTorch DPO training engine
656fe56
verified

ViuAI commited on