Minimal LLM Post-Training Experiments on an 8GB GPU (SFT, DPO, GRPO)

By popopanda · Show HN

AI Infra · Story 49133851

View original

HomeResourceLoading…