Build advanced, job-ready skills in fine-tuning using Hugging Face, reinforcement learning using proximal preference optimization (PPO), and optimal solutions for direct preference optimization (DPO).
What you'll learn
fine-tune generative AI models using Hugging Face
apply reinforcement learning techniques like PPO and DPO