ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models

Prix à partir de
37,21

En vedette

COMPARER TOUS LES MAGASINS EN LIGNE (2)

Description

ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models

Comparer les boutiques en ligne (2)

Shop
Prix
Affranchissement
Prix total
37,21 
Gratuit
37,21 
Voir l’offre
Gratuit Shipping Costs
37,21 
Gratuit
37,21 
Voir l’offre
Gratuit Shipping Costs
Description (0)

ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models


Spécifications du produit

Marque Independently Published
EAN
  • 9798193902928

Choix en vedette
37,21 
Voir l’offre