ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models

Prijzen vanaf
37,21

Uitgelicht

VERGELIJK ALLE AANBIEDERS (2)

Beschrijving

ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models

Vergelijk aanbieders (2)

Shop
Prijs
Verzendkosten
Totale prijs
37,21
Gratis
37,21
Naar shop
Gratis Shipping Costs
37,21
Gratis
37,21
Naar shop
Gratis Shipping Costs
Beschrijving (0)

ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models


Productspecificaties

Merk Independently Published
EAN
  • 9798193902928

Uitgelichte Keuze
37,21
Naar shop