ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models

Prezzi da
36,51

In evidenza

CONFRONTA TUTTI I WEBSHOP (2)

Descrizione

ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models

Confronta i webshop (2)

Shop
Prezzo
36,51 
36,51 
Descrizione (0)

ENGINEERING LLM POST-TRAINING: RLHF, Reward Modeling, DPO, GRPO, and Preference Optimization for Aligned Language Models


Specifiche del prodotto

Marchio Independently Published
EAN
  • 9798193902928

Scelta in evidenza
36,51 
Vai allo shop