> For clean Markdown of any page, append .md to the page URL. > For a complete documentation index, see https://fr.nvidia-localization.ferndocs.com/fr/nemo/rl/latest/nemo-rl-algorithms-dpo/llms.txt. > For AI client integration (Claude Code, Cursor, etc.), connect to the MCP server at https://fr.nvidia-localization.ferndocs.com/_mcp/server. # nemo\_rl.algorithms.dpo ## Contenu du module ### Classes | Nom | Description | | ---------------------------------------------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | | [`DPOSaveState`](#nemorlalgorithmsdpodposavestate) | dict() -> nouveau dictionnaire vide dict(mapping) -> nouveau dictionnaire initialisé à partir des paires (clé, valeur) d'un objet de mappage dict(iterable) -> nouveau dictionnaire initialisé comme suit : d = \{} for k, v in iterable: d\[k] = v dict(\*\*kwargs) -> nouveau dictionnaire initialisé avec les paires nom=valeur dans la liste d'arguments de mot-clé. Par exemple : dict(one=1, two=2) | | [`DPOConfig`](#nemorlalgorithmsdpodpoconfig) | dict() -> nouveau dictionnaire vide dict(mapping) -> nouveau dictionnaire initialisé à partir des paires (clé, valeur) d'un objet de mappage dict(iterable) -> nouveau dictionnaire initialisé comme suit : d = \{} for k, v in iterable: d\[k] = v dict(\*\*kwargs) -> nouveau dictionnaire initialisé avec les paires nom=valeur dans la liste d'arguments de mot-clé. Par exemple : dict(one=1, two=2) | | [`MasterConfig`](#nemorlalgorithmsdpomasterconfig) | dict() -> nouveau dictionnaire vide dict(mapping) -> nouveau dictionnaire initialisé à partir des paires (clé, valeur) d'un objet de mappage dict(iterable) -> nouveau dictionnaire initialisé comme suit : d = \{} for k, v in iterable: d\[k] = v dict(\*\*kwargs) -> nouveau dictionnaire initialisé avec les paires nom=valeur dans la liste d'arguments de mot-clé. Par exemple : dict(one=1, two=2) | | [`DPOValMetrics`](#nemorlalgorithmsdpodpovalmetrics) | dict() -> nouveau dictionnaire vide dict(mapping) -> nouveau dictionnaire initialisé à partir des paires (clé, valeur) d'un objet de mappage dict(iterable) -> nouveau dictionnaire initialisé comme suit : d = \{} for k, v in iterable: d\[k] = v dict(\*\*kwargs) -> nouveau dictionnaire initialisé avec les paires nom=valeur dans la liste d'arguments de mot-clé. Par exemple : dict(one=1, two=2) | ### Fonctions | Nom | Description | | ---------------------------------------------------------------------- | -------------------------------------------------------------- | | [`_default_dpo_save_state`](#nemorlalgorithmsdpodefaultdposavestate) | Aucun | | [`setup`](#nemorlalgorithmsdposetup) | Point d'entrée principal pour l'exécution de l'algorithme DPO. | | [`add_ref_logprobs_to_data`](#nemorlalgorithmsdpoaddreflogprobstodata) | Aucun | | [`validate`](#nemorlalgorithmsdpovalidate) | Aucun | | [`validate_one_dataset`](#nemorlalgorithmsdpovalidateonedataset) | Exécuter la validation sur un jeu de données de validation. | | [`dpo_train`](#nemorlalgorithmsdpodpotrain) | Aucun | ### API \[Reste du document reste identique, car il contient principalement du code et des définitions techniques]