# tinker_cookbook.distillation.train_on_policy.Config

## _class_ [**tinker_cookbook.distillation.train_on_policy.Config**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L134)()

**Fields:**

- [**learning_rate**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L135) ( _float_)
- [**dataset_configs**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L136) ( _list[ [DistillationDatasetConfig](https://tinker-docs.thinkingmachines.ai/cookbook/api-reference/distillation/distillationdatasetconfig/)]_)
- [**model_name**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L137) ( _str_)
- [**recipe_name**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L138) ( _str_)
- [**renderer_name**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L139) ( _str | None_, default: `None`)
- [**max_tokens**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L140) ( _int_)
- [**temperature**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L141) ( _float_, default: `1.0`)
- [**compute_post_kl**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L142) ( _bool_, default: `False`)
- [**evaluator_builders**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L143) ( _list[SamplingClientEvaluatorBuilder]_, default: `[]`)
- [**lora_rank**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L144) ( _int_, default: `32`)
- [**kl_penalty_coef**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L146) ( _float_, default: `1.0`)
- [**kl_discount_factor**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L147) ( _float_, default: `0.0`)
- [**loss_fn**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L151) ( _LossFnType_, default: `'importance_sampling'`) – See https://tinker-docs.thinkingmachines.ai/losses
- [**loss_fn_config**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L152) ( _dict[str, Any] | None_, default: `None`)
- [**num_substeps**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L156) ( _int_, default: `1`) – Useful for very large batch sizes.
- [**wandb_project**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L158) ( _str | None_, default: `None`)
- [**wandb_name**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L159) ( _str | None_, default: `None`)
- [**log_path**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L161) ( _str_)
- [**base_url**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L162) ( _str | None_, default: `None`)
- [**enable_trace**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L163) ( _bool_, default: `False`)
- [**span_chart_every**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L164) ( _int_, default: `0`)
- [**eval_every**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L166) ( _int_, default: `20`)
- [**save_every**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L167) ( _int_, default: `20`)
- [**load_checkpoint_path**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L168) ( _str | None_, default: `None`)
- [**max_steps**](https://github.com/thinking-machines-lab/tinker-cookbook/blob/main/tinker_cookbook/distillation/train_on_policy.py#L171) ( _int | None_, default: `None`) – Maximum number of training steps. If None, train on the full dataset.
