From 66d6beb5265c1a524a034bbbb548a12eb563070c Mon Sep 17 00:00:00 2001 From: Daniel Han Date: Sun, 14 Jul 2024 22:46:21 -0700 Subject: [PATCH] Updated Home (markdown) --- Home.md | 19 +++++++++++++++++++ 1 file changed, 19 insertions(+) diff --git a/Home.md b/Home.md index 3520662..fcb498f 100644 --- a/Home.md +++ b/Home.md @@ -47,6 +47,25 @@ trainer = UnslothTrainer( ) ``` +### Train on completions / responses only (Do not train on inputs) +We now support it! Try the following: +```python +from trl import SFTTrainer +from transformers import TrainingArguments, DataCollatorForSeq2Seq +trainer = SFTTrainer( + model = model, + tokenizer = tokenizer, + train_dataset = dataset, + data_collator = DataCollatorForSeq2Seq(tokenizer = tokenizer), + ... + args = TrainingArguments( + ... + ), +) +from unsloth.chat_templates import train_on_responses_only +trainer = train_on_responses_only(trainer) +``` + ### Finetuning from your last checkpoint You must edit the `Trainer` first to add `save_strategy` and `save_steps`. Below saves a checkpoint every 50 steps to the folder `outputs`. ```python