Commit graph

473 commits

Author SHA1 Message Date
Daniel Han
c3f4e9a87d Update pyproject.toml 2024-09-27 01:36:45 -07:00
Daniel Han
3dff3b3868 Update tokenizer_utils.py 2024-09-26 01:23:40 -07:00
Daniel Han
7c8f227681 Update README.md 2024-09-26 00:12:42 -07:00
Daniel Han
2462e5c51b Update README.md 2024-09-26 00:05:38 -07:00
Daniel Han
b0f3dc087a Update README.md 2024-09-26 00:02:15 -07:00
Daniel Han
2c5a3995c8 Update pyproject.toml 2024-09-25 23:47:15 -07:00
Daniel Han
a1ca724f5d Update pyproject.toml 2024-09-25 23:13:49 -07:00
Daniel Han
1c3124fc10 Remove version checks 2024-09-25 23:00:09 -07:00
Daniel Han
f00eaf1b09 Update _utils.py 2024-09-25 22:56:41 -07:00
Daniel Han
330a7f4682 Update llama.py 2024-09-25 22:12:21 -07:00
Daniel Han
539adef0f8 Update llama.py 2024-09-25 12:42:24 -07:00
Daniel Han
b4e4c874b4 Fix version 2024-09-25 12:35:38 -07:00
Daniel Han
64473743d5 Llama 3.2 2024-09-25 12:18:43 -07:00
Daniel Han
087ffc1907
Llama 3.2 (#1058)
* Layernorm

* Update layernorm.py

* Update layernorm.py

* Update layernorm.py

* Update layernorm.py

* Update layernorm.py

* Update layernorm.py

* Patch layernorm

* Update layernorm.py

* RMS Layernorm

* Update rms_layernorm.py

* Causal LM

* Update cross_entropy_loss.py

* Update cross_entropy_loss.py

* Update cross_entropy_loss.py

* Update cross_entropy_loss.py

* Update layernorm.py

* Update cross_entropy_loss.py

* Update cross_entropy_loss.py

* Update cross_entropy_loss.py

* Update cross_entropy_loss.py

* Update cross_entropy_loss.py

* Update cross_entropy_loss.py

* Update cross_entropy_loss.py

* Update _utils.py

* Update _utils.py

* Llama 3.2
2024-09-25 11:48:24 -07:00
Daniel Han
fb77505f84 Update _utils.py 2024-09-23 10:56:55 -07:00
Daniel Han
3ad8309b00 Update README.md 2024-09-23 01:36:50 -07:00
Daniel Han
1038c723bc Qwen 2.5 2024-09-23 01:27:12 -07:00
Daniel Han
bd2f0f549e Update chat_templates.py 2024-09-23 01:07:06 -07:00
Daniel Han
4063c1360e Upgrade Ollama presets 2024-09-23 01:02:24 -07:00
Daniel Han
bf493d5b2d Update chat_templates.py 2024-09-23 00:29:21 -07:00
Daniel Han
e543614fe3 Update tokenizer_utils.py 2024-09-23 00:04:33 -07:00
Daniel Han
80bba89341 Update tokenizer_utils.py 2024-09-22 23:00:24 -07:00
Daniel Han
c6bec501e4 Update tokenizer_utils.py 2024-09-22 22:48:35 -07:00
Daniel Han
26a0f945d6 Update mapper.py 2024-09-22 22:13:59 -07:00
Daniel Han
e5381b6a26 Update _utils.py 2024-09-22 02:38:28 -07:00
Nazim Ali
02cc97e388
fix: chat_templates.py bug (#1048)
* fix: chat_template bug

* fix: check trainer attribute values are not None
2024-09-22 01:18:37 -07:00
Daniel Han
c247bfc72c Update chat_templates.py 2024-09-21 01:56:17 -07:00
Daniel Han
0fbbdfc091 Merge branch 'nightly' 2024-09-18 14:30:33 -07:00
Daniel Han
3fddfd5166 Update mapper.py 2024-09-18 14:23:22 -07:00
Daniel Han
8aceff3e7b
Update README.md (#1036) 2024-09-18 13:23:45 -07:00
Daniel Han
c730659de7 Update llama.py 2024-09-17 17:38:12 -07:00
Daniel Han
f1951c0f6d Update mapper.py 2024-09-17 10:50:57 -07:00
Daniel Han
62c989ef0a Update mapper.py 2024-09-15 21:50:00 -07:00
Daniel Han
572c925fa7 Update _utils.py 2024-09-15 18:04:18 -07:00
Daniel Han
575c1bd67d
Update README.md (#1033) 2024-09-15 17:42:09 -07:00
Daniel Han
6c534341bb Update utils.py 2024-09-08 19:47:21 -07:00
Daniel Han
de43b9cedc Update __init__.py 2024-09-08 15:51:27 -07:00
Daniel Han
7476d4b5f6 Update README.md 2024-09-08 14:30:54 -07:00
Daniel Han
d674f1c852 Update README.md 2024-09-08 12:29:31 -07:00
Daniel Han
f549a5473c
Bug fixes (#1004)
* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* update token retrieval logic (#952)

* Fix DPO (#947)

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* update hf token retrieval logic

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* Update llama.py

* get_token

* Update README.md

* Update gemma2.py

* Update rms_layernorm.py

* synchronize

* Update gemma2.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* layernorm

* Update rms_layernorm.py

* Update gemma2.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* revert

* Gemma

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update gemma2.py

* Change UnslothTrainingArguments base class to SFTConfig (#979)

* Cohere

* Update trainer.py

* Cohere

* Cohere

* New models

* Update llama.py

* Update llama.py

* Update cohere.py

* Update llama.py

* Update cohere.py

* retry

* Update fast_lora.py

* Update llama.py

* Update fast_lora.py

* Update llama.py

* Update llama.py

* Update cross_entropy_loss.py

* _apply_lora_mlp

* Update _utils.py

* Gemma fixes

* Update llama.py

* Update flex_attention.py

* Update llama.py

* layernorm

* Update llama.py

* Update llama.py

* Flex Attention

* Update gemma2.py

* Update __init__.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update flex_attention.py

* Update chat_templates.py (#999)

fix all misspelled "unsued" to "unused"

* Update key from "from" to "user" (#1000)

When use [tokenizer.apply_chat_template](https://huggingface.co/docs/transformers/main/en/chat_templating), the key should be "role" rather than "from", this is liknk to [this issue](https://github.com/unslothai/unsloth/issues/994)

I don't know it is suitable for all situation, I also can add a dedicated parameter of the key if you think it is better.

* Update chat_templates.py

* Also patch the KTO trainer (#1001)

* flex attention

* Update llama.py

* Update flex_attention.py

* Update flex_attention.py

* Update _utils.py

* Update _utils.py

* Update flex_attention.py

* Update gemma2.py

* Update gemma2.py

---------

Co-authored-by: Hafedh <70411813+not-lain@users.noreply.github.com>
Co-authored-by: Tuan Pham <82665400+vTuanpham@users.noreply.github.com>
Co-authored-by: Yihao Wang <42559837+AgainstEntropy@users.noreply.github.com>
Co-authored-by: Peng <zphu1024@gmail.com>
Co-authored-by: Kyle Corbitt <kyle@openpipe.ai>
2024-09-08 03:16:09 -07:00
Daniel Han
d91d40a7b6 Bug fixes 2024-09-04 00:28:53 -07:00
Daniel Han
3682672d73 Fix bug 2024-09-03 17:30:40 -07:00
Daniel Han
480f2ef31c
Gemma faster inference (#987)
* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* update token retrieval logic (#952)

* Fix DPO (#947)

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* update hf token retrieval logic

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* Update llama.py

* get_token

* Update README.md

* Update gemma2.py

* Update rms_layernorm.py

* synchronize

* Update gemma2.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* layernorm

* Update rms_layernorm.py

* Update gemma2.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* revert

* Gemma

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update gemma2.py

* Change UnslothTrainingArguments base class to SFTConfig (#979)

* Cohere

* Update trainer.py

* Cohere

* Cohere

* New models

* Update llama.py

* Update llama.py

* Update cohere.py

* Update llama.py

* Update cohere.py

* retry

* Update fast_lora.py

* Update llama.py

* Update fast_lora.py

* Update llama.py

* Update llama.py

* Update cross_entropy_loss.py

* _apply_lora_mlp

* Update _utils.py

* Gemma fixes

* Update llama.py

* Update flex_attention.py

---------

Co-authored-by: Hafedh <70411813+not-lain@users.noreply.github.com>
Co-authored-by: Tuan Pham <82665400+vTuanpham@users.noreply.github.com>
2024-09-03 13:52:12 -07:00
Daniel Han
c085a4562c
Cohere, Bug fixes (#984)
* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* update token retrieval logic (#952)

* Fix DPO (#947)

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* update hf token retrieval logic

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* Update llama.py

* get_token

* Update README.md

* Update gemma2.py

* Update rms_layernorm.py

* synchronize

* Update gemma2.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* layernorm

* Update rms_layernorm.py

* Update gemma2.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* revert

* Gemma

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update rms_layernorm.py

* Update gemma2.py

* Change UnslothTrainingArguments base class to SFTConfig (#979)

* Cohere

* Update trainer.py

* Cohere

* Cohere

* New models

* Update llama.py

* Update llama.py

* Update cohere.py

* Update llama.py

* Update cohere.py

* retry

* Update fast_lora.py

* Update llama.py

* Update fast_lora.py

* Update llama.py

* Update llama.py

* Update cross_entropy_loss.py

* _apply_lora_mlp

* Update _utils.py

---------

Co-authored-by: Hafedh <70411813+not-lain@users.noreply.github.com>
Co-authored-by: Tuan Pham <82665400+vTuanpham@users.noreply.github.com>
2024-09-03 01:52:32 -07:00
Daniel Han
976d11a10d Update save.py 2024-08-27 00:08:39 -07:00
Daniel Han
12b437e122 Update gemma2.py 2024-08-23 23:43:57 -07:00
Daniel Han
20506463e1
Phi 3.5 bug fix (#955)
* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* update token retrieval logic (#952)

* Fix DPO (#947)

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* update hf token retrieval logic

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* Update llama.py

* get_token

* Update README.md

---------

Co-authored-by: Hafedh <70411813+not-lain@users.noreply.github.com>
2024-08-23 17:38:24 -07:00
Daniel Han
d0ca3497eb
Fix DPO (#947)
* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py
2024-08-22 02:18:03 -07:00
Daniel Han
600ffe2a17
Update README.md (#941)
Co-authored-by: Michael <107991372+shimmyshimmer@users.noreply.github.com>
2024-08-20 17:59:50 -07:00
Daniel Han
f629a638d6 Update chat_templates.py 2024-08-20 16:54:11 -07:00