Commit graph

4,672 commits

Author SHA1 Message Date
Daniel Han-Chen
16edcb3be2 Update save.py 2024-01-21 04:13:03 +11:00
Daniel Han
3d05a74b12 Fixed saving! (#113)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py

* getattr

* RSLoRA and LoftQ direct support

* Update llama.py

* Update llama.py

* Update llama.py

* Fix DPO + GGUF

* Fix quantization_method

* Fix quantization_config

* patch model

* Update llama.py

* Update llama.py

* Update llama.py

* Update save.py

* Update save.py

* tokenizer_save_settings

* Update save.py

* quantization and loftq

* Update save.py

* Update llama.py

* Update save.py

* upload_to_huggingface

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py
2024-01-21 03:43:49 +11:00
Daniel Han
bb05d6b6e2 Hotfix for Jan 2024 Release (#110)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py

* getattr

* RSLoRA and LoftQ direct support

* Update llama.py

* Update llama.py

* Update llama.py

* Fix DPO + GGUF

* Fix quantization_method

* Fix quantization_config

* patch model

* Update llama.py

* Update llama.py

* Update llama.py

* Update save.py

* Update save.py

* tokenizer_save_settings

* Update save.py

* quantization and loftq

* Update save.py

* Update llama.py

* Update save.py
2024-01-20 23:23:00 +11:00
Daniel Han
12e75c93d0 Quick fixes (#106)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py

* getattr

* RSLoRA and LoftQ direct support

* Update llama.py

* Update llama.py

* Update llama.py

* Fix DPO + GGUF
2024-01-20 04:25:06 +11:00
Daniel Han-Chen
52b5ef31e0 Update _utils.py 2024-01-20 02:30:31 +11:00
Daniel Han-Chen
1a19c38675 Merge branch 'main' of https://github.com/unslothai/unsloth 2024-01-19 23:15:38 +11:00
Daniel Han-Chen
0a52390ac2 Revert quantization methods 2024-01-19 23:15:20 +11:00
Daniel Han
0d6e52b5c7 getattr issues (#103)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py

* getattr
2024-01-19 22:57:22 +11:00
Daniel Han
b3fcea6421 Quick fixes (#101)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py
2024-01-19 22:52:30 +11:00
Daniel Han
d691516ab9 2024 Release (#96)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml
2024-01-19 04:51:19 +11:00
Daniel Han-Chen
9e2dec16fb Update pyproject.toml 2024-01-19 03:41:00 +11:00
Daniel Han-Chen
396c7245dd Update pyproject.toml 2024-01-19 03:35:17 +11:00
Daniel Han
738e91591f Fix some bugs (#83)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs
2024-01-11 04:08:03 +11:00
Daniel Han
a1da50b5ce Update README.md (#81) 2024-01-10 23:10:48 +11:00
shimmy
606e8a9284 Discord button redo (#80) 2024-01-10 23:10:23 +11:00
shimmy
0169294ffb Update logos (#79)
* HF Perf Button

* Update README.md

Adding new buttons cleanup

* Update README.md

* Delete images/Discord.png

* Delete images/try live demo green.png

* new transparent logos

* Revamping page

* Revamp mainpage

* Update README.md

* Update README.md
2024-01-10 23:02:20 +11:00
Daniel Han
b2a8c33430 Create FUNDING.yml (#78) 2024-01-10 20:03:01 +11:00
Daniel Han-Chen
c9c1abf290 fix_tokenizer 2024-01-10 01:02:44 +11:00
Daniel Han-Chen
6efffb46e4 check_tokenizer 2024-01-09 23:40:43 +11:00
Daniel Han
83052656b8 GGUF conv + TRL downgrade (#76)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue
2024-01-09 20:20:53 +11:00
shimmy
8621977c8b Replacing buttons (#75) 2024-01-09 20:17:18 +11:00
shimmy
38a524dfd1 Add files via upload (#74)
Updated buttons
2024-01-09 19:23:59 +11:00
Daniel Han
267083799f Fix PEFT downcasting (#70)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py
2024-01-07 17:57:03 +11:00
Daniel Han
45fa4bf356 Fix tokenizer, bias, dropout supported for LoRA (#69)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py
2024-01-06 19:13:39 +11:00
Daniel Han
e4a080b68e Update README.md (#65) 2024-01-06 04:14:38 +11:00
Daniel Han
f077568c6b Update README.md (#64) 2024-01-06 04:13:15 +11:00
Daniel Han
905bd58f7f Update README.md (#63) 2024-01-05 17:48:21 +11:00
Daniel Han
353432271d Fix tokenizer + docs (#62)
* Patch tokenizer

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Cleanup

* Add comments to functions

* Update rope_embedding.py

* Update rope_embedding.py

* Update llama.py

* New logos!

* Update README.md
2024-01-05 04:08:53 +11:00
Daniel Han-Chen
808211931d Update llama.py 2024-01-02 03:41:05 +11:00
Daniel Han-Chen
9a09d161f2 Update llama.py 2024-01-02 03:37:04 +11:00
Daniel Han-Chen
ca4a51048a Add tokenizer checking + TinyLlama 2024-01-02 03:20:11 +11:00
Daniel Han-Chen
9406ca6ec0 Update README.md 2023-12-31 19:26:34 +11:00
Daniel Han-Chen
5fbe143340 Update DPO readme 2023-12-31 19:24:30 +11:00
Daniel Han-Chen
148e7db6c3 PatchDPOTrainer 2023-12-31 18:36:43 +11:00
Daniel Han-Chen
473554810a DPO 2023-12-31 18:26:17 +11:00
Daniel Han-Chen
1665b06884 DPO 2023-12-31 17:57:45 +11:00
Daniel Han-Chen
3c3d4974ce Fix Kaggle issues 2023-12-31 01:20:04 +11:00
Daniel Han
aab090d20f Prelim Qwen, Deepseek support (#58)
* Pytorch 2.1.1 install path, 4bit loading

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update loader.py

* Update loader.py

* Update loader.py

* Update loader.py

* Spelling errors

* Update __init__.py

* DPO loss fix

* Update fast_lora.py

* Update fast_lora.py

* Out of bounds tokenization

* Fix Mistral SWA

* Prelim support Qwen, Deepseek etc
2023-12-30 04:35:35 +11:00
Daniel Han
e18736d5b2 DPO, SWA fixes (#57)
* Pytorch 2.1.1 install path, 4bit loading

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update loader.py

* Update loader.py

* Update loader.py

* Update loader.py

* Spelling errors

* Update __init__.py

* DPO loss fix

* Update fast_lora.py

* Update fast_lora.py

* Out of bounds tokenization

* Fix Mistral SWA
2023-12-29 04:55:01 +11:00
Daniel Han
28c7550571 Nightly (#56)
* Pytorch 2.1.1 install path, 4bit loading

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update README.md

* Update loader.py

* Update loader.py

* Update loader.py

* Update loader.py

* Spelling errors

* Update __init__.py
2023-12-28 04:19:12 +11:00
Daniel Han-Chen
56fe2cf49d Fix inference 2023-12-27 03:51:31 +11:00
Daniel Han-Chen
75d1a0e2e1 Fix FastLanguageModel 2023-12-27 03:01:45 +11:00
Daniel Han
04093395ed Fix RoPE Scaling issues (#52)
* Fix RoPE Scaling

* Update llama.py

* Update llama.py
2023-12-26 04:32:04 +11:00
Daniel Han-Chen
5dda3f4058 Fix Pytorch 2.1.1 2023-12-25 23:28:05 +11:00
Daniel Han
ef70177a24 Small fixes (#48)
* Fix generation for GQA

* Update _utils.py

* flash attn

* Update _utils.py

* Update llama.py

* Update mistral.py

* platform

* Update _utils.py

* Update llama.py

* Logo changed

* Update README.md

* Update README.md
2023-12-23 04:22:48 +11:00
Daniel Han
37365b6ba9 Fix typo 2023-12-18 12:27:31 +11:00
shimmy
51d6797c7c Update __init__.py
Fixing typo extra '='
2023-12-18 12:19:24 +11:00
Daniel Han-Chen
feec338c08 Torch version, docs, readme, general loader 2023-12-18 04:23:16 +11:00
Daniel Han-Chen
cf5204a52d Fix Mistral
BlockDiagonalCausalMask fix courtesy of https://github.com/Rypo
2023-12-16 13:14:33 +11:00
Daniel Han-Chen
44bf41e113 Update Colab to CUDA 12.1 2023-12-15 16:35:24 +11:00