Commit graph

161 commits

Author SHA1 Message Date
Daniel Han-Chen
00f50876f7 Update llama.py 2024-01-23 02:03:25 +11:00
Daniel Han-Chen
e5b5333137 Update llama.py 2024-01-23 02:00:10 +11:00
Daniel Han-Chen
9a5062e6c4 Update llama.py 2024-01-23 01:44:10 +11:00
Daniel Han-Chen
1289ae825b RoPE 2024-01-23 01:41:20 +11:00
Daniel Han-Chen
7e4140ebfc Update llama.py 2024-01-23 01:37:36 +11:00
Daniel Han-Chen
1ba28d8e26 Update llama.py 2024-01-23 01:33:51 +11:00
Daniel Han-Chen
3e1b244d5e Fast inference RoPE 2024-01-23 01:29:03 +11:00
Daniel Han-Chen
8647f0e86e Update llama.py 2024-01-23 01:06:34 +11:00
Daniel Han-Chen
085a8e944a inference 2024-01-23 00:32:57 +11:00
Daniel Han-Chen
f41a437540 Update utils.py 2024-01-22 22:34:33 +11:00
Daniel Han-Chen
31f0c9c08d Update utils.py 2024-01-22 22:31:38 +11:00
Daniel Han-Chen
4220f6a6dc No print 2024-01-22 22:26:55 +11:00
Daniel Han-Chen
e1cbc9e423 Update utils.py 2024-01-22 22:21:29 +11:00
Daniel Han-Chen
050c61bc0b Update utils.py 2024-01-22 20:04:27 +11:00
Daniel Han-Chen
7c3b647ba7 fast_linear_forward 2024-01-22 20:01:59 +11:00
Daniel Han-Chen
8c613e851f Apache 2 2024-01-22 19:36:17 +11:00
Daniel Han-Chen
a18f982e67 Max sequence lengths 2024-01-22 19:31:34 +11:00
Daniel Han-Chen
e38485feaa Mistral correct RoPE scaling 2024-01-22 18:18:23 +11:00
Daniel Han-Chen
278de9f375 Update llama.py 2024-01-22 04:33:44 +11:00
Daniel Han-Chen
0666589ace Update save.py 2024-01-22 04:28:24 +11:00
Daniel Han-Chen
e34393f975 Update llama.py 2024-01-22 04:25:37 +11:00
Daniel Han-Chen
2a3d4f3a8d fast inference 2024-01-22 04:18:42 +11:00
Daniel Han-Chen
a5ab4dc21a Merge branch 'main' into nightly 2024-01-22 01:58:00 +11:00
Daniel Han
b370c9c8aa
Hotfix (#118)
* faster saving & inference

* Update llama.py

* Update save.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update mistral.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py
2024-01-21 22:20:22 +11:00
Daniel Han-Chen
8828eceb5b Update llama.py 2024-01-21 22:18:53 +11:00
Daniel Han-Chen
fcde58859b Update llama.py 2024-01-21 20:06:14 +11:00
Daniel Han-Chen
2f80890578 Update llama.py 2024-01-21 19:21:56 +11:00
Daniel Han-Chen
7be801ff8d Update llama.py 2024-01-21 19:10:48 +11:00
Daniel Han-Chen
92512e670e Update llama.py 2024-01-21 19:01:45 +11:00
Daniel Han-Chen
5c927e4930 Update mistral.py 2024-01-21 19:01:28 +11:00
Daniel Han-Chen
fe2bc30987 Update llama.py 2024-01-21 18:52:25 +11:00
Daniel Han-Chen
ac99a47a45 Update llama.py 2024-01-21 18:52:15 +11:00
Daniel Han-Chen
5bf108ebda Update llama.py 2024-01-21 18:15:55 +11:00
Daniel Han-Chen
b591f33a37 Update llama.py 2024-01-21 18:06:44 +11:00
Daniel Han-Chen
da7b4f59ee Update save.py 2024-01-21 17:32:37 +11:00
Daniel Han-Chen
196ab974d6 Update llama.py 2024-01-21 16:53:58 +11:00
Daniel Han-Chen
cbc1c69e29 faster saving & inference 2024-01-21 16:22:28 +11:00
Daniel Han-Chen
57a5b5a49d Update save.py 2024-01-21 05:00:37 +11:00
Daniel Han-Chen
5145a61e69 Update save.py 2024-01-21 04:21:54 +11:00
Daniel Han-Chen
a7bd8d119c Update save.py 2024-01-21 04:13:03 +11:00
Daniel Han
be4b97e7d8
Fixed saving! (#113)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py

* getattr

* RSLoRA and LoftQ direct support

* Update llama.py

* Update llama.py

* Update llama.py

* Fix DPO + GGUF

* Fix quantization_method

* Fix quantization_config

* patch model

* Update llama.py

* Update llama.py

* Update llama.py

* Update save.py

* Update save.py

* tokenizer_save_settings

* Update save.py

* quantization and loftq

* Update save.py

* Update llama.py

* Update save.py

* upload_to_huggingface

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py
2024-01-21 03:43:49 +11:00
Daniel Han
abb462be71
Hotfix for Jan 2024 Release (#110)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py

* getattr

* RSLoRA and LoftQ direct support

* Update llama.py

* Update llama.py

* Update llama.py

* Fix DPO + GGUF

* Fix quantization_method

* Fix quantization_config

* patch model

* Update llama.py

* Update llama.py

* Update llama.py

* Update save.py

* Update save.py

* tokenizer_save_settings

* Update save.py

* quantization and loftq

* Update save.py

* Update llama.py

* Update save.py
2024-01-20 23:23:00 +11:00
Daniel Han
31e2d71720
Quick fixes (#106)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py

* getattr

* RSLoRA and LoftQ direct support

* Update llama.py

* Update llama.py

* Update llama.py

* Fix DPO + GGUF
2024-01-20 04:25:06 +11:00
Daniel Han-Chen
8846337e5c Update _utils.py 2024-01-20 02:30:31 +11:00
Daniel Han-Chen
d378df87e5 Merge branch 'main' of https://github.com/unslothai/unsloth 2024-01-19 23:15:38 +11:00
Daniel Han-Chen
c1e7480ac2 Revert quantization methods 2024-01-19 23:15:20 +11:00
Daniel Han
920e3c2ea0
getattr issues (#103)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py

* getattr
2024-01-19 22:57:22 +11:00
Daniel Han
fc25ab0df0
Quick fixes (#101)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml

* Quick fixes

* Update llama.py

* Update llama.py

* Update dpo.py

* Update dpo.py

* Update llama.py

* Update save.py
2024-01-19 22:52:30 +11:00
Daniel Han
b8b1eafda3
2024 Release (#96)
* Fix tokenizer, dropout, bias for LoRA

* Update loader.py

* Fix LoRA downcasting

* Update _utils.py

* Saving to GGUF

* fix

* colab_quantize_to_gguf

* move save modules

* save module

* Update __init__.py

* Update save.py

* Temp downgrade due to TRL issue

* Fix up bugs

* Faster saving + other changes

* Update llama.py

* Saving modules

* spelling

* Update llama.py

* Update save.py

* Update save.py

* Update loader.py

* Update llama.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* patch saving

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* original_model

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* saving to RAM leakage?

* Update save.py

* new_save_directory

* Update save.py

* Update save.py

* Update save.py

* Update save.py

* Update pyproject.toml

* Update pyproject.toml

* Update pyproject.toml
2024-01-19 04:51:19 +11:00
Daniel Han-Chen
4112eb4a3d Update pyproject.toml 2024-01-19 03:41:00 +11:00