Daniel Han
|
522e368dbc
|
Torch 2.2 (#157)
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update save.py
* Update fast_lora.py
* Update utils.py
* Update llama.py
* Update fast_lora.py
* Update swiglu.py
* Update save.py
* Update save.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Revert "Update llama.py"
This reverts commit 9c9dc55bef7e71960bd48941e987e8b6239d6783.
* Update llama.py
* Works?
* Update pyproject.toml
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Swiglu
* Update swiglu.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update swiglu.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* attention_mask
* Update llama.py
* Update llama.py
* labels
* Update mistral.py
* Update llama.py
* attention mask
* Update save.py
* Update save.py
* Update mistral.py
* attention mask
* Update llama.py
* Update llama.py
* Update mistral.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update dpo.py
* Patch saving
* Update save.py
* Update save.py
* patch_saving_functions
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* print
* Mistral patch
* Update mistral.py
* Update save.py
* saving
* Update llama.py
* Update llama.py
* Fast inference repatch
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update mistral.py
* Update __init__.py
* Fix inference
* Update mistral.py
* fast lm_head
* Remove fast path
* Update rope_embedding.py
* Update loader.py
* LlamaAttention_fast_forward_inference
* if past_key_value is not None and q_len == 1:
* revert inference
* Update loader.py
* past_key_value
* Update llama.py
* Update llama.py
* Fix SDPA
* Update llama.py
* padding
* Inference
* Update llama.py
* Revert
* Update mistral.py
* faster inference
* inference
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* inference
* Update llama.py
* Update utils.py
* faster inference
* Update llama.py
* revert
* lm_head
* Update llama.py
* inference
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update mistral.py
* Update llama.py
* faster inference
* Update llama.py
* fast inference
* Update llama.py
* Update llama.py
* Update mistral.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* torch compile
* past_key_values
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update llama.py
* fast inference + saving config.json
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update mistral.py
* fast inference again
* more temp matrices
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* fast inference
* Update mistral.py
* Update llama.py
* SDPA
* attention_mask
* New version
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update save.py
* Update save.py
* Torch 2.2.0
* Update save.py
* mistral swa
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Fix SWA inference
* Fix llm_int8_skip_modules
* SWA inference
* Update save.py
* Update save.py
* Update pyproject.toml
* __version__
* __version__
* Update save.py
* Update save.py
* Update mistral.py
|
2024-02-07 04:40:50 +11:00 |
|
Daniel Han
|
44e304bc65
|
Fix bugs + more accurate Swiglu (#137)
* faster saving & inference
* Update llama.py
* Update save.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update mistral.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* fast inference
* Update llama.py
* Update save.py
* Update llama.py
* Mistral correct RoPE scaling
* Max sequence lengths
* Apache 2
* fast_linear_forward
* Update utils.py
* Update utils.py
* No print
* Update utils.py
* Update utils.py
* inference
* Update llama.py
* Fast inference RoPE
* Update llama.py
* Update llama.py
* RoPE
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* LoRA
* Fast LoRA saving
* Update llama.py
* hidden_states
* q_len == 1
* q_len issue
* Update mistral.py
* Update mistral.py
* incorrect inference
* Update to transformers 4.37
* Graceful FA2 error + torch 2.1.1
* Update mapper.py
* Update pyproject.toml
* Fix saving and bnb-4bit
* Update fast_lora.py
* Update fast_lora.py
* remove patching
* Update llama.py
* Update llama.py
* Update swiglu.py
* Repatch
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update llama.py
* Update fast_lora.py
* Update llama.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update swiglu.py
* Update fast_lora.py
* Update swiglu.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update save.py
* Update fast_lora.py
* Update utils.py
* Update llama.py
* Update fast_lora.py
* Update swiglu.py
* Update save.py
* Update save.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Revert "Update llama.py"
This reverts commit 9c9dc55bef7e71960bd48941e987e8b6239d6783.
* Update llama.py
* Works?
* Update pyproject.toml
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Swiglu
* Update swiglu.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update swiglu.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* Update fast_lora.py
* attention_mask
* Update llama.py
* Update llama.py
* labels
* Update mistral.py
* Update llama.py
* attention mask
|
2024-01-28 04:20:06 +11:00 |
|
Daniel Han
|
62fae3aa74
|
Fix bugs (#129)
* faster saving & inference
* Update llama.py
* Update save.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update mistral.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* fast inference
* Update llama.py
* Update save.py
* Update llama.py
* Mistral correct RoPE scaling
* Max sequence lengths
* Apache 2
* fast_linear_forward
* Update utils.py
* Update utils.py
* No print
* Update utils.py
* Update utils.py
* inference
* Update llama.py
* Fast inference RoPE
* Update llama.py
* Update llama.py
* RoPE
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* LoRA
* Fast LoRA saving
* Update llama.py
* hidden_states
* q_len == 1
* q_len issue
* Update mistral.py
* Update mistral.py
* incorrect inference
* Update to transformers 4.37
* Graceful FA2 error + torch 2.1.1
* Update mapper.py
* Update pyproject.toml
* Fix saving and bnb-4bit
* Update fast_lora.py
* Update fast_lora.py
* remove patching
* Update llama.py
* Update llama.py
* Update swiglu.py
* Repatch
* Update fast_lora.py
|
2024-01-26 04:19:17 +11:00 |
|
Daniel Han-Chen
|
9e2dec16fb
|
Update pyproject.toml
|
2024-01-19 03:41:00 +11:00 |
|
Daniel Han-Chen
|
396c7245dd
|
Update pyproject.toml
|
2024-01-19 03:35:17 +11:00 |
|
Daniel Han
|
738e91591f
|
Fix some bugs (#83)
* Fix tokenizer, dropout, bias for LoRA
* Update loader.py
* Fix LoRA downcasting
* Update _utils.py
* Saving to GGUF
* fix
* colab_quantize_to_gguf
* move save modules
* save module
* Update __init__.py
* Update save.py
* Temp downgrade due to TRL issue
* Fix up bugs
|
2024-01-11 04:08:03 +11:00 |
|
Daniel Han
|
83052656b8
|
GGUF conv + TRL downgrade (#76)
* Fix tokenizer, dropout, bias for LoRA
* Update loader.py
* Fix LoRA downcasting
* Update _utils.py
* Saving to GGUF
* fix
* colab_quantize_to_gguf
* move save modules
* save module
* Update __init__.py
* Update save.py
* Temp downgrade due to TRL issue
|
2024-01-09 20:20:53 +11:00 |
|
Daniel Han
|
28c7550571
|
Nightly (#56)
* Pytorch 2.1.1 install path, 4bit loading
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Spelling errors
* Update __init__.py
|
2023-12-28 04:19:12 +11:00 |
|
Daniel Han-Chen
|
5dda3f4058
|
Fix Pytorch 2.1.1
|
2023-12-25 23:28:05 +11:00 |
|
Daniel Han-Chen
|
44bf41e113
|
Update Colab to CUDA 12.1
|
2023-12-15 16:35:24 +11:00 |
|
Daniel Han-Chen
|
9c6803a573
|
Fix packaging, readme
|
2023-12-15 12:57:08 +11:00 |
|
Daniel Han-Chen
|
0912303bfb
|
Mistral, GQA support
|
2023-12-11 23:58:36 +11:00 |
|
Daniel Han
|
6416f235cf
|
Pre-release 2023 December version (Mistral, Prelim DPO, WSL, bug fixes) (#16)
* Immediate bug fixes
* Update README.md
* Update README.md
* Update llama.py
* Update llama.py
* Rope Scaling and max_seq_len will change
* Update llama.py
* new images
* Update README.md
* Images
* Update README.md
* Update pyproject.toml
* GQA
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
|
2023-12-06 02:59:22 +11:00 |
|
Daniel Han-Chen
|
30461b4057
|
images and exclusion
|
2023-12-01 01:22:09 +11:00 |
|
Daniel Han-Chen
|
5724e8e389
|
Update pyproject.toml
|
2023-11-30 20:45:04 +11:00 |
|
Daniel Han-Chen
|
0ec68d4e3e
|
Update pyproject.toml
|
2023-11-30 20:24:40 +11:00 |
|
Daniel Han-Chen
|
04587cd56e
|
Update pyproject.toml
|
2023-11-30 20:23:48 +11:00 |
|
Daniel Han-Chen
|
60c3301de0
|
Update pyproject.toml
|
2023-11-30 20:20:45 +11:00 |
|
Daniel Han-Chen
|
6657135e6c
|
Update pyproject.toml
|
2023-11-30 17:11:30 +11:00 |
|
Daniel Han-Chen
|
be49b5e104
|
Update pyproject.toml
|
2023-11-30 17:10:10 +11:00 |
|
Daniel Han-Chen
|
ced4699550
|
Update pyproject.toml
|
2023-11-30 17:08:40 +11:00 |
|
Daniel Han-Chen
|
610fdaab13
|
Update pyproject.toml
|
2023-11-30 17:06:51 +11:00 |
|
Daniel Han-Chen
|
f520bc39ee
|
requirements
|
2023-11-30 17:05:49 +11:00 |
|
Daniel Han-Chen
|
dc21b80735
|
requirements
|
2023-11-30 17:04:20 +11:00 |
|
Daniel Han-Chen
|
b4a5cfafaf
|
dependencies
|
2023-11-30 16:59:31 +11:00 |
|
Daniel Han-Chen
|
1bcb6ae283
|
Update pyproject.toml
|
2023-11-30 16:55:38 +11:00 |
|
Daniel Han-Chen
|
b2eb882bb2
|
Update pyproject.toml
|
2023-11-30 16:54:10 +11:00 |
|
Daniel Han-Chen
|
35a31ce5d2
|
Update pyproject.toml
|
2023-11-30 16:52:05 +11:00 |
|
Daniel Han-Chen
|
df2da4f043
|
Update pyproject.toml
|
2023-11-30 16:51:13 +11:00 |
|
Daniel Han-Chen
|
c3d6def64a
|
First upload of Unsloth code
|
2023-11-30 03:51:54 +11:00 |
|