Daniel Han
|
fc25ab0df0
|
Quick fixes (#101)
* Fix tokenizer, dropout, bias for LoRA
* Update loader.py
* Fix LoRA downcasting
* Update _utils.py
* Saving to GGUF
* fix
* colab_quantize_to_gguf
* move save modules
* save module
* Update __init__.py
* Update save.py
* Temp downgrade due to TRL issue
* Fix up bugs
* Faster saving + other changes
* Update llama.py
* Saving modules
* spelling
* Update llama.py
* Update save.py
* Update save.py
* Update loader.py
* Update llama.py
* patch saving
* Update save.py
* Update save.py
* Update save.py
* patch saving
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* original_model
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* saving to RAM leakage?
* Update save.py
* new_save_directory
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update pyproject.toml
* Update pyproject.toml
* Update pyproject.toml
* Quick fixes
* Update llama.py
* Update llama.py
* Update dpo.py
* Update dpo.py
* Update llama.py
* Update save.py
|
2024-01-19 22:52:30 +11:00 |
|
Daniel Han
|
b8b1eafda3
|
2024 Release (#96)
* Fix tokenizer, dropout, bias for LoRA
* Update loader.py
* Fix LoRA downcasting
* Update _utils.py
* Saving to GGUF
* fix
* colab_quantize_to_gguf
* move save modules
* save module
* Update __init__.py
* Update save.py
* Temp downgrade due to TRL issue
* Fix up bugs
* Faster saving + other changes
* Update llama.py
* Saving modules
* spelling
* Update llama.py
* Update save.py
* Update save.py
* Update loader.py
* Update llama.py
* patch saving
* Update save.py
* Update save.py
* Update save.py
* patch saving
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* original_model
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* saving to RAM leakage?
* Update save.py
* new_save_directory
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update pyproject.toml
* Update pyproject.toml
* Update pyproject.toml
|
2024-01-19 04:51:19 +11:00 |
|
Daniel Han-Chen
|
4112eb4a3d
|
Update pyproject.toml
|
2024-01-19 03:41:00 +11:00 |
|
Daniel Han-Chen
|
59d7475336
|
Update pyproject.toml
|
2024-01-19 03:35:17 +11:00 |
|
Daniel Han
|
c1ac4d2707
|
Fix some bugs (#83)
* Fix tokenizer, dropout, bias for LoRA
* Update loader.py
* Fix LoRA downcasting
* Update _utils.py
* Saving to GGUF
* fix
* colab_quantize_to_gguf
* move save modules
* save module
* Update __init__.py
* Update save.py
* Temp downgrade due to TRL issue
* Fix up bugs
|
2024-01-11 04:08:03 +11:00 |
|
Daniel Han
|
d3887c7fd9
|
Update README.md (#81)
|
2024-01-10 23:10:48 +11:00 |
|
shimmy
|
b5d94d9a0a
|
Discord button redo (#80)
|
2024-01-10 23:10:23 +11:00 |
|
shimmy
|
01d7f58e11
|
Update logos (#79)
* HF Perf Button
* Update README.md
Adding new buttons cleanup
* Update README.md
* Delete images/Discord.png
* Delete images/try live demo green.png
* new transparent logos
* Revamping page
* Revamp mainpage
* Update README.md
* Update README.md
|
2024-01-10 23:02:20 +11:00 |
|
Daniel Han
|
9faaf5b388
|
Create FUNDING.yml (#78)
|
2024-01-10 20:03:01 +11:00 |
|
Daniel Han-Chen
|
82e6fece0b
|
fix_tokenizer
|
2024-01-10 01:02:44 +11:00 |
|
Daniel Han-Chen
|
b52278199b
|
check_tokenizer
|
2024-01-09 23:40:43 +11:00 |
|
Daniel Han
|
1e3f77208b
|
GGUF conv + TRL downgrade (#76)
* Fix tokenizer, dropout, bias for LoRA
* Update loader.py
* Fix LoRA downcasting
* Update _utils.py
* Saving to GGUF
* fix
* colab_quantize_to_gguf
* move save modules
* save module
* Update __init__.py
* Update save.py
* Temp downgrade due to TRL issue
|
2024-01-09 20:20:53 +11:00 |
|
shimmy
|
b569f4b282
|
Replacing buttons (#75)
|
2024-01-09 20:17:18 +11:00 |
|
shimmy
|
89b5ecef36
|
Add files via upload (#74)
Updated buttons
|
2024-01-09 19:23:59 +11:00 |
|
Daniel Han
|
97d952e834
|
Fix PEFT downcasting (#70)
* Fix tokenizer, dropout, bias for LoRA
* Update loader.py
* Fix LoRA downcasting
* Update _utils.py
|
2024-01-07 17:57:03 +11:00 |
|
Daniel Han
|
d17202869d
|
Fix tokenizer, bias, dropout supported for LoRA (#69)
* Fix tokenizer, dropout, bias for LoRA
* Update loader.py
|
2024-01-06 19:13:39 +11:00 |
|
Daniel Han
|
3fc1305d75
|
Update README.md (#65)
|
2024-01-06 04:14:38 +11:00 |
|
Daniel Han
|
f1a4849bb7
|
Update README.md (#64)
|
2024-01-06 04:13:15 +11:00 |
|
Daniel Han
|
b7cc0f119f
|
Update README.md (#63)
|
2024-01-05 17:48:21 +11:00 |
|
Daniel Han
|
40f384c723
|
Fix tokenizer + docs (#62)
* Patch tokenizer
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Cleanup
* Add comments to functions
* Update rope_embedding.py
* Update rope_embedding.py
* Update llama.py
* New logos!
* Update README.md
|
2024-01-05 04:08:53 +11:00 |
|
Daniel Han-Chen
|
b2689ecc64
|
Update llama.py
|
2024-01-02 03:41:05 +11:00 |
|
Daniel Han-Chen
|
6e23d50750
|
Update llama.py
|
2024-01-02 03:37:04 +11:00 |
|
Daniel Han-Chen
|
a3e4f47ebf
|
Add tokenizer checking + TinyLlama
|
2024-01-02 03:20:11 +11:00 |
|
Daniel Han-Chen
|
033a897af3
|
Update README.md
|
2023-12-31 19:26:34 +11:00 |
|
Daniel Han-Chen
|
c6a0e07029
|
Update DPO readme
|
2023-12-31 19:24:30 +11:00 |
|
Daniel Han-Chen
|
230ac5652b
|
PatchDPOTrainer
|
2023-12-31 18:36:43 +11:00 |
|
Daniel Han-Chen
|
c79d2c31cd
|
DPO
|
2023-12-31 18:26:17 +11:00 |
|
Daniel Han-Chen
|
0a3477993a
|
DPO
|
2023-12-31 17:57:45 +11:00 |
|
Daniel Han-Chen
|
74826077da
|
Fix Kaggle issues
|
2023-12-31 01:20:04 +11:00 |
|
Daniel Han
|
ad02ea81b7
|
Prelim Qwen, Deepseek support (#58)
* Pytorch 2.1.1 install path, 4bit loading
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Spelling errors
* Update __init__.py
* DPO loss fix
* Update fast_lora.py
* Update fast_lora.py
* Out of bounds tokenization
* Fix Mistral SWA
* Prelim support Qwen, Deepseek etc
|
2023-12-30 04:35:35 +11:00 |
|
Daniel Han
|
24133feda6
|
DPO, SWA fixes (#57)
* Pytorch 2.1.1 install path, 4bit loading
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Spelling errors
* Update __init__.py
* DPO loss fix
* Update fast_lora.py
* Update fast_lora.py
* Out of bounds tokenization
* Fix Mistral SWA
|
2023-12-29 04:55:01 +11:00 |
|
Daniel Han
|
0369e7aa7a
|
Nightly (#56)
* Pytorch 2.1.1 install path, 4bit loading
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update README.md
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Spelling errors
* Update __init__.py
|
2023-12-28 04:19:12 +11:00 |
|
Daniel Han-Chen
|
a3ed0dc4f4
|
Fix inference
|
2023-12-27 03:51:31 +11:00 |
|
Daniel Han-Chen
|
1128ecb82a
|
Fix FastLanguageModel
|
2023-12-27 03:01:45 +11:00 |
|
Daniel Han
|
51dd120e35
|
Fix RoPE Scaling issues (#52)
* Fix RoPE Scaling
* Update llama.py
* Update llama.py
|
2023-12-26 04:32:04 +11:00 |
|
Daniel Han-Chen
|
627acc4bb3
|
Fix Pytorch 2.1.1
|
2023-12-25 23:28:05 +11:00 |
|
Daniel Han
|
de855c2afa
|
Small fixes (#48)
* Fix generation for GQA
* Update _utils.py
* flash attn
* Update _utils.py
* Update llama.py
* Update mistral.py
* platform
* Update _utils.py
* Update llama.py
* Logo changed
* Update README.md
* Update README.md
|
2023-12-23 04:22:48 +11:00 |
|
Daniel Han
|
725e581539
|
Fix typo
|
2023-12-18 12:27:31 +11:00 |
|
shimmy
|
275483f7de
|
Update __init__.py
Fixing typo extra '='
|
2023-12-18 12:19:24 +11:00 |
|
Daniel Han-Chen
|
b0f5ef5526
|
Torch version, docs, readme, general loader
|
2023-12-18 04:23:16 +11:00 |
|
Daniel Han-Chen
|
f380cc1170
|
Fix Mistral
BlockDiagonalCausalMask fix courtesy of https://github.com/Rypo
|
2023-12-16 13:14:33 +11:00 |
|
Daniel Han-Chen
|
399f8ed56f
|
Update Colab to CUDA 12.1
|
2023-12-15 16:35:24 +11:00 |
|
Daniel Han-Chen
|
c931ec40c6
|
Fix packaging, readme
|
2023-12-15 12:57:08 +11:00 |
|
Daniel Han
|
27bbd6b2cd
|
Update README.md
|
2023-12-14 15:10:17 +11:00 |
|
Daniel Han
|
50f55b2a38
|
Update README.md
|
2023-12-14 12:33:51 +11:00 |
|
Daniel Han-Chen
|
badf6a4980
|
Update llama.py
|
2023-12-12 13:07:38 +11:00 |
|
Daniel Han-Chen
|
82dcf52980
|
Update llama.py
|
2023-12-12 02:54:54 +11:00 |
|
Daniel Han-Chen
|
2d5d884874
|
tokenizer pad fix
|
2023-12-12 02:40:37 +11:00 |
|
Daniel Han-Chen
|
28f3b971d2
|
Update mistral.py
|
2023-12-12 00:59:30 +11:00 |
|
Daniel Han-Chen
|
e699f1d09e
|
Update llama.py
|
2023-12-12 00:57:06 +11:00 |
|