Daniel Han
|
54121bb4b3
|
device
|
2025-03-03 00:04:08 -08:00 |
|
Daniel Han
|
cf77d8b610
|
device
|
2025-03-02 23:58:17 -08:00 |
|
Daniel Han
|
a833ab9829
|
Update utils.py
|
2025-03-02 23:43:02 -08:00 |
|
Daniel Han
|
4b2b345cdd
|
Update utils.py
|
2025-03-02 23:41:35 -08:00 |
|
Daniel Han
|
306fd3009e
|
Update utils.py
|
2025-03-02 23:38:32 -08:00 |
|
Daniel Han
|
7e096ff9bf
|
torch_cuda_device
|
2025-03-02 23:31:16 -08:00 |
|
Daniel Han
|
72a7919e37
|
Update cross_entropy_loss.py
|
2025-03-02 23:08:44 -08:00 |
|
Daniel Han
|
e7fca61f7c
|
Merge branch 'main' into nightly
|
2025-03-02 20:28:24 -08:00 |
|
J. M Areeb Uzair
|
debb3e0810
|
Added Python version warning to Windows Install Section (#1872)
I spent half a day on the wrong Python version, so I am adding this big, red sign.
|
2025-03-02 03:48:21 -08:00 |
|
Mohamed Mekkouri
|
8c9404dd5e
|
Fix Layernorm when num_cols not a power of 2 (#1867)
* fix
* Update layernorm.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
|
2025-03-01 14:23:22 -08:00 |
|
Daniel Han
|
4ffbf6734c
|
Update vision.py
|
2025-03-01 13:47:01 -08:00 |
|
Daniel Han
|
3fa6ac944f
|
LoRA
|
2025-03-01 02:52:20 -08:00 |
|
Daniel Han
|
09be705d7d
|
Update llama.py
|
2025-03-01 00:23:20 -08:00 |
|
Daniel Han
|
b53d160b6f
|
Update _utils.py
|
2025-03-01 00:21:28 -08:00 |
|
Daniel Han
|
a7f00fe966
|
Update granite.py
|
2025-03-01 00:20:34 -08:00 |
|
Daniel Han
|
69682a456c
|
Update granite.py
|
2025-03-01 00:19:12 -08:00 |
|
Daniel Han
|
a448530269
|
Prelim release
|
2025-03-01 00:13:11 -08:00 |
|
Aditya Ghai
|
ce5190b868
|
Direct windows support for unsloth (#1841)
* Direct Windows Support(main)
* Update pyproject.toml
* Update README.md
Added the suggested changes to README
|
2025-02-27 20:25:46 -08:00 |
|
Daniel Han
|
584c41f628
|
Update rl_replacements.py
|
2025-02-27 03:46:47 -08:00 |
|
Daniel Han
|
51aa56efb9
|
Update rl_replacements.py
|
2025-02-27 03:42:03 -08:00 |
|
Michael Han
|
7eb2b62b16
|
Update README.md
|
2025-02-26 17:03:47 -08:00 |
|
Michael Han
|
5b721c7cd3
|
Update README.md
|
2025-02-26 16:58:32 -08:00 |
|
Kareem
|
2f3f680274
|
fixed syntax warnings (#1522)
* fixed most of syntax warnings
* all syntaxwarnings fixed
* Syntax fixes
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
|
2025-02-26 03:50:37 -08:00 |
|
Charles London
|
cac515ee2e
|
Fix key error in GRPOTrainer (#1818)
* fix keyerror in GRPOTrainer
* check for train in _metrics
|
2025-02-25 15:22:35 -08:00 |
|
Igor Kilbas
|
c7cea3e751
|
Fix: GRPO with Mistral and importing (#1831)
* fix: mistral and importing
* minor change
* Style :)
* Update mistral.py
* Update mistral.py
* Update mistral.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
|
2025-02-25 15:21:26 -08:00 |
|
Jyotin Goel
|
2b77128647
|
Export Model to ollama.com (#1648)
* Ollama Export Model to ollama.com
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Check for model_name
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* subprocess use instead of requests | added check for ollama server
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model | fix
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Push to Ollama
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
|
2025-02-22 02:37:01 -08:00 |
|
Michael Han
|
6a57b5e333
|
Update README.md
|
2025-02-21 22:59:19 -08:00 |
|
Daniel Han
|
07bdb5f642
|
Update _utils.py
|
2025-02-20 09:24:07 -08:00 |
|
Daniel Han
|
661859fff3
|
Bug Fixes (#1774)
* Update rl.py
* Update tokenizer_utils.py
* Auto patching
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* max seq length
* Update rl.py
* Update rl.py
* Patching
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* NEFTune
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Extra replacements
* Update rl_replacements.py
* Update rl.py
* extra RL replacements
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update _utils.py
* Update loader_utils.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* autocast
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update pyproject.toml
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update _utils.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* GRPO optimized
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Selective Log softmax
* Fix GRPO bsz
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Fix TRL
* Metrics GRPO
* Update rl_replacements.py
* Update rl_replacements.py
* No compile
* Update rl.py
* Remove docs
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* llama-quantize on WINDOWS WSL error fix - edit save.py (gguf saving breaks) (#1649)
* edit save.py to fix gguf saving breaks.
* add check for .exe or not exe file extension for linux and windows
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* unsloth_num_chunks
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py (#1754)
Fix typo in comment: know -> now.
This was printed when running the Llama3.1_(8B)-GRPO.ipynb example notebook, so I'd expect others to run into it as well.
* Optional logits
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update pyproject.toml
* Update pyproject.toml
---------
Co-authored-by: Gennadii Manzhos <105049664+everythingisc00l@users.noreply.github.com>
Co-authored-by: Seth Weidman <seth@sethweidman.com>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
|
2025-02-20 09:20:49 -08:00 |
|
Daniel Han
|
5eb02b68d3
|
Update pyproject.toml
2025-02-v2
|
2025-02-20 09:02:41 -08:00 |
|
Daniel Han
|
3faf5867b7
|
Update pyproject.toml
|
2025-02-20 08:43:46 -08:00 |
|
Daniel Han
|
e47340558e
|
Update rl_replacements.py
|
2025-02-20 08:31:37 -08:00 |
|
Daniel Han
|
74c8f12b21
|
Update rl_replacements.py
|
2025-02-20 08:28:21 -08:00 |
|
Daniel Han
|
fd436e4c61
|
Update _utils.py
|
2025-02-20 07:51:33 -08:00 |
|
Daniel Han
|
c669175796
|
Update llama.py
|
2025-02-20 07:46:14 -08:00 |
|
Daniel Han
|
1505235f0f
|
Update llama.py
|
2025-02-20 07:40:45 -08:00 |
|
Daniel Han
|
bb0d3f900f
|
Update llama.py
|
2025-02-20 07:36:23 -08:00 |
|
Daniel Han
|
ebf8187d70
|
Update llama.py
|
2025-02-20 07:25:31 -08:00 |
|
Daniel Han
|
5d4182c774
|
Update llama.py
|
2025-02-20 07:01:14 -08:00 |
|
Daniel Han
|
d30bbfd3cf
|
Merge branch 'main' into nightly
|
2025-02-20 05:14:57 -08:00 |
|
Daniel Han
|
02c19d97f9
|
bug fix
|
2025-02-20 04:47:12 -08:00 |
|
Daniel Han
|
7b6cd79c2f
|
Memory Efficient GRPO (#1773)
* Update __init__.py
* Update loader.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Better TRL handling
* Update rl.py
* Update tokenizer_utils.py
* Auto patching
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* max seq length
* Update rl.py
* Update rl.py
* Patching
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* NEFTune
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Extra replacements
* Update rl_replacements.py
* Update rl.py
* extra RL replacements
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update _utils.py
* Update loader_utils.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* autocast
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update pyproject.toml
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update _utils.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* GRPO optimized
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Selective Log softmax
* Fix GRPO bsz
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Fix TRL
* Metrics GRPO
* Update rl_replacements.py
* Update rl_replacements.py
* No compile
* Update rl.py
* Remove docs
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* llama-quantize on WINDOWS WSL error fix - edit save.py (gguf saving breaks) (#1649)
* edit save.py to fix gguf saving breaks.
* add check for .exe or not exe file extension for linux and windows
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* unsloth_num_chunks
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py (#1754)
Fix typo in comment: know -> now.
This was printed when running the Llama3.1_(8B)-GRPO.ipynb example notebook, so I'd expect others to run into it as well.
* Optional logits
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
---------
Co-authored-by: Gennadii Manzhos <105049664+everythingisc00l@users.noreply.github.com>
Co-authored-by: Seth Weidman <seth@sethweidman.com>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
|
2025-02-20 04:23:28 -08:00 |
|
Daniel Han
|
c0bdacd505
|
Versioning
|
2025-02-20 04:22:17 -08:00 |
|
Daniel Han
|
2ff2cdad63
|
default num_chunks == -1
|
2025-02-19 23:51:06 -08:00 |
|
Daniel Han
|
af709e1dd6
|
Update __init__.py
|
2025-02-19 23:45:07 -08:00 |
|
Daniel Han
|
f89ae2b255
|
vLLMSamplingParams
|
2025-02-19 23:43:52 -08:00 |
|
Daniel Han
|
0c6ee39481
|
Merge branch 'nightly' of https://github.com/unslothai/unsloth into nightly
|
2025-02-19 23:40:50 -08:00 |
|
Ben
|
5b816e735c
|
[Windows Support] Add latest xformers wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
|
2025-02-19 23:40:07 -08:00 |
|
Edd
|
8e5aeacbee
|
Convert mask to float (#1762)
|
2025-02-19 23:38:48 -08:00 |
|
Daniel Han
|
f9ed548b54
|
SamplingParams
|
2025-02-19 23:37:52 -08:00 |
|