Daniel Han
|
ce708bef1c
|
Update llama.py
|
2025-03-03 15:49:04 -08:00 |
|
Daniel Han
|
6662fd652c
|
Update llama.py
|
2025-03-03 15:48:55 -08:00 |
|
Daniel Han
|
d7ffc09329
|
Update README.md
|
2025-03-03 14:58:30 -08:00 |
|
Daniel Han
|
643637dd5e
|
Update llama.py
|
2025-03-03 02:36:16 -08:00 |
|
Daniel Han
|
64ab4df808
|
Update loader.py
|
2025-03-03 02:30:53 -08:00 |
|
Daniel Han
|
391fe2907b
|
device
|
2025-03-03 00:04:08 -08:00 |
|
Daniel Han
|
37541f149a
|
device
|
2025-03-02 23:58:17 -08:00 |
|
Daniel Han
|
cb6318299d
|
Update utils.py
|
2025-03-02 23:43:02 -08:00 |
|
Daniel Han
|
ed45bd9cd3
|
Update utils.py
|
2025-03-02 23:41:35 -08:00 |
|
Daniel Han
|
0b69bf34cc
|
Update utils.py
|
2025-03-02 23:38:32 -08:00 |
|
Daniel Han
|
ed75ff330a
|
torch_cuda_device
|
2025-03-02 23:31:16 -08:00 |
|
Daniel Han
|
b73a2c39d7
|
Update cross_entropy_loss.py
|
2025-03-02 23:08:44 -08:00 |
|
Daniel Han
|
f47415973a
|
Merge branch 'main' into nightly
|
2025-03-02 20:28:24 -08:00 |
|
J. M Areeb Uzair
|
c6d2433547
|
Added Python version warning to Windows Install Section (#1872)
I spent half a day on the wrong Python version, so I am adding this big, red sign.
|
2025-03-02 03:48:21 -08:00 |
|
Mohamed Mekkouri
|
8180e9803c
|
Fix Layernorm when num_cols not a power of 2 (#1867)
* fix
* Update layernorm.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
|
2025-03-01 14:23:22 -08:00 |
|
Daniel Han
|
8a72e20aa5
|
Update vision.py
|
2025-03-01 13:47:01 -08:00 |
|
Daniel Han
|
4f166026d7
|
LoRA
|
2025-03-01 02:52:20 -08:00 |
|
Daniel Han
|
481e3e41b2
|
Update llama.py
|
2025-03-01 00:23:20 -08:00 |
|
Daniel Han
|
f4748c020d
|
Update _utils.py
|
2025-03-01 00:21:28 -08:00 |
|
Daniel Han
|
f3b5469213
|
Update granite.py
|
2025-03-01 00:20:34 -08:00 |
|
Daniel Han
|
6b735edbcb
|
Update granite.py
|
2025-03-01 00:19:12 -08:00 |
|
Daniel Han
|
6485cbb499
|
Prelim release
|
2025-03-01 00:13:11 -08:00 |
|
Aditya Ghai
|
08bc291300
|
Direct windows support for unsloth (#1841)
* Direct Windows Support(main)
* Update pyproject.toml
* Update README.md
Added the suggested changes to README
|
2025-02-27 20:25:46 -08:00 |
|
Daniel Han
|
841626c405
|
Update rl_replacements.py
|
2025-02-27 03:46:47 -08:00 |
|
Daniel Han
|
f55395b5f0
|
Update rl_replacements.py
|
2025-02-27 03:42:03 -08:00 |
|
Michael Han
|
569b4422c4
|
Update README.md
|
2025-02-26 17:03:47 -08:00 |
|
Michael Han
|
86aea0b4f8
|
Update README.md
|
2025-02-26 16:58:32 -08:00 |
|
Kareem
|
71d2a24575
|
fixed syntax warnings (#1522)
* fixed most of syntax warnings
* all syntaxwarnings fixed
* Syntax fixes
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
|
2025-02-26 03:50:37 -08:00 |
|
Charles London
|
96346a5f35
|
Fix key error in GRPOTrainer (#1818)
* fix keyerror in GRPOTrainer
* check for train in _metrics
|
2025-02-25 15:22:35 -08:00 |
|
Igor Kilbas
|
455517aae9
|
Fix: GRPO with Mistral and importing (#1831)
* fix: mistral and importing
* minor change
* Style :)
* Update mistral.py
* Update mistral.py
* Update mistral.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
|
2025-02-25 15:21:26 -08:00 |
|
Jyotin Goel
|
c316ad8910
|
Export Model to ollama.com (#1648)
* Ollama Export Model to ollama.com
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Check for model_name
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* subprocess use instead of requests | added check for ollama server
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model | fix
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Push to Ollama
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
|
2025-02-22 02:37:01 -08:00 |
|
Michael Han
|
ab701257d6
|
Update README.md
|
2025-02-21 22:59:19 -08:00 |
|
Daniel Han
|
734a9a0611
|
Update _utils.py
|
2025-02-20 09:24:07 -08:00 |
|
Daniel Han
|
4570c8b41e
|
Bug Fixes (#1774)
* Update rl.py
* Update tokenizer_utils.py
* Auto patching
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* max seq length
* Update rl.py
* Update rl.py
* Patching
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* NEFTune
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Extra replacements
* Update rl_replacements.py
* Update rl.py
* extra RL replacements
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update _utils.py
* Update loader_utils.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* autocast
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update pyproject.toml
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update _utils.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* GRPO optimized
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Selective Log softmax
* Fix GRPO bsz
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Fix TRL
* Metrics GRPO
* Update rl_replacements.py
* Update rl_replacements.py
* No compile
* Update rl.py
* Remove docs
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* llama-quantize on WINDOWS WSL error fix - edit save.py (gguf saving breaks) (#1649)
* edit save.py to fix gguf saving breaks.
* add check for .exe or not exe file extension for linux and windows
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* unsloth_num_chunks
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py (#1754)
Fix typo in comment: know -> now.
This was printed when running the Llama3.1_(8B)-GRPO.ipynb example notebook, so I'd expect others to run into it as well.
* Optional logits
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update pyproject.toml
* Update pyproject.toml
---------
Co-authored-by: Gennadii Manzhos <105049664+everythingisc00l@users.noreply.github.com>
Co-authored-by: Seth Weidman <seth@sethweidman.com>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
|
2025-02-20 09:20:49 -08:00 |
|
Daniel Han
|
b39a8605cc
|
Update pyproject.toml
|
2025-02-20 09:02:41 -08:00 |
|
Daniel Han
|
92ea46eae4
|
Update pyproject.toml
|
2025-02-20 08:43:46 -08:00 |
|
Daniel Han
|
0cf0a33c41
|
Update rl_replacements.py
|
2025-02-20 08:31:37 -08:00 |
|
Daniel Han
|
7a6e004288
|
Update rl_replacements.py
|
2025-02-20 08:28:21 -08:00 |
|
Daniel Han
|
3a06c5054c
|
Update _utils.py
|
2025-02-20 07:51:33 -08:00 |
|
Daniel Han
|
0d28429ba1
|
Update llama.py
|
2025-02-20 07:46:14 -08:00 |
|
Daniel Han
|
4dc880dae8
|
Update llama.py
|
2025-02-20 07:40:45 -08:00 |
|
Daniel Han
|
9c812cc72a
|
Update llama.py
|
2025-02-20 07:36:23 -08:00 |
|
Daniel Han
|
1a0f18e598
|
Update llama.py
|
2025-02-20 07:25:31 -08:00 |
|
Daniel Han
|
2c438b3b99
|
Update llama.py
|
2025-02-20 07:01:14 -08:00 |
|
Daniel Han
|
0345c8b1c3
|
Merge branch 'main' into nightly
|
2025-02-20 05:14:57 -08:00 |
|
Daniel Han
|
cd3a733602
|
bug fix
|
2025-02-20 04:47:12 -08:00 |
|
Daniel Han
|
a45a08f91b
|
Memory Efficient GRPO (#1773)
* Update __init__.py
* Update loader.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Better TRL handling
* Update rl.py
* Update tokenizer_utils.py
* Auto patching
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* max seq length
* Update rl.py
* Update rl.py
* Patching
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* NEFTune
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Extra replacements
* Update rl_replacements.py
* Update rl.py
* extra RL replacements
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update _utils.py
* Update loader_utils.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* autocast
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update pyproject.toml
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update _utils.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* GRPO optimized
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Selective Log softmax
* Fix GRPO bsz
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Fix TRL
* Metrics GRPO
* Update rl_replacements.py
* Update rl_replacements.py
* No compile
* Update rl.py
* Remove docs
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* llama-quantize on WINDOWS WSL error fix - edit save.py (gguf saving breaks) (#1649)
* edit save.py to fix gguf saving breaks.
* add check for .exe or not exe file extension for linux and windows
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* unsloth_num_chunks
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py (#1754)
Fix typo in comment: know -> now.
This was printed when running the Llama3.1_(8B)-GRPO.ipynb example notebook, so I'd expect others to run into it as well.
* Optional logits
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
---------
Co-authored-by: Gennadii Manzhos <105049664+everythingisc00l@users.noreply.github.com>
Co-authored-by: Seth Weidman <seth@sethweidman.com>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
|
2025-02-20 04:23:28 -08:00 |
|
Daniel Han
|
89711bf4f8
|
Versioning
|
2025-02-20 04:22:17 -08:00 |
|
Daniel Han
|
3a0fb38744
|
default num_chunks == -1
|
2025-02-19 23:51:06 -08:00 |
|
Daniel Han
|
50acb0f4f8
|
Update __init__.py
|
2025-02-19 23:45:07 -08:00 |
|