Commit graph

1,602 commits

Author SHA1 Message Date
Daniel Han
6e2a3a8d77 Update utils.py 2025-03-03 18:33:18 -08:00
Daniel Han
d93cca24a8 Update utils.py 2025-03-03 18:29:35 -08:00
Daniel Han
a7a5d75b83 Update utils.py 2025-03-03 17:27:59 -08:00
Daniel Han
91458bbcdc Update utils.py 2025-03-03 17:17:25 -08:00
Daniel Han
ee9d6e5955 Update _utils.py 2025-03-03 17:12:56 -08:00
Daniel Han
bc87afde41 Update llama.py 2025-03-03 15:49:04 -08:00
Daniel Han
469ed48cf4 Update llama.py 2025-03-03 15:48:55 -08:00
Daniel Han
748c5b522d Update README.md 2025-03-03 14:58:30 -08:00
Daniel Han
ffa327862b Update llama.py 2025-03-03 02:36:16 -08:00
Daniel Han
64e2b00975 Update loader.py 2025-03-03 02:30:53 -08:00
Daniel Han
30b6f9449c device 2025-03-03 00:04:08 -08:00
Daniel Han
35e9144a01 device 2025-03-02 23:58:17 -08:00
Daniel Han
9d95aeee8d Update utils.py 2025-03-02 23:43:02 -08:00
Daniel Han
9215212724 Update utils.py 2025-03-02 23:41:35 -08:00
Daniel Han
f21314c1c0 Update utils.py 2025-03-02 23:38:32 -08:00
Daniel Han
0ae908247e torch_cuda_device 2025-03-02 23:31:16 -08:00
Daniel Han
9cab34721c Update cross_entropy_loss.py 2025-03-02 23:08:44 -08:00
Daniel Han
f853ac0288 Merge branch 'main' into nightly 2025-03-02 20:28:24 -08:00
J. M Areeb Uzair
3a0d3d58d2
Added Python version warning to Windows Install Section (#1872)
I spent half a day on the wrong Python version, so I am adding this big, red sign.
2025-03-02 03:48:21 -08:00
Mohamed Mekkouri
bda3978287
Fix Layernorm when num_cols not a power of 2 (#1867)
* fix

* Update layernorm.py

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>
2025-03-01 14:23:22 -08:00
Daniel Han
1e82600104 Update vision.py 2025-03-01 13:47:01 -08:00
Daniel Han
91598a6ee8 LoRA 2025-03-01 02:52:20 -08:00
Daniel Han
60d173322b Update llama.py 2025-03-01 00:23:20 -08:00
Daniel Han
c4ac03cf4c Update _utils.py 2025-03-01 00:21:28 -08:00
Daniel Han
deff934f46 Update granite.py 2025-03-01 00:20:34 -08:00
Daniel Han
a777cd4a8f Update granite.py 2025-03-01 00:19:12 -08:00
Daniel Han
996dca380c Prelim release 2025-03-01 00:13:11 -08:00
Aditya Ghai
0887650427
Direct windows support for unsloth (#1841)
* Direct Windows Support(main)

* Update pyproject.toml

* Update README.md

Added the suggested changes to README
2025-02-27 20:25:46 -08:00
Daniel Han
32f86a05c2 Update rl_replacements.py 2025-02-27 03:46:47 -08:00
Daniel Han
2f15de5670 Update rl_replacements.py 2025-02-27 03:42:03 -08:00
Michael Han
34ed383015
Update README.md 2025-02-26 17:03:47 -08:00
Michael Han
034af99dc2
Update README.md 2025-02-26 16:58:32 -08:00
Kareem
7feb2ff881
fixed syntax warnings (#1522)
* fixed most of syntax warnings

* all syntaxwarnings fixed

* Syntax fixes

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>
2025-02-26 03:50:37 -08:00
Charles London
2c0f50160e
Fix key error in GRPOTrainer (#1818)
* fix keyerror in GRPOTrainer

* check for train in _metrics
2025-02-25 15:22:35 -08:00
Igor Kilbas
42cbe1f565
Fix: GRPO with Mistral and importing (#1831)
* fix: mistral and importing

* minor change

* Style :)

* Update mistral.py

* Update mistral.py

* Update mistral.py

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>
2025-02-25 15:21:26 -08:00
Jyotin Goel
a9b542fa8e
Export Model to ollama.com (#1648)
* Ollama Export Model to ollama.com

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* Check for model_name

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* subprocess use instead of requests | added check for ollama server

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* create_ollama_model

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* create_ollama_model | fix

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* Push to Ollama

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

---------

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
2025-02-22 02:37:01 -08:00
Michael Han
575ef4d9c0
Update README.md 2025-02-21 22:59:19 -08:00
Daniel Han
14c9be1d71 Update _utils.py 2025-02-20 09:24:07 -08:00
Daniel Han
ca33f4b206
Bug Fixes (#1774)
* Update rl.py

* Update tokenizer_utils.py

* Auto patching

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update rl.py

* Update tokenizer_utils.py

* Update rl.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update tokenizer_utils.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update tokenizer_utils.py

* Update rl.py

* Update rl.py

* Update rl.py

* max seq length

* Update rl.py

* Update rl.py

* Patching

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* NEFTune

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Extra replacements

* Update rl_replacements.py

* Update rl.py

* extra RL replacements

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update llama.py

* Update rl_replacements.py

* Update _utils.py

* Update loader_utils.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* autocast

* Update rl_replacements.py

* Update llama.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update llama.py

* Update rl_replacements.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update rl_replacements.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update pyproject.toml

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update llama.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update llama.py

* Update _utils.py

* Update llama.py

* Update _utils.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update rl_replacements.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* GRPO optimized

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Selective Log softmax

* Fix GRPO bsz

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Fix TRL

* Metrics GRPO

* Update rl_replacements.py

* Update rl_replacements.py

* No compile

* Update rl.py

* Remove docs

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* llama-quantize on WINDOWS WSL error fix - edit save.py (gguf saving breaks) (#1649)

* edit save.py to fix gguf saving breaks.

* add check for .exe or not exe file extension for linux and windows

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update llama.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update llama.py

* Update llama.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* unsloth_num_chunks

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py (#1754)

Fix typo in comment: know -> now.

This was printed when running the Llama3.1_(8B)-GRPO.ipynb example notebook, so I'd expect others to run into it as well.

* Optional logits

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* fix an import error (#1767)

* fix an import error

* Delete .gitignore

* Update loader.py

* Update save.py

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* SamplingParams

* Convert mask to float (#1762)

* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)

* Add latest xformers

* Add a couple of lines to docs

* vLLMSamplingParams

* Update __init__.py

* default num_chunks == -1

* Versioning

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update _utils.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update pyproject.toml

* Update pyproject.toml

---------

Co-authored-by: Gennadii Manzhos <105049664+everythingisc00l@users.noreply.github.com>
Co-authored-by: Seth Weidman <seth@sethweidman.com>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
2025-02-20 09:20:49 -08:00
Daniel Han
adbe38e6ca Update pyproject.toml 2025-02-20 09:02:41 -08:00
Daniel Han
bc1d2cefa9 Update pyproject.toml 2025-02-20 08:43:46 -08:00
Daniel Han
ec6e0b7ac2 Update rl_replacements.py 2025-02-20 08:31:37 -08:00
Daniel Han
5dcd079e61 Update rl_replacements.py 2025-02-20 08:28:21 -08:00
Daniel Han
1792deb733 Update _utils.py 2025-02-20 07:51:33 -08:00
Daniel Han
ae6e2bd671 Update llama.py 2025-02-20 07:46:14 -08:00
Daniel Han
0bbfbe802e Update llama.py 2025-02-20 07:40:45 -08:00
Daniel Han
d4d7694dd9 Update llama.py 2025-02-20 07:36:23 -08:00
Daniel Han
7de002246f Update llama.py 2025-02-20 07:25:31 -08:00
Daniel Han
b5eda24d81 Update llama.py 2025-02-20 07:01:14 -08:00
Daniel Han
2969db8bbc Merge branch 'main' into nightly 2025-02-20 05:14:57 -08:00