Commit graph

1,817 commits

Author SHA1 Message Date
Daniel Han
3a7660763a Update rl_replacements.py 2025-03-14 06:01:42 -07:00
Daniel Han
9554dd5a3a grpo fix 2025-03-14 05:57:17 -07:00
Daniel Han
4079dbacdb Update vision.py 2025-03-14 05:54:57 -07:00
Daniel Han
5d98f5b7ef Update rl_replacements.py 2025-03-14 05:51:08 -07:00
Daniel Han
f988ed4851 Update vision.py 2025-03-14 05:41:17 -07:00
Daniel Han
26045d8efe Update vision.py 2025-03-14 05:40:56 -07:00
Daniel Han
9bc273b950 Update vision.py 2025-03-14 04:59:29 -07:00
Daniel Han
f6efd4d809 Update vision.py 2025-03-14 04:58:32 -07:00
Daniel Han
970384302f Update vision.py 2025-03-14 04:51:43 -07:00
Daniel Han
6b5eb3c687 Update vision.py 2025-03-14 04:43:11 -07:00
Daniel Han
e78fe39281 Update vision.py 2025-03-14 04:40:29 -07:00
Daniel Han
ba8408d990 Update vision.py 2025-03-14 04:39:00 -07:00
Daniel Han
790833e7b7 Update vision.py 2025-03-14 04:37:31 -07:00
Daniel Han
8f455fcc5c Update vision.py 2025-03-14 04:30:26 -07:00
Daniel Han
0003eadda5 Update vision.py 2025-03-14 04:30:02 -07:00
Daniel Han
5e17f22e20 Update vision.py 2025-03-14 04:26:10 -07:00
Daniel Han
9cd4f47d31 Update llama.py 2025-03-14 04:08:17 -07:00
Daniel Han
4ef899c9ca Update llama.py 2025-03-14 04:02:41 -07:00
Daniel Han
8ec6e8bd3e Merge branch 'main' into nightly 2025-03-14 02:59:25 -07:00
Daniel Han
1d6c395c0f Merge branch 'nightly' of https://github.com/unslothai/unsloth into nightly 2025-03-14 02:54:47 -07:00
Daniel Han
94f075c92a Update Zoo 2025-03-14 02:54:40 -07:00
Nino Risteski
6aaf377d3a
Update RMS LayerNorm implementation, and list compr. change in chat templates (#1974)
* Update RMS LayerNorm implementation with optimizations and testing suite

* perf: optimize list comprehension in get_ollama_eos_tokens
2025-03-14 02:53:21 -07:00
Akshay Behl
1b45ab69de
Triton windows update (#1976)
* Update pyproject.toml

* Update README.md
2025-03-14 02:51:30 -07:00
Daniel Han
2b76350c0c New models 2025-03-14 02:41:52 -07:00
Daniel Han
13b4a957de Update save.py 2025-03-14 02:32:53 -07:00
Daniel Han
7afe411743 Update _utils.py 2025-03-14 02:21:15 -07:00
Daniel Han
6547468ed3 Update _utils.py 2025-03-14 02:07:13 -07:00
Daniel Han
edd6181c51 Update _utils.py 2025-03-14 02:00:03 -07:00
Daniel Han
1f7f78e1b4 Update _utils.py 2025-03-14 01:44:04 -07:00
Daniel Han
c21dba49eb Update llama.py 2025-03-14 01:39:45 -07:00
Daniel Han
5a4f410263 Update llama.py 2025-03-14 01:36:12 -07:00
Daniel Han
ae54a69a72 Update llama.py 2025-03-14 01:26:45 -07:00
Daniel Han
050cb85485 Update llama.py 2025-03-14 01:25:35 -07:00
Daniel Han
d9d1116d02 Update llama.py 2025-03-14 01:20:18 -07:00
Daniel Han
a2190296d0 Update llama.py 2025-03-14 01:18:54 -07:00
Daniel Han
7ccacc3faf Update llama.py 2025-03-14 01:18:04 -07:00
Daniel Han
13788ab323 Update llama.py 2025-03-14 00:16:24 -07:00
Daniel Han
69f4581236 Update rl.py 2025-03-13 23:08:46 -07:00
Daniel Han
2def2a5e0e Update vision.py 2025-03-13 18:34:26 -07:00
Daniel Han
e388265a89 Update vision.py 2025-03-13 18:31:03 -07:00
Daniel Han
6e7d5be3ff Update vision.py 2025-03-13 18:26:30 -07:00
Daniel Han
f525442d63 constexpr 2025-03-13 18:23:29 -07:00
Daniel Han
9f6d280994 vLLM fixes 2025-03-13 17:57:46 -07:00
Daniel Han
171ad425ae Update rl.py 2025-03-13 16:02:56 -07:00
Daniel Han
fe04c014c2
Gemma 3 bug fixes (#2005)
* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* llama-quantize on WINDOWS WSL error fix - edit save.py (gguf saving breaks) (#1649)

* edit save.py to fix gguf saving breaks.

* add check for .exe or not exe file extension for linux and windows

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update llama.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update llama.py

* Update llama.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* unsloth_num_chunks

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py (#1754)

Fix typo in comment: know -> now.

This was printed when running the Llama3.1_(8B)-GRPO.ipynb example notebook, so I'd expect others to run into it as well.

* Optional logits

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* fix an import error (#1767)

* fix an import error

* Delete .gitignore

* Update loader.py

* Update save.py

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* SamplingParams

* Convert mask to float (#1762)

* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)

* Add latest xformers

* Add a couple of lines to docs

* vLLMSamplingParams

* Update __init__.py

* default num_chunks == -1

* Versioning

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update _utils.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update pyproject.toml

* Update pyproject.toml

* Export Model to ollama.com  (#1648)

* Ollama Export Model to ollama.com

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* Check for model_name

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* subprocess use instead of requests | added check for ollama server

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* create_ollama_model

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* create_ollama_model | fix

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* Push to Ollama

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

---------

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>

* Update cross_entropy_loss.py

* torch_cuda_device

* Update utils.py

* Update utils.py

* Update utils.py

* device

* device

* Update loader.py

* Update llama.py

* Update README.md

* Update llama.py

* Update llama.py

* Update _utils.py

* Update utils.py

* Update utils.py

* Update utils.py

* Update utils.py

* Update utils.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update utils.py

* Update utils.py

* Update utils.py

* Update utils.py

* __version__

* Update rl.py

* Bug fixes

* Bug fixes

* Update llama.py

* Update _utils.py

* _wrap_fast_inference

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update _utils.py

* SFT dataset prepare

* Update pyproject.toml

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl.py

* Update llama.py

* Update llama.py

* Update utils.py

* bug fix

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update llama.py

* Update __init__.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update _utils.py

* Update __init__.py

* Update _utils.py

* Version

* versioning

* Update _utils.py

* Update llama.py

* Update llama.py

* Bug fixes

* FastModel

* __doc__

* Update vision.py

* Update loader.py

* Update loader.py

* Update loader.py

* version

* move use_modelscope to _utils (#1938)

* move use_modelscope to _utils

* Update _utils.py

* Update loader.py

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* Don't use revision when loading model_config and is_peft=True (#1949)

* More syntax warnings (#1944)

* move use_modelscope to _utils

* fix

* Update _utils.py

* Update loader.py

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* Update loader.py

* Full finetuning and other fixes

* UNSLOTH_ENABLE_FULL_FINETUNING

* Update loader.py

* Update loader.py

* Update loader.py

* Update vision.py

* Update vision.py

* full finetuning

* Update loader.py

* Update loader.py

* Update loader.py

* Update _utils.py

* max_seq_length

* Update rl.py

* Update rl.py

* Update rl.py

* Update pyproject.toml

* AutoModelForImageTextToText

* Update mapper.py

* Update pyproject.toml

* Update _utils.py

* Update _utils.py

* Update _utils.py

* Batch samples

* Update loader.py

* Update loader.py

* Update loader.py

* Update loader.py

* Update _utils.py

* Update loader.py

* Update vision.py

* Update loader.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update mapper.py

* Update vision.py

* Temporary patches

* Update loader.py

* model names

* Gemma 3 chat template

* Bug fixes

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update llama.py

* Update llama.py

* Update rl.py

* Update chat_templates.py

* Update chat_templates.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update loader.py

* Update vision.py

* Update vision.py

* Revert

* Update _utils.py

* forced precision

* Autocast

* Update vision.py

* Update vision.py

* Update rl.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

---------

Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
Co-authored-by: Gennadii Manzhos <105049664+everythingisc00l@users.noreply.github.com>
Co-authored-by: Seth Weidman <seth@sethweidman.com>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
Co-authored-by: Jyotin Goel <120490013+gjyotin305@users.noreply.github.com>
Co-authored-by: Kareem <81531392+KareemMusleh@users.noreply.github.com>
Co-authored-by: Wilson Wu <140025193+wiwu2390@users.noreply.github.com>
2025-03-13 06:41:42 -07:00
Daniel Han
ed80c07943 Update vision.py 2025-03-13 06:39:17 -07:00
Daniel Han
b284ed58a7 Update vision.py 2025-03-13 06:34:55 -07:00
Daniel Han
3b6c379f50 Update vision.py 2025-03-13 06:25:18 -07:00
Daniel Han
57576a5bd3 Update vision.py 2025-03-13 06:24:37 -07:00
Daniel Han
e0e31d9f96 Update vision.py 2025-03-13 06:15:42 -07:00