Daniel Han
|
8f455fcc5c
|
Update vision.py
|
2025-03-14 04:30:26 -07:00 |
|
Daniel Han
|
0003eadda5
|
Update vision.py
|
2025-03-14 04:30:02 -07:00 |
|
Daniel Han
|
5e17f22e20
|
Update vision.py
|
2025-03-14 04:26:10 -07:00 |
|
Daniel Han
|
9cd4f47d31
|
Update llama.py
|
2025-03-14 04:08:17 -07:00 |
|
Daniel Han
|
4ef899c9ca
|
Update llama.py
|
2025-03-14 04:02:41 -07:00 |
|
Daniel Han
|
8ec6e8bd3e
|
Merge branch 'main' into nightly
|
2025-03-14 02:59:25 -07:00 |
|
Daniel Han
|
1d6c395c0f
|
Merge branch 'nightly' of https://github.com/unslothai/unsloth into nightly
|
2025-03-14 02:54:47 -07:00 |
|
Daniel Han
|
94f075c92a
|
Update Zoo
|
2025-03-14 02:54:40 -07:00 |
|
Nino Risteski
|
6aaf377d3a
|
Update RMS LayerNorm implementation, and list compr. change in chat templates (#1974)
* Update RMS LayerNorm implementation with optimizations and testing suite
* perf: optimize list comprehension in get_ollama_eos_tokens
|
2025-03-14 02:53:21 -07:00 |
|
Akshay Behl
|
1b45ab69de
|
Triton windows update (#1976)
* Update pyproject.toml
* Update README.md
|
2025-03-14 02:51:30 -07:00 |
|
Daniel Han
|
2b76350c0c
|
New models
|
2025-03-14 02:41:52 -07:00 |
|
Daniel Han
|
13b4a957de
|
Update save.py
|
2025-03-14 02:32:53 -07:00 |
|
Daniel Han
|
7afe411743
|
Update _utils.py
|
2025-03-14 02:21:15 -07:00 |
|
Daniel Han
|
6547468ed3
|
Update _utils.py
|
2025-03-14 02:07:13 -07:00 |
|
Daniel Han
|
edd6181c51
|
Update _utils.py
|
2025-03-14 02:00:03 -07:00 |
|
Daniel Han
|
1f7f78e1b4
|
Update _utils.py
|
2025-03-14 01:44:04 -07:00 |
|
Daniel Han
|
c21dba49eb
|
Update llama.py
|
2025-03-14 01:39:45 -07:00 |
|
Daniel Han
|
5a4f410263
|
Update llama.py
|
2025-03-14 01:36:12 -07:00 |
|
Daniel Han
|
ae54a69a72
|
Update llama.py
|
2025-03-14 01:26:45 -07:00 |
|
Daniel Han
|
050cb85485
|
Update llama.py
|
2025-03-14 01:25:35 -07:00 |
|
Daniel Han
|
d9d1116d02
|
Update llama.py
|
2025-03-14 01:20:18 -07:00 |
|
Daniel Han
|
a2190296d0
|
Update llama.py
|
2025-03-14 01:18:54 -07:00 |
|
Daniel Han
|
7ccacc3faf
|
Update llama.py
|
2025-03-14 01:18:04 -07:00 |
|
Daniel Han
|
13788ab323
|
Update llama.py
|
2025-03-14 00:16:24 -07:00 |
|
Daniel Han
|
69f4581236
|
Update rl.py
|
2025-03-13 23:08:46 -07:00 |
|
Daniel Han
|
2def2a5e0e
|
Update vision.py
|
2025-03-13 18:34:26 -07:00 |
|
Daniel Han
|
e388265a89
|
Update vision.py
|
2025-03-13 18:31:03 -07:00 |
|
Daniel Han
|
6e7d5be3ff
|
Update vision.py
|
2025-03-13 18:26:30 -07:00 |
|
Daniel Han
|
f525442d63
|
constexpr
|
2025-03-13 18:23:29 -07:00 |
|
Daniel Han
|
9f6d280994
|
vLLM fixes
|
2025-03-13 17:57:46 -07:00 |
|
Daniel Han
|
171ad425ae
|
Update rl.py
|
2025-03-13 16:02:56 -07:00 |
|
Daniel Han
|
fe04c014c2
|
Gemma 3 bug fixes (#2005)
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* llama-quantize on WINDOWS WSL error fix - edit save.py (gguf saving breaks) (#1649)
* edit save.py to fix gguf saving breaks.
* add check for .exe or not exe file extension for linux and windows
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* unsloth_num_chunks
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py (#1754)
Fix typo in comment: know -> now.
This was printed when running the Llama3.1_(8B)-GRPO.ipynb example notebook, so I'd expect others to run into it as well.
* Optional logits
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update pyproject.toml
* Update pyproject.toml
* Export Model to ollama.com (#1648)
* Ollama Export Model to ollama.com
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Check for model_name
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* subprocess use instead of requests | added check for ollama server
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model | fix
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Push to Ollama
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Update cross_entropy_loss.py
* torch_cuda_device
* Update utils.py
* Update utils.py
* Update utils.py
* device
* device
* Update loader.py
* Update llama.py
* Update README.md
* Update llama.py
* Update llama.py
* Update _utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* __version__
* Update rl.py
* Bug fixes
* Bug fixes
* Update llama.py
* Update _utils.py
* _wrap_fast_inference
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* SFT dataset prepare
* Update pyproject.toml
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update utils.py
* bug fix
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update __init__.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update __init__.py
* Update _utils.py
* Version
* versioning
* Update _utils.py
* Update llama.py
* Update llama.py
* Bug fixes
* FastModel
* __doc__
* Update vision.py
* Update loader.py
* Update loader.py
* Update loader.py
* version
* move use_modelscope to _utils (#1938)
* move use_modelscope to _utils
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Don't use revision when loading model_config and is_peft=True (#1949)
* More syntax warnings (#1944)
* move use_modelscope to _utils
* fix
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update loader.py
* Full finetuning and other fixes
* UNSLOTH_ENABLE_FULL_FINETUNING
* Update loader.py
* Update loader.py
* Update loader.py
* Update vision.py
* Update vision.py
* full finetuning
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* max_seq_length
* Update rl.py
* Update rl.py
* Update rl.py
* Update pyproject.toml
* AutoModelForImageTextToText
* Update mapper.py
* Update pyproject.toml
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Batch samples
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* Update loader.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Temporary patches
* Update loader.py
* model names
* Gemma 3 chat template
* Bug fixes
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update llama.py
* Update llama.py
* Update rl.py
* Update chat_templates.py
* Update chat_templates.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Revert
* Update _utils.py
* forced precision
* Autocast
* Update vision.py
* Update vision.py
* Update rl.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
Co-authored-by: Gennadii Manzhos <105049664+everythingisc00l@users.noreply.github.com>
Co-authored-by: Seth Weidman <seth@sethweidman.com>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
Co-authored-by: Jyotin Goel <120490013+gjyotin305@users.noreply.github.com>
Co-authored-by: Kareem <81531392+KareemMusleh@users.noreply.github.com>
Co-authored-by: Wilson Wu <140025193+wiwu2390@users.noreply.github.com>
|
2025-03-13 06:41:42 -07:00 |
|
Daniel Han
|
ed80c07943
|
Update vision.py
|
2025-03-13 06:39:17 -07:00 |
|
Daniel Han
|
b284ed58a7
|
Update vision.py
|
2025-03-13 06:34:55 -07:00 |
|
Daniel Han
|
3b6c379f50
|
Update vision.py
|
2025-03-13 06:25:18 -07:00 |
|
Daniel Han
|
57576a5bd3
|
Update vision.py
|
2025-03-13 06:24:37 -07:00 |
|
Daniel Han
|
e0e31d9f96
|
Update vision.py
|
2025-03-13 06:15:42 -07:00 |
|
Daniel Han
|
d1f09cf63e
|
Update rl.py
|
2025-03-13 06:12:36 -07:00 |
|
Daniel Han
|
c6eae35193
|
Update vision.py
|
2025-03-13 06:08:33 -07:00 |
|
Daniel Han
|
6dcd0bf7c6
|
Update vision.py
|
2025-03-13 06:06:24 -07:00 |
|
Daniel Han
|
7493af8cab
|
Autocast
|
2025-03-13 06:02:33 -07:00 |
|
Daniel Han
|
067fb5ee09
|
forced precision
|
2025-03-13 05:46:02 -07:00 |
|
Daniel Han
|
20ae25a13d
|
Update _utils.py
|
2025-03-13 05:38:21 -07:00 |
|
Daniel Han
|
833e295db6
|
Revert
|
2025-03-13 05:13:17 -07:00 |
|
Daniel Han
|
8b51a7d8fb
|
Update vision.py
|
2025-03-13 01:30:06 -07:00 |
|
Daniel Han
|
7d0893bd89
|
Update vision.py
|
2025-03-13 01:27:50 -07:00 |
|
Daniel Han
|
dd17676c99
|
Update loader.py
|
2025-03-13 01:17:48 -07:00 |
|
Daniel Han
|
6e58d9764f
|
Update vision.py
|
2025-03-13 01:15:25 -07:00 |
|
Daniel Han
|
c96eab5d8c
|
Update vision.py
|
2025-03-12 22:23:29 -07:00 |
|
Daniel Han
|
caec8ffcf9
|
Update vision.py
|
2025-03-12 22:22:23 -07:00 |
|