Daniel Han
|
d42f11f41e
|
Update vision.py
|
2025-03-14 06:11:51 -07:00 |
|
Daniel Han
|
64820ea4bd
|
Update rl_replacements.py
|
2025-03-14 06:11:19 -07:00 |
|
Daniel Han
|
c0c42e9716
|
Update vision.py
|
2025-03-14 06:06:10 -07:00 |
|
Daniel Han
|
026fb59e2f
|
Update rl_replacements.py
|
2025-03-14 06:01:42 -07:00 |
|
Daniel Han
|
86bc0a4761
|
grpo fix
|
2025-03-14 05:57:17 -07:00 |
|
Daniel Han
|
fdb2f8e177
|
Update vision.py
|
2025-03-14 05:54:57 -07:00 |
|
Daniel Han
|
7322f95971
|
Update rl_replacements.py
|
2025-03-14 05:51:08 -07:00 |
|
Daniel Han
|
b8500b055d
|
Update vision.py
|
2025-03-14 05:41:17 -07:00 |
|
Daniel Han
|
0a64bb88f6
|
Update vision.py
|
2025-03-14 05:40:56 -07:00 |
|
Daniel Han
|
7c4889a84c
|
Update vision.py
|
2025-03-14 04:59:29 -07:00 |
|
Daniel Han
|
4d49983b8b
|
Update vision.py
|
2025-03-14 04:58:32 -07:00 |
|
Daniel Han
|
70d09475fa
|
Update vision.py
|
2025-03-14 04:51:43 -07:00 |
|
Daniel Han
|
5c2ce48bb1
|
Update vision.py
|
2025-03-14 04:43:11 -07:00 |
|
Daniel Han
|
490b1b087a
|
Update vision.py
|
2025-03-14 04:40:29 -07:00 |
|
Daniel Han
|
99c2eec8e0
|
Update vision.py
|
2025-03-14 04:39:00 -07:00 |
|
Daniel Han
|
43db95099b
|
Update vision.py
|
2025-03-14 04:37:31 -07:00 |
|
Daniel Han
|
87071e4f4c
|
Update vision.py
|
2025-03-14 04:30:26 -07:00 |
|
Daniel Han
|
a9bd11e336
|
Update vision.py
|
2025-03-14 04:30:02 -07:00 |
|
Daniel Han
|
20512f8a9b
|
Update vision.py
|
2025-03-14 04:26:10 -07:00 |
|
Daniel Han
|
5d85b29a2a
|
Update llama.py
|
2025-03-14 04:08:17 -07:00 |
|
Daniel Han
|
ca3a09e7dd
|
Update llama.py
|
2025-03-14 04:02:41 -07:00 |
|
Daniel Han
|
3ff81862ef
|
Merge branch 'main' into nightly
|
2025-03-14 02:59:25 -07:00 |
|
Daniel Han
|
cbfb67441c
|
Merge branch 'nightly' of https://github.com/unslothai/unsloth into nightly
|
2025-03-14 02:54:47 -07:00 |
|
Daniel Han
|
67e498ae82
|
Update Zoo
|
2025-03-14 02:54:40 -07:00 |
|
Nino Risteski
|
f4d97caf5e
|
Update RMS LayerNorm implementation, and list compr. change in chat templates (#1974)
* Update RMS LayerNorm implementation with optimizations and testing suite
* perf: optimize list comprehension in get_ollama_eos_tokens
|
2025-03-14 02:53:21 -07:00 |
|
Akshay Behl
|
8baebe46a0
|
Triton windows update (#1976)
* Update pyproject.toml
* Update README.md
|
2025-03-14 02:51:30 -07:00 |
|
Daniel Han
|
d66f5ff082
|
New models
|
2025-03-14 02:41:52 -07:00 |
|
Daniel Han
|
5d6fa45c3f
|
Update save.py
|
2025-03-14 02:32:53 -07:00 |
|
Daniel Han
|
0a09349096
|
Update _utils.py
|
2025-03-14 02:21:15 -07:00 |
|
Daniel Han
|
c92ef07ab7
|
Update _utils.py
|
2025-03-14 02:07:13 -07:00 |
|
Daniel Han
|
c508113286
|
Update _utils.py
|
2025-03-14 02:00:03 -07:00 |
|
Daniel Han
|
758bca7414
|
Update _utils.py
|
2025-03-14 01:44:04 -07:00 |
|
Daniel Han
|
abfe34f7c0
|
Update llama.py
|
2025-03-14 01:39:45 -07:00 |
|
Daniel Han
|
f25063f060
|
Update llama.py
|
2025-03-14 01:36:12 -07:00 |
|
Daniel Han
|
aaca723291
|
Update llama.py
|
2025-03-14 01:26:45 -07:00 |
|
Daniel Han
|
82835c2904
|
Update llama.py
|
2025-03-14 01:25:35 -07:00 |
|
Daniel Han
|
88c042500b
|
Update llama.py
|
2025-03-14 01:20:18 -07:00 |
|
Daniel Han
|
456e05dc57
|
Update llama.py
|
2025-03-14 01:18:54 -07:00 |
|
Daniel Han
|
d628218ac8
|
Update llama.py
|
2025-03-14 01:18:04 -07:00 |
|
Daniel Han
|
c2b9855084
|
Update llama.py
|
2025-03-14 00:16:24 -07:00 |
|
Daniel Han
|
813fb7edcf
|
Update rl.py
|
2025-03-13 23:08:46 -07:00 |
|
Daniel Han
|
1d7dba52d2
|
Update vision.py
|
2025-03-13 18:34:26 -07:00 |
|
Daniel Han
|
6df2ef3667
|
Update vision.py
|
2025-03-13 18:31:03 -07:00 |
|
Daniel Han
|
b28b7fa364
|
Update vision.py
|
2025-03-13 18:26:30 -07:00 |
|
Daniel Han
|
5843d784f5
|
constexpr
|
2025-03-13 18:23:29 -07:00 |
|
Daniel Han
|
78584619f5
|
vLLM fixes
|
2025-03-13 17:57:46 -07:00 |
|
Daniel Han
|
325741b7b7
|
Update rl.py
|
2025-03-13 16:02:56 -07:00 |
|
Daniel Han
|
d0e0dad7d0
|
Gemma 3 bug fixes (#2005)
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* llama-quantize on WINDOWS WSL error fix - edit save.py (gguf saving breaks) (#1649)
* edit save.py to fix gguf saving breaks.
* add check for .exe or not exe file extension for linux and windows
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* unsloth_num_chunks
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py (#1754)
Fix typo in comment: know -> now.
This was printed when running the Llama3.1_(8B)-GRPO.ipynb example notebook, so I'd expect others to run into it as well.
* Optional logits
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update pyproject.toml
* Update pyproject.toml
* Export Model to ollama.com (#1648)
* Ollama Export Model to ollama.com
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Check for model_name
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* subprocess use instead of requests | added check for ollama server
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model | fix
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Push to Ollama
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Update cross_entropy_loss.py
* torch_cuda_device
* Update utils.py
* Update utils.py
* Update utils.py
* device
* device
* Update loader.py
* Update llama.py
* Update README.md
* Update llama.py
* Update llama.py
* Update _utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* __version__
* Update rl.py
* Bug fixes
* Bug fixes
* Update llama.py
* Update _utils.py
* _wrap_fast_inference
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* SFT dataset prepare
* Update pyproject.toml
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update utils.py
* bug fix
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update __init__.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update __init__.py
* Update _utils.py
* Version
* versioning
* Update _utils.py
* Update llama.py
* Update llama.py
* Bug fixes
* FastModel
* __doc__
* Update vision.py
* Update loader.py
* Update loader.py
* Update loader.py
* version
* move use_modelscope to _utils (#1938)
* move use_modelscope to _utils
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Don't use revision when loading model_config and is_peft=True (#1949)
* More syntax warnings (#1944)
* move use_modelscope to _utils
* fix
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update loader.py
* Full finetuning and other fixes
* UNSLOTH_ENABLE_FULL_FINETUNING
* Update loader.py
* Update loader.py
* Update loader.py
* Update vision.py
* Update vision.py
* full finetuning
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* max_seq_length
* Update rl.py
* Update rl.py
* Update rl.py
* Update pyproject.toml
* AutoModelForImageTextToText
* Update mapper.py
* Update pyproject.toml
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Batch samples
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* Update loader.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Temporary patches
* Update loader.py
* model names
* Gemma 3 chat template
* Bug fixes
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update llama.py
* Update llama.py
* Update rl.py
* Update chat_templates.py
* Update chat_templates.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Revert
* Update _utils.py
* forced precision
* Autocast
* Update vision.py
* Update vision.py
* Update rl.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
Co-authored-by: Gennadii Manzhos <105049664+everythingisc00l@users.noreply.github.com>
Co-authored-by: Seth Weidman <seth@sethweidman.com>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
Co-authored-by: Jyotin Goel <120490013+gjyotin305@users.noreply.github.com>
Co-authored-by: Kareem <81531392+KareemMusleh@users.noreply.github.com>
Co-authored-by: Wilson Wu <140025193+wiwu2390@users.noreply.github.com>
|
2025-03-13 06:41:42 -07:00 |
|
Daniel Han
|
df9573c754
|
Update vision.py
|
2025-03-13 06:39:17 -07:00 |
|
Daniel Han
|
188ccdde3e
|
Update vision.py
|
2025-03-13 06:34:55 -07:00 |
|