Daniel Han
23bac1dae5
Update pyproject.toml
2025-03-18 01:09:51 -07:00
Daniel Han
50c98b5d90
Update _utils.py
2025-03-18 01:05:58 -07:00
Daniel Han
4756979ae9
Update vision.py
2025-03-18 01:01:46 -07:00
Kareem
0e54be4c44
fix error message ( #2046 )
2025-03-17 21:46:20 -07:00
Isaac Breen
420380d829
Show both peft_error and autoconfig_error, not just autoconfig_error ( #2080 )
...
When loading a PEFT model fails, only the `autoconfig_error` is shown. Instead of the `peft_error`, which is what really matters when we're trying to load a PEFT adapter, the user will see something like this:
```
RuntimeError: Unrecognized model in my_model. Should have a `model_type` key in its config.json, or contain one of the following strings in its name: albert, align, altclip, ...
```
This PR just changes it so `autoconfig_error` and `peft_error` are both displayed.
2025-03-17 21:45:29 -07:00
Daniel Han
e2dc4b37fa
Merge branch 'nightly' of https://github.com/unslothai/unsloth into nightly
2025-03-17 21:44:00 -07:00
Daniel Han
997fa41db2
Update _utils.py
2025-03-17 21:43:51 -07:00
Xander Hawthorne
457fc127db
Ensure trust_remote_code propegates down to unsloth_compile_transformers ( #2075 )
2025-03-17 21:43:47 -07:00
Daniel Han
984273a405
move float32
2025-03-17 19:42:49 -07:00
Daniel Han
d3eaf9e10c
Fix forced float32
2025-03-17 19:24:21 -07:00
Daniel Han
0cf990f53e
disable bfloat16
2025-03-17 18:28:46 -07:00
Daniel Han
07ea763472
Update _utils.py
2025-03-17 16:57:14 -07:00
Daniel Han
78e85e3c16
move print
2025-03-17 04:51:28 -07:00
Daniel Han
3cf8d07875
Update _utils.py
2025-03-17 04:49:26 -07:00
Daniel Han
5ca4f5c381
Update _utils.py
2025-03-17 04:47:58 -07:00
Daniel Han
12de176afd
Update _utils.py
2025-03-17 04:45:49 -07:00
Daniel Han
9f558850f0
Update _utils.py
2025-03-17 04:42:50 -07:00
Daniel Han
9a356a7f79
move forced float32
2025-03-17 04:41:44 -07:00
Daniel Han
6d596da2aa
Update vision.py
2025-03-17 04:17:59 -07:00
Daniel Han
28b4128c2b
Update _utils.py
2025-03-16 23:37:46 -07:00
Daniel Han
682de7427e
Update vision.py
2025-03-16 23:27:59 -07:00
Daniel Han
82debd25cc
Update vision.py
2025-03-16 23:20:43 -07:00
Daniel Han
df554bcfb7
LoRA 16bit fix
2025-03-16 23:18:57 -07:00
Daniel Han
301f7fd699
Update loader.py
2025-03-16 22:15:54 -07:00
Daniel Han
f358b793bf
more prints
2025-03-16 22:13:57 -07:00
Daniel Han
19c69280b7
Update vision.py
2025-03-16 22:10:36 -07:00
Daniel Han
60b3da5fe5
Update pyproject.toml
2025-03-16 20:31:54 -07:00
Daniel Han
64c29182a7
Update pyproject.toml
2025-03-16 20:30:46 -07:00
Daniel Han
97c2a88f41
Update loader.py
2025-03-16 20:18:53 -07:00
Kareem
ce4558bf55
fix ( #2051 )
2025-03-16 15:19:58 -07:00
Mukkesh Ganesh
b1ec22ddf2
bug fix #2008 ( #2039 )
2025-03-16 15:19:14 -07:00
Daniel Han
cfa846e54e
Update llama.py
2025-03-15 23:34:52 -07:00
Daniel Han
ee07fb9930
Update llama.py
2025-03-15 22:39:09 -07:00
Daniel Han
69659f6a44
Update pyproject.toml
2025-03-15 19:40:02 -07:00
Daniel Han
e50fb7401b
Version
2025-03-15 19:22:44 -07:00
Daniel Han
48a33ad1fc
Merge branch 'main' into nightly
2025-03-15 19:15:26 -07:00
Daniel Han
8ab8c6c120
Update _utils.py
2025-03-15 17:58:14 -07:00
Michael Han
6f7c8c6d0a
Update README.md
2025-03-15 17:47:25 -07:00
Daniel Han
0f0e6eb194
Update rl.py
2025-03-15 17:13:18 -07:00
Daniel Han
2b8c15cd9a
Merge branch 'main' into nightly
2025-03-15 16:36:18 -07:00
Daniel Han
5df2a0ce2a
Update README.md ( #2028 )
2025-03-14 22:06:53 -07:00
Daniel Han
5174a675a2
Gemma 3 readme ( #2019 )
...
* Update README.md
* Update README.md
* Update README.md
---------
Co-authored-by: Michael Han <107991372+shimmyshimmer@users.noreply.github.com>
2025-03-14 11:12:02 -07:00
Daniel Han
aff2cf2125
Update _utils.py
2025-03-14 10:04:10 -07:00
Daniel Han
c62a05bc6b
Update save.py
2025-03-14 09:54:48 -07:00
Daniel Han
ae43909f1f
Precision issues
2025-03-14 08:33:33 -07:00
Daniel Han
99a591a862
Update vision.py
2025-03-14 08:19:02 -07:00
Daniel Han
23683e1d34
Update _utils.py
2025-03-14 08:17:49 -07:00
Daniel Han
fc6ca8dd1a
Update vision.py
2025-03-14 08:17:36 -07:00
Daniel Han
1101752ee1
Update save.py
2025-03-14 08:08:43 -07:00
Daniel Han
fa6dedf3be
GGUF saving ( #2017 )
...
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767 )
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762 )
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753 )
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update pyproject.toml
* Update pyproject.toml
* Export Model to ollama.com (#1648 )
* Ollama Export Model to ollama.com
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Check for model_name
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* subprocess use instead of requests | added check for ollama server
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model | fix
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Push to Ollama
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Update cross_entropy_loss.py
* torch_cuda_device
* Update utils.py
* Update utils.py
* Update utils.py
* device
* device
* Update loader.py
* Update llama.py
* Update README.md
* Update llama.py
* Update llama.py
* Update _utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* __version__
* Update rl.py
* Bug fixes
* Bug fixes
* Update llama.py
* Update _utils.py
* _wrap_fast_inference
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* SFT dataset prepare
* Update pyproject.toml
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update utils.py
* bug fix
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update __init__.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update __init__.py
* Update _utils.py
* Version
* versioning
* Update _utils.py
* Update llama.py
* Update llama.py
* Bug fixes
* FastModel
* __doc__
* Update vision.py
* Update loader.py
* Update loader.py
* Update loader.py
* version
* move use_modelscope to _utils (#1938 )
* move use_modelscope to _utils
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Don't use revision when loading model_config and is_peft=True (#1949 )
* More syntax warnings (#1944 )
* move use_modelscope to _utils
* fix
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update loader.py
* Full finetuning and other fixes
* UNSLOTH_ENABLE_FULL_FINETUNING
* Update loader.py
* Update loader.py
* Update loader.py
* Update vision.py
* Update vision.py
* full finetuning
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* max_seq_length
* Update rl.py
* Update rl.py
* Update rl.py
* Update pyproject.toml
* AutoModelForImageTextToText
* Update mapper.py
* Update pyproject.toml
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Batch samples
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* Update loader.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Temporary patches
* Update loader.py
* model names
* Gemma 3 chat template
* Bug fixes
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update llama.py
* Update llama.py
* Update rl.py
* Update chat_templates.py
* Update chat_templates.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Revert
* Update _utils.py
* forced precision
* Autocast
* Update vision.py
* Update vision.py
* Update rl.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl.py
* vLLM fixes
* constexpr
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update save.py
* New models
* Triton windows update (#1976 )
* Update pyproject.toml
* Update README.md
* Update RMS LayerNorm implementation, and list compr. change in chat templates (#1974 )
* Update RMS LayerNorm implementation with optimizations and testing suite
* perf: optimize list comprehension in get_ollama_eos_tokens
* Update Zoo
* Update llama.py
* Update llama.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl_replacements.py
* Update vision.py
* grpo fix
* Update rl_replacements.py
* Update vision.py
* Update rl_replacements.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update save.py
* Update save.py
* Update save.py
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
Co-authored-by: Jyotin Goel <120490013+gjyotin305@users.noreply.github.com>
Co-authored-by: Kareem <81531392+KareemMusleh@users.noreply.github.com>
Co-authored-by: Wilson Wu <140025193+wiwu2390@users.noreply.github.com>
Co-authored-by: Akshay Behl <126911424+Captain-T2004@users.noreply.github.com>
2025-03-14 07:58:57 -07:00