Commit graph

2,503 commits

Author SHA1 Message Date
Daniel Han
eeca02aef7 Update pyproject.toml 2025-06-30 21:01:32 -07:00
Daniel Han
656972de2e Update pyproject.toml 2025-06-30 21:00:49 -07:00
Daniel Han
75232838e9 Update pyproject.toml 2025-06-30 20:25:46 -07:00
Daniel Han
7d994c431b Update pyproject.toml 2025-06-30 20:01:13 -07:00
Daniel Han
1f50825e75 Update pyproject.toml 2025-06-30 20:00:20 -07:00
Daniel Han
2f76af30b2 Update setup.py 2025-06-30 19:50:15 -07:00
Daniel Han
a6af9ffd97 Update setup.py 2025-06-30 19:48:00 -07:00
Daniel Han
1c7c9ae76f Update setup.py 2025-06-30 19:47:22 -07:00
Daniel Han
a14463004c Prints 2025-06-30 19:35:59 -07:00
Daniel Han
0a33947fb6 setup.py 2025-06-30 19:32:32 -07:00
Daniel Han
be7dbc9c67 Fix setup.py 2025-06-30 19:25:49 -07:00
Daniel Han
4f244b49f3 Merge branch 'main' into nightly 2025-06-30 16:57:19 -07:00
billishyahao
a9635c964e [Feature] enable unsloth on amd gpu (#2520)
* [Feature] enable unsloth on amd gpu

* fix the comment

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>
2025-06-30 16:52:05 -07:00
Rishabh
fc0c46bc8b Convert torch.bfloat16, torch.float16, etc. to vLLM valid dtypes (#2811)
* Convert torch.bfloat16, torch.float16, etc. to vLLM valid dtypes

* removed newlines and extra whitespace
2025-06-30 16:39:36 -07:00
DoubleMathew
bbdf55b40d Fix loftq None config for FastBaseModel (#2848)
add new validate_loftq_config to __all__
2025-06-30 16:38:51 -07:00
Daniel Han
ba19fdaef9 Gemma 3N bug fixes (#2842)
* Update vision.py

* Bug fix

* Update mapper.py

* check SDPA for Mistral 3, Pixtral

* Update vision.py

* Versioning

* Update rl_replacements.py

* Update README.md

* add model registry

* move hf hub utils to unsloth/utils

* refactor global model info dicts to dataclasses

* fix dataclass init

* fix llama registration

* remove deprecated key function

* start registry reog

* add llama vision

* quant types -> Enum

* remap literal quant types to QuantType Enum

* add llama model registration

* fix quant tag mapping

* add qwen2.5 models to registry

* add option to include original model in registry

* handle quant types per model size

* separate registration of base and instruct llama3.2

* add QwenQVQ to registry

* add gemma3 to registry

* add phi

* add deepseek v3

* add deepseek r1 base

* add deepseek r1 zero

* add deepseek distill llama

* add deepseek distill models

* remove redundant code when constructing model names

* add mistral small to registry

* rename model registration methods

* rename deepseek registration methods

* refactor naming for mistral and phi

* add global register models

* refactor model registration tests for new registry apis

* add model search method

* remove deprecated registration api

* add quant type test

* add registry readme

* make llama registration more specific

* clear registry when executing individual model registration file

* more registry readme updates

* Update _auto_install.py

* Llama4

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Synthetic data

* Update mapper.py

* Xet and Synthetic

* Update synthetic.py

* Update loader.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update pyproject.toml

* Delete .gitignore

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update _utils.py

* Update pyproject.toml

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update chat_templates.py

* Seasame force float16 / float32

* Fix Seasame

* Update loader.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update loader.py

* is_multimodal

* Update loader.py

* Update loader.py

* Update loader.py

* Update loader.py

* Update vision.py

* Update vision.py

* Update vision.py

* UNSLOTH_DISABLE_STATIC_GENERATION

* Update vision.py

* Auto vision detection

* Sesame

* Whisper

* Update loader.py

* Update loader.py

* Update loader.py

* Update mapper.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update loader.py

* Update loader.py

* Update loader.py

* Update loader.py

* Update _utils.py

* Update rl.py

* versioning

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* logging

* Update pyproject.toml

* Update rl.py

* versioning

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* logits / temperature

* Update rl_replacements.py

* Update pyproject.toml

* Update rl_replacements.py

* Update rl_replacements.py

* Debugging only

* Update llama.py

* Update llama.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Generic efficient GRPO

* Update rl_replacements.py

* Update rl_replacements.py

* Remove debugging

* Update rl_replacements.py

* Update rl_replacements.py

* Update vision.py

* Update llama.py

* Update rl_replacements.py

* versioning

* Update _utils.py

* Update vision.py

* Update mapper.py

* Update loader.py

* Update mapper.py

* Update vision.py

* Update loader.py

* Update vision.py

* Update loader.py

* Update _utils.py

* Update vision.py

* gradient checkpointing

* Gemma 3N fixes

* Update loader.py

* Versioning

* Gemma 3N fixes

* Update vision.py

* Update vision.py

* Update loader.py

* Update vision.py

---------

Co-authored-by: Jack Shi Wei Lun <87535974+jackswl@users.noreply.github.com>
Co-authored-by: jeromeku <jerome.ku@gmail.com>
Co-authored-by: Michael Han <107991372+shimmyshimmer@users.noreply.github.com>
2025-06-30 07:15:48 -07:00
Daniel Han
0ca1be0097 Update vision.py 2025-06-30 07:07:38 -07:00
Daniel Han
4aaa1e269a Update loader.py 2025-06-30 07:06:35 -07:00
Daniel Han
a393513e64 Update vision.py 2025-06-30 07:03:36 -07:00
Daniel Han
14c6cd63a2 Update vision.py 2025-06-30 06:53:28 -07:00
Daniel Han
e1654ec5a3 Gemma 3N fixes 2025-06-30 06:51:49 -07:00
Daniel Han
36bbd15d93 Versioning 2025-06-30 06:08:14 -07:00
Daniel Han
b0e1725572 Update loader.py 2025-06-30 06:04:19 -07:00
Roland Tannous
ec7400b552 Added conda/mamba section to blackwell installation readme (#2817)
* Added conda/mamba section to blackwell installation readme

* fix conda creation suffix and vllm install syntax
2025-06-30 06:02:57 -07:00
Daniel Han
d0b03f80b2 Gemma 3N fixes 2025-06-30 06:01:50 -07:00
Daniel Han
67e5bcf9c1 Merge branch 'main' into nightly 2025-06-30 05:52:19 -07:00
Daniel Han
167b97127d Update stale.yml 2025-06-30 02:16:09 -07:00
Daniel Han
dd18796fe1 Create stale.yml (#2836) 2025-06-29 21:59:43 -07:00
Daniel Han
5901204643 Delete stale.yml 2025-06-29 21:58:55 -07:00
Daniel Han
35a440abd0 Update stale.yml 2025-06-29 21:57:30 -07:00
Daniel Han
e80f725efa Create stale.yml (#2832) 2025-06-29 17:36:23 -07:00
Daniel Han
40c3c33dba Delete stale.yml 2025-06-29 17:35:01 -07:00
Daniel Han
dc62a55b31 Update stale.yml 2025-06-29 17:29:36 -07:00
Daniel Han
e62fa8a5f6 Create stale.yml 2025-06-29 17:28:18 -07:00
Daniel Han
94e0ba18b9 Merge branch 'main' into nightly 2025-06-29 16:38:27 -07:00
Mehmet Oguz Derin
cb9f5bb923 Fix LoftQ with FastBaseModel (#2826)
Pass `init_lora_weights` and `loftq_config` to `LoraConfig` constructor, which enables classes like `FastModel` to use LoftQ support. Thank you very much in advance!
2025-06-29 16:14:02 -07:00
Daniel Han
e98cb6c399 gradient checkpointing 2025-06-29 03:19:20 -07:00
Daniel Han
8943c1b5dd Merge branch 'main' into nightly 2025-06-28 17:44:21 -07:00
DoubleMathew
be38f500d0 import undefined transformers_version for falcon model (#2822)
* import undefined transformers_version for falcon model

fixed falcon transformers version check and added error handling for FalconH1Attention bad import

* Also, conditionally load module from falcon_h1 depending on if the transformers version supports is
2025-06-28 17:41:19 -07:00
DoubleMathew
ebe935ee74 granite force layernorm upcast (#2799) 2025-06-28 05:27:56 -07:00
Dhia Eddine Rhaiem
96941573e6 Add falcon h1 (#2650)
* add falcon h1

* feat: add Falcon-H1 into unsloth

* address comments

* fix

* Update unsloth/models/llama.py

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* Update unsloth/models/llama.py

Co-authored-by: Daniel Han <danielhanchen@gmail.com>

* fixes

* fix comments

---------

Co-authored-by: Daniel Han <danielhanchen@gmail.com>
Co-authored-by: Younes B <49240599+younesbelkada@users.noreply.github.com>
Co-authored-by: Younes Belkada <younes.belkada@tii.ae>
Co-authored-by: ilyasch2 <ilyas.chahed@tii.ae>
2025-06-28 04:55:13 -07:00
jeromeku
267ca3b209 add instructions for installing on blackwell (#2812) 2025-06-27 04:54:55 -07:00
Daniel Han
e32785619a Update vision.py 2025-06-27 04:12:10 -07:00
Daniel Han
cb1e6d903f Merge branch 'main' into nightly 2025-06-27 03:10:11 -07:00
Daniel Han
e53aa34fb7 Update loader.py 2025-06-26 12:03:29 -07:00
Daniel Han
b91a5cea20 Update _utils.py 2025-06-26 11:31:17 -07:00
Daniel Han
ccf00d22b8 Update loader.py 2025-06-26 11:31:08 -07:00
Daniel Han
345f1fe425 Merge branch 'main' into nightly 2025-06-26 10:30:51 -07:00
Daniel Han
fd22687155 Update pyproject.toml 2025-06-26 09:15:14 -07:00
Daniel Han
4907b8dd67 Gemma 3N (#2809)
* Add QLoRA Train and Merge16bit Test (#2130)

* add reference and unsloth lora merging tests

* add test / dataset printing to test scripts

* allow running tests from repo root

* add qlora test readme

* more readme edits

* ruff formatting

* additional readme comments

* forgot to add actual tests

* add apache license

* Update pyproject.toml

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update loader.py

* Update loader.py

* Revert

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Bug fix

* Update mapper.py

* check SDPA for Mistral 3, Pixtral

* Update vision.py

* Versioning

* Update rl_replacements.py

* Update README.md

* add model registry

* move hf hub utils to unsloth/utils

* refactor global model info dicts to dataclasses

* fix dataclass init

* fix llama registration

* remove deprecated key function

* start registry reog

* add llama vision

* quant types -> Enum

* remap literal quant types to QuantType Enum

* add llama model registration

* fix quant tag mapping

* add qwen2.5 models to registry

* add option to include original model in registry

* handle quant types per model size

* separate registration of base and instruct llama3.2

* add QwenQVQ to registry

* add gemma3 to registry

* add phi

* add deepseek v3

* add deepseek r1 base

* add deepseek r1 zero

* add deepseek distill llama

* add deepseek distill models

* remove redundant code when constructing model names

* add mistral small to registry

* rename model registration methods

* rename deepseek registration methods

* refactor naming for mistral and phi

* add global register models

* refactor model registration tests for new registry apis

* add model search method

* remove deprecated registration api

* add quant type test

* add registry readme

* make llama registration more specific

* clear registry when executing individual model registration file

* more registry readme updates

* Update _auto_install.py

* Llama4

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Synthetic data

* Update mapper.py

* Xet and Synthetic

* Update synthetic.py

* Update loader.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update pyproject.toml

* Delete .gitignore

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update _utils.py

* Update pyproject.toml

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update synthetic.py

* Update chat_templates.py

* Seasame force float16 / float32

* Fix Seasame

* Update loader.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update loader.py

* is_multimodal

* Update loader.py

* Update loader.py

* Update loader.py

* Update loader.py

* Update vision.py

* Update vision.py

* Update vision.py

* UNSLOTH_DISABLE_STATIC_GENERATION

* Update vision.py

* Auto vision detection

* Sesame

* Whisper

* Update loader.py

* Update loader.py

* Update loader.py

* Update mapper.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update vision.py

* Update loader.py

* Update loader.py

* Update loader.py

* Update loader.py

* Update _utils.py

* Update rl.py

* versioning

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* Update rl.py

* logging

* Update pyproject.toml

* Update rl.py

* versioning

* Update rl.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl.py

* Update rl_replacements.py

* Update rl_replacements.py

* logits / temperature

* Update rl_replacements.py

* Update pyproject.toml

* Update rl_replacements.py

* Update rl_replacements.py

* Debugging only

* Update llama.py

* Update llama.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Update rl_replacements.py

* Generic efficient GRPO

* Update rl_replacements.py

* Update rl_replacements.py

* Remove debugging

* Update rl_replacements.py

* Update rl_replacements.py

* Update vision.py

* Update llama.py

* Update rl_replacements.py

* versioning

* Update _utils.py

* Update vision.py

* Update mapper.py

* Update loader.py

* Update mapper.py

* Update vision.py

* Update loader.py

* Update vision.py

* Update loader.py

* Update _utils.py

---------

Co-authored-by: jeromeku <jerome.ku@gmail.com>
Co-authored-by: Jack Shi Wei Lun <87535974+jackswl@users.noreply.github.com>
Co-authored-by: Michael Han <107991372+shimmyshimmer@users.noreply.github.com>
2025-06-26 09:14:28 -07:00