Kareem
|
d4c0668448
|
fix (#2051)
|
2025-03-16 15:19:58 -07:00 |
|
Mukkesh Ganesh
|
d1db265965
|
bug fix #2008 (#2039)
|
2025-03-16 15:19:14 -07:00 |
|
Daniel Han
|
4bdb668809
|
Update llama.py
|
2025-03-15 23:34:52 -07:00 |
|
Daniel Han
|
766ae6781b
|
Update llama.py
|
2025-03-15 22:39:09 -07:00 |
|
Daniel Han
|
79d117455d
|
Update pyproject.toml
|
2025-03-15 19:40:02 -07:00 |
|
Daniel Han
|
079ca8c7c3
|
Version
|
2025-03-15 19:22:44 -07:00 |
|
Daniel Han
|
dc1999eacb
|
Merge branch 'main' into nightly
|
2025-03-15 19:15:26 -07:00 |
|
Daniel Han
|
f92544d75a
|
Update _utils.py
|
2025-03-15 17:58:14 -07:00 |
|
Michael Han
|
0c819e097b
|
Update README.md
|
2025-03-15 17:47:25 -07:00 |
|
Daniel Han
|
7f2400da25
|
Update rl.py
|
2025-03-15 17:13:18 -07:00 |
|
Daniel Han
|
ee6ff8711e
|
Merge branch 'main' into nightly
|
2025-03-15 16:36:18 -07:00 |
|
Daniel Han
|
8a91a7e7a4
|
Update README.md (#2028)
|
2025-03-14 22:06:53 -07:00 |
|
Daniel Han
|
4dbb759705
|
Gemma 3 readme (#2019)
* Update README.md
* Update README.md
* Update README.md
---------
Co-authored-by: Michael Han <107991372+shimmyshimmer@users.noreply.github.com>
|
2025-03-14 11:12:02 -07:00 |
|
Daniel Han
|
cc15aef60e
|
Update _utils.py
|
2025-03-14 10:04:10 -07:00 |
|
Daniel Han
|
a5d7436b39
|
Update save.py
|
2025-03-14 09:54:48 -07:00 |
|
Daniel Han
|
5ca5f44698
|
Precision issues
|
2025-03-14 08:33:33 -07:00 |
|
Daniel Han
|
6e3f56ce06
|
Update vision.py
|
2025-03-14 08:19:02 -07:00 |
|
Daniel Han
|
3258b72693
|
Update _utils.py
|
2025-03-14 08:17:49 -07:00 |
|
Daniel Han
|
c25ed132c0
|
Update vision.py
|
2025-03-14 08:17:36 -07:00 |
|
Daniel Han
|
787c03287d
|
Update save.py
|
2025-03-14 08:08:43 -07:00 |
|
Daniel Han
|
bec1b782bc
|
GGUF saving (#2017)
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update pyproject.toml
* Update pyproject.toml
* Export Model to ollama.com (#1648)
* Ollama Export Model to ollama.com
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Check for model_name
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* subprocess use instead of requests | added check for ollama server
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model | fix
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Push to Ollama
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Update cross_entropy_loss.py
* torch_cuda_device
* Update utils.py
* Update utils.py
* Update utils.py
* device
* device
* Update loader.py
* Update llama.py
* Update README.md
* Update llama.py
* Update llama.py
* Update _utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* __version__
* Update rl.py
* Bug fixes
* Bug fixes
* Update llama.py
* Update _utils.py
* _wrap_fast_inference
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* SFT dataset prepare
* Update pyproject.toml
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update utils.py
* bug fix
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update __init__.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update __init__.py
* Update _utils.py
* Version
* versioning
* Update _utils.py
* Update llama.py
* Update llama.py
* Bug fixes
* FastModel
* __doc__
* Update vision.py
* Update loader.py
* Update loader.py
* Update loader.py
* version
* move use_modelscope to _utils (#1938)
* move use_modelscope to _utils
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Don't use revision when loading model_config and is_peft=True (#1949)
* More syntax warnings (#1944)
* move use_modelscope to _utils
* fix
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update loader.py
* Full finetuning and other fixes
* UNSLOTH_ENABLE_FULL_FINETUNING
* Update loader.py
* Update loader.py
* Update loader.py
* Update vision.py
* Update vision.py
* full finetuning
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* max_seq_length
* Update rl.py
* Update rl.py
* Update rl.py
* Update pyproject.toml
* AutoModelForImageTextToText
* Update mapper.py
* Update pyproject.toml
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Batch samples
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* Update loader.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Temporary patches
* Update loader.py
* model names
* Gemma 3 chat template
* Bug fixes
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update llama.py
* Update llama.py
* Update rl.py
* Update chat_templates.py
* Update chat_templates.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Revert
* Update _utils.py
* forced precision
* Autocast
* Update vision.py
* Update vision.py
* Update rl.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl.py
* vLLM fixes
* constexpr
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update save.py
* New models
* Triton windows update (#1976)
* Update pyproject.toml
* Update README.md
* Update RMS LayerNorm implementation, and list compr. change in chat templates (#1974)
* Update RMS LayerNorm implementation with optimizations and testing suite
* perf: optimize list comprehension in get_ollama_eos_tokens
* Update Zoo
* Update llama.py
* Update llama.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl_replacements.py
* Update vision.py
* grpo fix
* Update rl_replacements.py
* Update vision.py
* Update rl_replacements.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update save.py
* Update save.py
* Update save.py
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
Co-authored-by: Jyotin Goel <120490013+gjyotin305@users.noreply.github.com>
Co-authored-by: Kareem <81531392+KareemMusleh@users.noreply.github.com>
Co-authored-by: Wilson Wu <140025193+wiwu2390@users.noreply.github.com>
Co-authored-by: Akshay Behl <126911424+Captain-T2004@users.noreply.github.com>
|
2025-03-14 07:58:57 -07:00 |
|
Daniel Han
|
921975f082
|
Update save.py
2025-03
|
2025-03-14 07:56:56 -07:00 |
|
Daniel Han
|
f3ac7068b0
|
Update save.py
|
2025-03-14 07:36:35 -07:00 |
|
Daniel Han
|
3f0c9adf82
|
Update save.py
|
2025-03-14 07:26:23 -07:00 |
|
Daniel Han
|
2b9f86bec8
|
Update vision.py
|
2025-03-14 07:09:23 -07:00 |
|
Daniel Han
|
962c470ef7
|
Merge branch 'main' into nightly
|
2025-03-14 07:09:16 -07:00 |
|
Daniel Han
|
8cd65ba494
|
Gemma 3, bug fixes (#2014)
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update pyproject.toml
* Update pyproject.toml
* Export Model to ollama.com (#1648)
* Ollama Export Model to ollama.com
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Check for model_name
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* subprocess use instead of requests | added check for ollama server
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model | fix
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Push to Ollama
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Update cross_entropy_loss.py
* torch_cuda_device
* Update utils.py
* Update utils.py
* Update utils.py
* device
* device
* Update loader.py
* Update llama.py
* Update README.md
* Update llama.py
* Update llama.py
* Update _utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* __version__
* Update rl.py
* Bug fixes
* Bug fixes
* Update llama.py
* Update _utils.py
* _wrap_fast_inference
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* SFT dataset prepare
* Update pyproject.toml
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update utils.py
* bug fix
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update __init__.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update __init__.py
* Update _utils.py
* Version
* versioning
* Update _utils.py
* Update llama.py
* Update llama.py
* Bug fixes
* FastModel
* __doc__
* Update vision.py
* Update loader.py
* Update loader.py
* Update loader.py
* version
* move use_modelscope to _utils (#1938)
* move use_modelscope to _utils
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Don't use revision when loading model_config and is_peft=True (#1949)
* More syntax warnings (#1944)
* move use_modelscope to _utils
* fix
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update loader.py
* Full finetuning and other fixes
* UNSLOTH_ENABLE_FULL_FINETUNING
* Update loader.py
* Update loader.py
* Update loader.py
* Update vision.py
* Update vision.py
* full finetuning
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* max_seq_length
* Update rl.py
* Update rl.py
* Update rl.py
* Update pyproject.toml
* AutoModelForImageTextToText
* Update mapper.py
* Update pyproject.toml
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Batch samples
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* Update loader.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Temporary patches
* Update loader.py
* model names
* Gemma 3 chat template
* Bug fixes
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update llama.py
* Update llama.py
* Update rl.py
* Update chat_templates.py
* Update chat_templates.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Revert
* Update _utils.py
* forced precision
* Autocast
* Update vision.py
* Update vision.py
* Update rl.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl.py
* vLLM fixes
* constexpr
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update save.py
* New models
* Triton windows update (#1976)
* Update pyproject.toml
* Update README.md
* Update RMS LayerNorm implementation, and list compr. change in chat templates (#1974)
* Update RMS LayerNorm implementation with optimizations and testing suite
* perf: optimize list comprehension in get_ollama_eos_tokens
* Update Zoo
* Update llama.py
* Update llama.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl_replacements.py
* Update vision.py
* grpo fix
* Update rl_replacements.py
* Update vision.py
* Update rl_replacements.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Update vision.py
* Update loader.py
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
Co-authored-by: Jyotin Goel <120490013+gjyotin305@users.noreply.github.com>
Co-authored-by: Kareem <81531392+KareemMusleh@users.noreply.github.com>
Co-authored-by: Wilson Wu <140025193+wiwu2390@users.noreply.github.com>
Co-authored-by: Akshay Behl <126911424+Captain-T2004@users.noreply.github.com>
|
2025-03-14 06:42:44 -07:00 |
|
Daniel Han
|
935cb93b1a
|
Update loader.py
|
2025-03-14 06:26:01 -07:00 |
|
Daniel Han
|
f89f30aa24
|
Update vision.py
|
2025-03-14 06:17:35 -07:00 |
|
Daniel Han
|
0a74e08557
|
Update vision.py
|
2025-03-14 06:17:20 -07:00 |
|
Daniel Han
|
376e0d25ce
|
Update mapper.py
|
2025-03-14 06:15:44 -07:00 |
|
Daniel Han
|
0642665ea5
|
Update vision.py
|
2025-03-14 06:11:51 -07:00 |
|
Daniel Han
|
22eeee212d
|
Update rl_replacements.py
|
2025-03-14 06:11:19 -07:00 |
|
Daniel Han
|
571f3abe54
|
Update vision.py
|
2025-03-14 06:06:10 -07:00 |
|
Daniel Han
|
d3439f887e
|
Update rl_replacements.py
|
2025-03-14 06:01:42 -07:00 |
|
Daniel Han
|
e6e071a456
|
grpo fix
|
2025-03-14 05:57:17 -07:00 |
|
Daniel Han
|
4ca856fefd
|
Update vision.py
|
2025-03-14 05:54:57 -07:00 |
|
Daniel Han
|
5b24b2e761
|
Update rl_replacements.py
|
2025-03-14 05:51:08 -07:00 |
|
Daniel Han
|
c524050481
|
Update vision.py
|
2025-03-14 05:41:17 -07:00 |
|
Daniel Han
|
3baed67682
|
Update vision.py
|
2025-03-14 05:40:56 -07:00 |
|
Daniel Han
|
27e3809815
|
Update vision.py
|
2025-03-14 04:59:29 -07:00 |
|
Daniel Han
|
2a6fb83630
|
Update vision.py
|
2025-03-14 04:58:32 -07:00 |
|
Daniel Han
|
658f23f3f6
|
Update vision.py
|
2025-03-14 04:51:43 -07:00 |
|
Daniel Han
|
d2b8043b79
|
Update vision.py
|
2025-03-14 04:43:11 -07:00 |
|
Daniel Han
|
d7173b482d
|
Update vision.py
|
2025-03-14 04:40:29 -07:00 |
|
Daniel Han
|
dbccfd7ad9
|
Update vision.py
|
2025-03-14 04:39:00 -07:00 |
|
Daniel Han
|
86ef8913ce
|
Update vision.py
|
2025-03-14 04:37:31 -07:00 |
|
Daniel Han
|
d64d082499
|
Update vision.py
|
2025-03-14 04:30:26 -07:00 |
|
Daniel Han
|
c217844c4c
|
Update vision.py
|
2025-03-14 04:30:02 -07:00 |
|
Daniel Han
|
f21ad4b1e4
|
Update vision.py
|
2025-03-14 04:26:10 -07:00 |
|