Michael Han
|
1b8269f794
|
Update README.md
|
2025-09-16 10:07:02 -07:00 |
|
Daniel Han
|
e204e93599
|
Update README.md
|
2025-09-15 01:46:07 -07:00 |
|
Daniel Han
|
1d83c5ffe8
|
Update README.md
|
2025-09-15 01:43:11 -07:00 |
|
Daniel Han
|
fdbee04f96
|
Update README.md
|
2025-09-15 01:42:59 -07:00 |
|
Daniel Han
|
e66427f795
|
Update README.md
|
2025-09-15 01:40:28 -07:00 |
|
Daniel Han
|
a40ccf8d33
|
Update README.md
|
2025-09-15 01:40:06 -07:00 |
|
Daniel Han
|
fe291a10a9
|
Update README.md
|
2025-09-15 01:39:39 -07:00 |
|
Daniel Han
|
b73e9b0b9e
|
Blackwell support
|
2025-09-15 01:39:03 -07:00 |
|
Michael Han
|
c7fc68c5e0
|
Update README.md
|
2025-09-13 21:45:22 -07:00 |
|
Michael Han
|
dbaff8a0dd
|
Update README.md
Adding new install instructions
|
2025-09-13 21:30:52 -07:00 |
|
Michael Han
|
7dd4e1dd5d
|
Update README.md
|
2025-08-09 15:53:29 -07:00 |
|
Michael Han
|
63199569fa
|
Update README.md
|
2025-08-08 12:14:38 -07:00 |
|
Quentin Gallouédec
|
89ba48dd7e
|
Update README.md (#2991)
* Update README.md
* Update README.md
|
2025-07-18 15:43:59 -07:00 |
|
Daniel Han
|
2fac21687f
|
Fixes
|
2025-07-11 00:01:37 -07:00 |
|
Michael Han
|
d672f03d0b
|
Update README.md
Updating icon sizes
|
2025-07-04 15:50:31 -07:00 |
|
Michael Han
|
61a220ffef
|
Update README.md
Editing icon sizes
|
2025-07-04 15:37:44 -07:00 |
|
Michael Han
|
968fd27265
|
Update README.md
|
2025-07-01 09:28:59 -07:00 |
|
Daniel Han
|
eef2515749
|
Move AMD to AMD branch
|
2025-07-01 01:02:51 -07:00 |
|
billishyahao
|
06ca5c273b
|
[Feature] enable unsloth on amd gpu (#2520)
* [Feature] enable unsloth on amd gpu
* fix the comment
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
|
2025-06-30 16:52:05 -07:00 |
|
Michael Han
|
f14d7e1542
|
Update README.md
Updating links
|
2025-06-25 01:32:24 -07:00 |
|
Michael Han
|
c820beeaad
|
Update README.md
Better Qwen3 notebook
|
2025-05-26 23:44:41 -07:00 |
|
Michael Han
|
380c3b6896
|
Update README.md
|
2025-05-25 03:35:43 -07:00 |
|
Quentin Gallouédec
|
216fb5cde9
|
Remove dataset_text_field from SFTConfig (#2609)
|
2025-05-25 03:20:16 -07:00 |
|
Michael Han
|
3e5024ceed
|
Update README.md
Updating model support
|
2025-05-20 09:51:55 -07:00 |
|
Michael Han
|
d69fc3149c
|
Update README.md
|
2025-05-19 21:26:19 -07:00 |
|
Michael Han
|
524d05cd73
|
Update README.md
|
2025-05-16 01:56:40 -07:00 |
|
Michael Han
|
6e771a0a24
|
Update README.md
TTS support
|
2025-05-15 15:15:53 -07:00 |
|
Michael Han
|
520c8ddf41
|
Update README.md
|
2025-05-15 06:54:05 -07:00 |
|
omahs
|
616bacb199
|
Fix typos (#2540)
|
2025-05-15 04:23:27 -07:00 |
|
Michael Han
|
3ce4cc6cf5
|
Update README.md
|
2025-05-13 01:39:59 -07:00 |
|
Yuanzhe Dong
|
dd9d030eec
|
Fix readme example
|
2025-05-06 19:26:35 -07:00 |
|
Michael Han
|
9390bd528d
|
Update README.md
Adding extra synthetic data notebook, cleaning repo
|
2025-05-05 20:56:01 -07:00 |
|
Michael Han
|
5ce83f272b
|
Update README.md
|
2025-05-02 23:14:34 -07:00 |
|
Michael Han
|
2ba6052260
|
Update README.md
|
2025-05-02 09:06:57 -07:00 |
|
Michael Han
|
418dc94226
|
Update README.md
Qwen3 notebook
|
2025-05-01 22:52:42 -07:00 |
|
Michael Han
|
96dec7dae1
|
Update README.md
|
2025-04-28 19:08:12 -07:00 |
|
Michael Han
|
c9b9a366e7
|
Update README.md
|
2025-04-05 14:56:01 -07:00 |
|
zhaozh
|
6088faf0e7
|
Update README.md
Gemma3 HF uploaded GGUFs, 4-bit models link.
|
2025-04-02 16:10:21 +08:00 |
|
Michael Han
|
2ff5dc1a8d
|
Update README.md
|
2025-03-27 00:26:18 -07:00 |
|
Michael Han
|
37dbadb366
|
Update README.md
|
2025-03-19 04:23:52 -07:00 |
|
Michael Han
|
1a43974dfe
|
Update README.md
|
2025-03-19 04:21:39 -07:00 |
|
Michael Han
|
6f7c8c6d0a
|
Update README.md
|
2025-03-15 17:47:25 -07:00 |
|
Daniel Han
|
5df2a0ce2a
|
Update README.md (#2028)
|
2025-03-14 22:06:53 -07:00 |
|
Daniel Han
|
5174a675a2
|
Gemma 3 readme (#2019)
* Update README.md
* Update README.md
* Update README.md
---------
Co-authored-by: Michael Han <107991372+shimmyshimmer@users.noreply.github.com>
|
2025-03-14 11:12:02 -07:00 |
|
Daniel Han
|
029461a8c4
|
Gemma 3, bug fixes (#2014)
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update pyproject.toml
* Update pyproject.toml
* Export Model to ollama.com (#1648)
* Ollama Export Model to ollama.com
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Check for model_name
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* subprocess use instead of requests | added check for ollama server
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model | fix
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Push to Ollama
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Update cross_entropy_loss.py
* torch_cuda_device
* Update utils.py
* Update utils.py
* Update utils.py
* device
* device
* Update loader.py
* Update llama.py
* Update README.md
* Update llama.py
* Update llama.py
* Update _utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* __version__
* Update rl.py
* Bug fixes
* Bug fixes
* Update llama.py
* Update _utils.py
* _wrap_fast_inference
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* SFT dataset prepare
* Update pyproject.toml
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update utils.py
* bug fix
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update __init__.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update __init__.py
* Update _utils.py
* Version
* versioning
* Update _utils.py
* Update llama.py
* Update llama.py
* Bug fixes
* FastModel
* __doc__
* Update vision.py
* Update loader.py
* Update loader.py
* Update loader.py
* version
* move use_modelscope to _utils (#1938)
* move use_modelscope to _utils
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Don't use revision when loading model_config and is_peft=True (#1949)
* More syntax warnings (#1944)
* move use_modelscope to _utils
* fix
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update loader.py
* Full finetuning and other fixes
* UNSLOTH_ENABLE_FULL_FINETUNING
* Update loader.py
* Update loader.py
* Update loader.py
* Update vision.py
* Update vision.py
* full finetuning
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* max_seq_length
* Update rl.py
* Update rl.py
* Update rl.py
* Update pyproject.toml
* AutoModelForImageTextToText
* Update mapper.py
* Update pyproject.toml
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Batch samples
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* Update loader.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Temporary patches
* Update loader.py
* model names
* Gemma 3 chat template
* Bug fixes
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update llama.py
* Update llama.py
* Update rl.py
* Update chat_templates.py
* Update chat_templates.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update vision.py
* Revert
* Update _utils.py
* forced precision
* Autocast
* Update vision.py
* Update vision.py
* Update rl.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl.py
* vLLM fixes
* constexpr
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update save.py
* New models
* Triton windows update (#1976)
* Update pyproject.toml
* Update README.md
* Update RMS LayerNorm implementation, and list compr. change in chat templates (#1974)
* Update RMS LayerNorm implementation with optimizations and testing suite
* perf: optimize list comprehension in get_ollama_eos_tokens
* Update Zoo
* Update llama.py
* Update llama.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update rl_replacements.py
* Update vision.py
* grpo fix
* Update rl_replacements.py
* Update vision.py
* Update rl_replacements.py
* Update vision.py
* Update mapper.py
* Update vision.py
* Update vision.py
* Update loader.py
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
Co-authored-by: Jyotin Goel <120490013+gjyotin305@users.noreply.github.com>
Co-authored-by: Kareem <81531392+KareemMusleh@users.noreply.github.com>
Co-authored-by: Wilson Wu <140025193+wiwu2390@users.noreply.github.com>
Co-authored-by: Akshay Behl <126911424+Captain-T2004@users.noreply.github.com>
|
2025-03-14 06:42:44 -07:00 |
|
Daniel Han
|
362a9ac1ac
|
Bug fixes (#1891)
* Update rl.py
* Patching
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* NEFTune
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Extra replacements
* Update rl_replacements.py
* Update rl.py
* extra RL replacements
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update _utils.py
* Update loader_utils.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* autocast
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update pyproject.toml
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update _utils.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* GRPO optimized
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Selective Log softmax
* Fix GRPO bsz
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Fix TRL
* Metrics GRPO
* Update rl_replacements.py
* Update rl_replacements.py
* No compile
* Update rl.py
* Remove docs
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* llama-quantize on WINDOWS WSL error fix - edit save.py (gguf saving breaks) (#1649)
* edit save.py to fix gguf saving breaks.
* add check for .exe or not exe file extension for linux and windows
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* unsloth_num_chunks
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py (#1754)
Fix typo in comment: know -> now.
This was printed when running the Llama3.1_(8B)-GRPO.ipynb example notebook, so I'd expect others to run into it as well.
* Optional logits
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* fix an import error (#1767)
* fix an import error
* Delete .gitignore
* Update loader.py
* Update save.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* SamplingParams
* Convert mask to float (#1762)
* [Windows Support] Add latest `xformers` wheels to pyproject.toml (#1753)
* Add latest xformers
* Add a couple of lines to docs
* vLLMSamplingParams
* Update __init__.py
* default num_chunks == -1
* Versioning
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update pyproject.toml
* Update pyproject.toml
* Export Model to ollama.com (#1648)
* Ollama Export Model to ollama.com
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Check for model_name
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* subprocess use instead of requests | added check for ollama server
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* create_ollama_model | fix
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Push to Ollama
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
* Update cross_entropy_loss.py
* torch_cuda_device
* Update utils.py
* Update utils.py
* Update utils.py
* device
* device
* Update loader.py
* Update llama.py
* Update README.md
* Update llama.py
* Update llama.py
* Update _utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* __version__
* Update rl.py
* Bug fixes
---------
Signed-off-by: Jyotin Goel <b22ai063@iitj.ac.in>
Co-authored-by: Gennadii Manzhos <105049664+everythingisc00l@users.noreply.github.com>
Co-authored-by: Seth Weidman <seth@sethweidman.com>
Co-authored-by: Nino Risteski <95188570+NinoRisteski@users.noreply.github.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Ben <6579034+versipellis@users.noreply.github.com>
Co-authored-by: Jyotin Goel <120490013+gjyotin305@users.noreply.github.com>
|
2025-03-04 03:55:49 -08:00 |
|
Michael Han
|
b512a60093
|
Update README.md
|
2025-03-03 21:27:20 -08:00 |
|
Michael Han
|
5d0ee525c1
|
Update README.md
|
2025-03-02 20:44:26 -08:00 |
|
Michael Han
|
ceb2ca864e
|
Update README.md
|
2025-03-02 20:35:27 -08:00 |
|
Michael Han
|
eb04ec464b
|
Update README.md
|
2025-03-02 20:34:36 -08:00 |
|