-
released this
2024-12-04 14:38:05 +01:00 | 5897 commits to main since this releaseDynamic quants (#1379)
-
typing
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
int64
-
Update _utils.py
-
Update cross_entropy_loss.py
-
constexpr
-
constexpr
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
CE
-
Update cross_entropy_loss.py
-
Update _utils.py
-
Update llama.py
-
Update _utils.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update utils.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
typing
-
Update rope_embedding.py
-
types
-
Disable compiling
-
Update _utils.py
-
Update _utils.py
-
Forward hook
-
Update _utils.py
-
Update llama.py
-
Update _utils.py
-
Update llama.py
-
Update llama.py
-
Update _utils.py
-
Update pyproject.toml
-
Update _utils.py
-
Update llama.py
-
CE Loss
-
Update cross_entropy_loss.py
-
Update _utils.py
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update cross_entropy_loss.py
-
Update llama.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Fix: cast logits to float32 in cross_entropy_forward to prevent errors (#1254)
-
Fix: cast logits to float32 in cross_entropy_forward to prevent errors
-
Update cross_entropy_loss.py
Co-authored-by: Daniel Han danielhanchen@gmail.com
-
Throw error when inferencing longer than max_popsition_embeddings (#1236)
-
Throw error when inferencing longer than max_popsition_embeddings without rope scaling
-
Update llama.py
Co-authored-by: Daniel Han danielhanchen@gmail.com
- CLI now handles user input strings for dtype correctly (#1235)
Co-authored-by: root root@ieeres.chu.cam.ac.uk
-
Update flex_attention.py
-
Update _utils.py
-
Update _utils.py
-
Update flex_attention.py
-
Update flex_attention.py
-
Update loader.py
-
Update loader.py
-
Update flex_attention.py
-
Update flex_attention.py
-
Update flex_attention.py
-
Update flex_attention.py
-
Update _utils.py
-
Update cross_entropy_loss.py
-
Update _utils.py
-
Update tokenizer_utils.py
-
Update tokenizer_utils.py
-
Update tokenizer_utils.py
-
Update tokenizer_utils.py
-
Update tokenizer_utils.py
-
triton_cast
-
Update utils.py
-
Qwen 2.5 Coder
-
Fix/export mistral (#1281)
-
Enhance install_python_non_blocking to handle protobuf installation and process management
-
Revert "Enhance install_python_non_blocking to handle protobuf installation and process management"
This reverts commit a3b796a05841fb8d93c652c845591e12cf81ea93.
-
Set PROTOCOL_BUFFERS_PYTHON_IMPLEMENTATION to 'python' to address issue #1266
-
Revert "Set PROTOCOL_BUFFERS_PYTHON_IMPLEMENTATION to 'python' to address issue #1266"
This reverts commit f00fbf5eac7ad4f5d48c70b98d770255d1a9ef58.
-
Set PROTOCOL_BUFFERS_PYTHON_IMPLEMENTATION to 'python' to address issue #1266
-
Update init.py
Co-authored-by: Daniel Han danielhanchen@gmail.com
-
DOC Update - Update README.md with os.environ in example (#1269)
-
Update README.md with os.environ in example
Added OS Environ in example to avoid device conflicts , for a user at least in jupyter notebook this allows to select GPU in a multi GPU setup.
As currently the unsloth init checks all GPU's and takes the first in the order which can be a issue when some GPU's are in use and the list still shows them. So to manually avoid this, this os config is required.
Small change but a bit time saver for those who straight away copies the tutorials- Update README.md
Co-authored-by: Daniel Han danielhanchen@gmail.com
-
fix/get_chat_template (#1246)
-
Refactor
get_chat_templateto now support system message instead. It supposed to fix ollama tokenizer chattemplate to -
Remove type hinting
-
Update chat_templates.py
Co-authored-by: Daniel Han danielhanchen@gmail.com
-
fix/sft-trainer (#1276)
-
Add patch for SFTTrainer to maintain backward compatibility with TRL changes
-
Update trainer.py
-
Update trainer.py
-
Refactor trainer patch to maintain backward compatibility with TRL changes
-
Update trainer.py
-
Refactor trainer.py to exclude non-convertible trainers from backward compatibility patch
Co-authored-by: Daniel Han danielhanchen@gmail.com
-
Update init.py
-
Update trainer.py
-
Update trainer.py
-
Update trainer.py
-
Update tokenizer_utils.py
-
Update llama.py
-
Fix #853
-
fix/sfttrainer-compatibility (#1293)
-
Refactor trainer.py to import SFTConfig directly and update UnslothTrainingArguments class inheritance
-
Update trainer.py
-
Update trainer.py
Co-authored-by: Daniel Han danielhanchen@gmail.com
-
Update rms_layernorm.py
-
Update rms_layernorm.py
-
Gemma
-
Update rms_layernorm.py
-
Update gemma2.py
-
Cut Cross Entropy
-
Update llama.py
-
Cut Cross Entropy
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update init.py
-
Update init.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update mapper.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
patch_fast_lora
-
vision
-
Update fast_lora.py
-
Update _utils.py
-
Update _utils.py
-
Vision
-
Update trainer.py
-
Update save.py
-
FastBaseVisionModel
-
Update loader_utils.py
-
Update vision.py
-
Update loader.py
-
Update vision.py
-
Update loader.py
-
Update vision.py
-
Update _utils.py
-
tokenizer_name
-
Update loader.py
-
Update vision.py
-
Update save.py
-
Update save.py
-
Update vision.py
-
Update vision.py
-
Update vision.py
-
Update vision.py
-
Update vision.py
-
Update vision.py
-
Update _utils.py
-
Update loader.py
-
kwargs
-
logits
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
error
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update _utils.py
-
Update loader.py
-
Update llama.py
-
Update vision.py
-
Update loader.py
-
Old torch versions
-
Update loader.py
-
Update loader.py
-
prints
-
recheck
-
Update loader.py
-
Update loader.py
-
Update _utils.py
-
Update _utils.py
-
Update mapper.py
-
Feat/kto (#1316)
-
Add PatchKTOTrainer and update model imports
-
Update dpo.py
-
Update init.py
-
Delete unsloth/models/kto.py
Co-authored-by: Daniel Han danielhanchen@gmail.com
-
Fix orpo/dpo trainer (#1286)
-
change the colab notebook for dpo zephyr and orpo
-
use original tokenizer
-
Update README.md
-
Update README.md
Co-authored-by: Daniel Han danielhanchen@gmail.com
-
skip modules
-
Update vision.py
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Update llama.py
-
Fix llama.cpp
-
Update save.py
-
Update save.py
-
Update vision.py
-
Update save.py
-
Update save.py
-
Update save.py
-
Update save.py
-
Update save.py
-
Update save.py
-
Update save.py
-
Update _utils.py
-
Update save.py
-
Update save.py
-
Update mapper.py
-
modules
Co-authored-by: Edd 68678137+Erland366@users.noreply.github.com
Co-authored-by: Datta Nimmaturi datta.nimmaturi@nutanix.com
Co-authored-by: Edwin Fennell edwinfennell1@gmail.com
Co-authored-by: root root@ieeres.chu.cam.ac.uk
Co-authored-by: Uday Girish Maradana einsteingirish@gmail.com
Co-authored-by: cell-dame 122996026+dame-cell@users.noreply.github.comDownloads
-
Source code (ZIP)
0 downloads
-
Source code (TAR.GZ)
0 downloads
-