Daniel Han
|
862ab9290c
|
Update loader.py
|
2025-01-01 02:06:41 -08:00 |
|
Daniel Han
|
800868243e
|
Xformers
|
2024-12-31 22:42:28 -08:00 |
|
Daniel Han
|
f5b6fd1aa5
|
Update __init__.py
|
2024-12-31 12:35:56 -08:00 |
|
Daniel Han
|
a0967e8ae7
|
Update __init__.py
|
2024-12-31 12:31:30 -08:00 |
|
Daniel Han
|
843cf8463f
|
Update __init__.py
|
2024-12-31 00:38:18 -08:00 |
|
Daniel Han
|
fc7190c9d6
|
Update __init__.py
|
2024-12-30 14:13:49 -08:00 |
|
Daniel Han
|
4d0bb213f0
|
Fix Triton heuristics
https://github.com/triton-lang/triton/issues/5224
|
2024-12-30 13:52:42 -08:00 |
|
Daniel Han
|
abad689731
|
Update __init__.py
|
2024-12-29 19:36:11 -08:00 |
|
Daniel Han
|
5ccba2ae6c
|
Update __init__.py
|
2024-12-29 19:35:05 -08:00 |
|
Daniel Han
|
4c036e0d24
|
Update pyproject.toml
|
2024-12-29 19:34:30 -08:00 |
|
Daniel Han
|
5cceec9d3e
|
Update __init__.py
|
2024-12-29 19:29:19 -08:00 |
|
Daniel Han
|
b95a001114
|
Merge branch 'main' into nightly
|
2024-12-29 03:58:02 -08:00 |
|
Daniel Han
|
05ec0debb5
|
Update _utils.py
|
2024-12-29 03:57:58 -08:00 |
|
Daniel Han
|
53973b0120
|
Bug fixes (#1484)
* Update save.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* print
* Update _utils.py
* Update _utils.py
* Update llama.py
* Update _utils.py
* Update vision.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update loader.py
* accurate_accumulation
* Update loader.py
* Update loader.py
* Update _utils.py
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Update pyproject.toml
|
2024-12-29 03:57:31 -08:00 |
|
Daniel Han
|
0513177143
|
Update pyproject.toml
|
2024-12-29 03:57:21 -08:00 |
|
Daniel Han
|
688616922f
|
Update loader.py
|
2024-12-29 03:53:46 -08:00 |
|
Daniel Han
|
5f3c1821c2
|
Update loader.py
|
2024-12-28 21:28:49 -08:00 |
|
Daniel Han
|
c7be72ca0a
|
Update loader.py
|
2024-12-28 18:02:00 -08:00 |
|
Daniel Han
|
6c6fc92674
|
Update loader.py
|
2024-12-28 03:29:58 -08:00 |
|
Daniel Han
|
98e89b7a3d
|
Update _utils.py
|
2024-12-28 03:24:18 -08:00 |
|
Daniel Han
|
0d84dcab22
|
Update loader.py
|
2024-12-28 03:21:41 -08:00 |
|
Daniel Han
|
9924e03c30
|
Update loader.py
|
2024-12-28 03:12:03 -08:00 |
|
Daniel Han
|
9f8d6d7774
|
accurate_accumulation
|
2024-12-28 03:11:53 -08:00 |
|
Daniel Han
|
be292e18cb
|
Update loader.py
|
2024-12-27 01:02:40 -08:00 |
|
Daniel Han
|
92ede4f28f
|
Update _utils.py
|
2024-12-27 00:59:16 -08:00 |
|
Daniel Han
|
28b7890c88
|
Update _utils.py
|
2024-12-27 00:54:12 -08:00 |
|
Daniel Han
|
04e82e570d
|
Update _utils.py
|
2024-12-27 00:33:41 -08:00 |
|
Daniel Han
|
48c0cb3f5b
|
Update _utils.py
|
2024-12-26 23:45:19 -08:00 |
|
Daniel Han
|
c6d8bfa434
|
Update _utils.py
|
2024-12-26 23:41:44 -08:00 |
|
Daniel Han
|
a98673c578
|
Update _utils.py
|
2024-12-26 23:37:25 -08:00 |
|
Daniel Han
|
9d389b1c2e
|
Update _utils.py
|
2024-12-26 23:35:15 -08:00 |
|
Daniel Han
|
43ef5c635f
|
Update _utils.py
|
2024-12-26 22:25:19 -08:00 |
|
Daniel Han
|
c669c87294
|
Update vision.py
|
2024-12-26 21:39:38 -08:00 |
|
Daniel Han
|
cb5c182bda
|
Update _utils.py
|
2024-12-26 19:30:49 -08:00 |
|
Daniel Han
|
7b95a76f16
|
Update llama.py
|
2024-12-26 19:16:58 -08:00 |
|
Daniel Han
|
a838f6ece6
|
Update _utils.py
|
2024-12-26 19:12:13 -08:00 |
|
Daniel Han
|
44c2a407ea
|
Update _utils.py
|
2024-12-26 19:12:02 -08:00 |
|
Daniel Han
|
75387306a1
|
print
|
2024-12-26 18:45:16 -08:00 |
|
Daniel Han
|
b2e429da3e
|
Update _utils.py
|
2024-12-26 18:21:30 -08:00 |
|
Daniel Han
|
2a6bc2ad10
|
Update _utils.py
|
2024-12-26 18:19:45 -08:00 |
|
Daniel Han
|
e01cb38c74
|
Update _utils.py
|
2024-12-26 18:12:52 -08:00 |
|
Daniel Han
|
f4f966c3b6
|
Update _utils.py
|
2024-12-26 17:11:22 -08:00 |
|
Daniel Han
|
e2d10ebdcc
|
Update save.py
|
2024-12-26 17:07:25 -08:00 |
|
Daniel Han
|
42a7ac3eff
|
Update pyproject.toml
|
2024-12-26 04:12:46 -08:00 |
|
Daniel Han
|
3d7f73029e
|
Update _utils.py
|
2024-12-26 04:05:07 -08:00 |
|
Daniel Han
|
9a50ffa01d
|
Update pyproject.toml
|
2024-12-26 04:04:23 -08:00 |
|
Daniel Han
|
c92891af06
|
Update pyproject.toml
|
2024-12-26 03:26:01 -08:00 |
|
Daniel Han
|
65485501bf
|
Merge branch 'main' into nightly
|
2024-12-26 01:44:31 -08:00 |
|
Daniel Han
|
1d42fb4f48
|
Update save.py
|
2024-12-26 01:44:12 -08:00 |
|
Daniel Han
|
4172d2cae8
|
Bug fixes (#1473)
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update llama.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Fix: cast logits to float32 in cross_entropy_forward to prevent errors (#1254)
* Fix: cast logits to float32 in cross_entropy_forward to prevent errors
* Update cross_entropy_loss.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Throw error when inferencing longer than max_popsition_embeddings (#1236)
* Throw error when inferencing longer than max_popsition_embeddings without rope scaling
* Update llama.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* CLI now handles user input strings for dtype correctly (#1235)
Co-authored-by: root <root@ieeres.chu.cam.ac.uk>
* Update flex_attention.py
* Update _utils.py
* Update _utils.py
* Update flex_attention.py
* Update flex_attention.py
* Update loader.py
* Update loader.py
* Update flex_attention.py
* Update flex_attention.py
* Update flex_attention.py
* Update flex_attention.py
* Update _utils.py
* Update cross_entropy_loss.py
* Update _utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* triton_cast
* Update utils.py
* Qwen 2.5 Coder
* Fix/export mistral (#1281)
* Enhance install_python_non_blocking to handle protobuf installation and process management
* Revert "Enhance install_python_non_blocking to handle protobuf installation and process management"
This reverts commit a3b796a05841fb8d93c652c845591e12cf81ea93.
* Set PROTOCOL_BUFFERS_PYTHON_IMPLEMENTATION to 'python' to address issue #1266
* Revert "Set PROTOCOL_BUFFERS_PYTHON_IMPLEMENTATION to 'python' to address issue #1266"
This reverts commit f00fbf5eac7ad4f5d48c70b98d770255d1a9ef58.
* Set PROTOCOL_BUFFERS_PYTHON_IMPLEMENTATION to 'python' to address issue #1266
* Update __init__.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* DOC Update - Update README.md with os.environ in example (#1269)
* Update README.md with os.environ in example
Added OS Environ in example to avoid device conflicts , for a user at least in jupyter notebook this allows to select GPU in a multi GPU setup.
As currently the unsloth init checks all GPU's and takes the first in the order which can be a issue when some GPU's are in use and the list still shows them. So to manually avoid this, this os config is required.
Small change but a bit time saver for those who straight away copies the tutorials
* Update README.md
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* fix/get_chat_template (#1246)
* Refactor `get_chat_template` to now support system message instead. It supposed to fix ollama tokenizer chattemplate to
* Remove type hinting
* Update chat_templates.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* fix/sft-trainer (#1276)
* Add patch for SFTTrainer to maintain backward compatibility with TRL changes
* Update trainer.py
* Update trainer.py
* Refactor trainer patch to maintain backward compatibility with TRL changes
* Update trainer.py
* Refactor trainer.py to exclude non-convertible trainers from backward compatibility patch
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update __init__.py
* Update trainer.py
* Update trainer.py
* Update trainer.py
* Update tokenizer_utils.py
* Update llama.py
* Fix #853
* fix/sfttrainer-compatibility (#1293)
* Refactor trainer.py to import SFTConfig directly and update UnslothTrainingArguments class inheritance
* Update trainer.py
* Update trainer.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update rms_layernorm.py
* Update rms_layernorm.py
* Gemma
* Update rms_layernorm.py
* Update gemma2.py
* Cut Cross Entropy
* Update llama.py
* Cut Cross Entropy
* Update llama.py
* Update llama.py
* Update llama.py
* Update __init__.py
* Update __init__.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update mapper.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* patch_fast_lora
* vision
* Update fast_lora.py
* Update _utils.py
* Update _utils.py
* Vision
* Update trainer.py
* Update save.py
* FastBaseVisionModel
* Update loader_utils.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update _utils.py
* tokenizer_name
* Update loader.py
* Update vision.py
* Update save.py
* Update save.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update _utils.py
* Update loader.py
* kwargs
* logits
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* error
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update loader.py
* Update llama.py
* Update vision.py
* Update loader.py
* Old torch versions
* Update loader.py
* Update loader.py
* prints
* recheck
* Update loader.py
* Update loader.py
* Update _utils.py
* Update _utils.py
* Update mapper.py
* Feat/kto (#1316)
* Add PatchKTOTrainer and update model imports
* Update dpo.py
* Update __init__.py
* Delete unsloth/models/kto.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Fix orpo/dpo trainer (#1286)
* change the colab notebook for dpo zephyr and orpo
* use original tokenizer
* Update README.md
* Update README.md
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* skip modules
* Update vision.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Fix llama.cpp
* Update save.py
* Update save.py
* Update vision.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update _utils.py
* Update save.py
* Update save.py
* Update mapper.py
* modules
* Fix vision model tokenizer padding side. (#1384)
* Dynamic quants (#1379)
* typing
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* int64
* Update _utils.py
* Update cross_entropy_loss.py
* constexpr
* constexpr
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* CE
* Update cross_entropy_loss.py
* Update _utils.py
* Update llama.py
* Update _utils.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update utils.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* Update rms_layernorm.py
* typing
* Update rope_embedding.py
* types
* Disable compiling
* Update _utils.py
* Update _utils.py
* Forward hook
* Update _utils.py
* Update llama.py
* Update _utils.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update pyproject.toml
* Update _utils.py
* Update llama.py
* CE Loss
* Update cross_entropy_loss.py
* Update _utils.py
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update cross_entropy_loss.py
* Update llama.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Fix: cast logits to float32 in cross_entropy_forward to prevent errors (#1254)
* Fix: cast logits to float32 in cross_entropy_forward to prevent errors
* Update cross_entropy_loss.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Throw error when inferencing longer than max_popsition_embeddings (#1236)
* Throw error when inferencing longer than max_popsition_embeddings without rope scaling
* Update llama.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* CLI now handles user input strings for dtype correctly (#1235)
Co-authored-by: root <root@ieeres.chu.cam.ac.uk>
* Update flex_attention.py
* Update _utils.py
* Update _utils.py
* Update flex_attention.py
* Update flex_attention.py
* Update loader.py
* Update loader.py
* Update flex_attention.py
* Update flex_attention.py
* Update flex_attention.py
* Update flex_attention.py
* Update _utils.py
* Update cross_entropy_loss.py
* Update _utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* triton_cast
* Update utils.py
* Qwen 2.5 Coder
* Fix/export mistral (#1281)
* Enhance install_python_non_blocking to handle protobuf installation and process management
* Revert "Enhance install_python_non_blocking to handle protobuf installation and process management"
This reverts commit a3b796a05841fb8d93c652c845591e12cf81ea93.
* Set PROTOCOL_BUFFERS_PYTHON_IMPLEMENTATION to 'python' to address issue #1266
* Revert "Set PROTOCOL_BUFFERS_PYTHON_IMPLEMENTATION to 'python' to address issue #1266"
This reverts commit f00fbf5eac7ad4f5d48c70b98d770255d1a9ef58.
* Set PROTOCOL_BUFFERS_PYTHON_IMPLEMENTATION to 'python' to address issue #1266
* Update __init__.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* DOC Update - Update README.md with os.environ in example (#1269)
* Update README.md with os.environ in example
Added OS Environ in example to avoid device conflicts , for a user at least in jupyter notebook this allows to select GPU in a multi GPU setup.
As currently the unsloth init checks all GPU's and takes the first in the order which can be a issue when some GPU's are in use and the list still shows them. So to manually avoid this, this os config is required.
Small change but a bit time saver for those who straight away copies the tutorials
* Update README.md
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* fix/get_chat_template (#1246)
* Refactor `get_chat_template` to now support system message instead. It supposed to fix ollama tokenizer chattemplate to
* Remove type hinting
* Update chat_templates.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* fix/sft-trainer (#1276)
* Add patch for SFTTrainer to maintain backward compatibility with TRL changes
* Update trainer.py
* Update trainer.py
* Refactor trainer patch to maintain backward compatibility with TRL changes
* Update trainer.py
* Refactor trainer.py to exclude non-convertible trainers from backward compatibility patch
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update __init__.py
* Update trainer.py
* Update trainer.py
* Update trainer.py
* Update tokenizer_utils.py
* Update llama.py
* Fix #853
* fix/sfttrainer-compatibility (#1293)
* Refactor trainer.py to import SFTConfig directly and update UnslothTrainingArguments class inheritance
* Update trainer.py
* Update trainer.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update rms_layernorm.py
* Update rms_layernorm.py
* Gemma
* Update rms_layernorm.py
* Update gemma2.py
* Cut Cross Entropy
* Update llama.py
* Cut Cross Entropy
* Update llama.py
* Update llama.py
* Update llama.py
* Update __init__.py
* Update __init__.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update mapper.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* patch_fast_lora
* vision
* Update fast_lora.py
* Update _utils.py
* Update _utils.py
* Vision
* Update trainer.py
* Update save.py
* FastBaseVisionModel
* Update loader_utils.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update loader.py
* Update vision.py
* Update _utils.py
* tokenizer_name
* Update loader.py
* Update vision.py
* Update save.py
* Update save.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update vision.py
* Update _utils.py
* Update loader.py
* kwargs
* logits
* Update llama.py
* Update llama.py
* Update llama.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* error
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update loader.py
* Update llama.py
* Update vision.py
* Update loader.py
* Old torch versions
* Update loader.py
* Update loader.py
* prints
* recheck
* Update loader.py
* Update loader.py
* Update _utils.py
* Update _utils.py
* Update mapper.py
* Feat/kto (#1316)
* Add PatchKTOTrainer and update model imports
* Update dpo.py
* Update __init__.py
* Delete unsloth/models/kto.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Fix orpo/dpo trainer (#1286)
* change the colab notebook for dpo zephyr and orpo
* use original tokenizer
* Update README.md
* Update README.md
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* skip modules
* Update vision.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Fix llama.cpp
* Update save.py
* Update save.py
* Update vision.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update save.py
* Update _utils.py
* Update save.py
* Update save.py
* Update mapper.py
* modules
---------
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Datta Nimmaturi <datta.nimmaturi@nutanix.com>
Co-authored-by: Edwin Fennell <edwinfennell1@gmail.com>
Co-authored-by: root <root@ieeres.chu.cam.ac.uk>
Co-authored-by: Uday Girish Maradana <einsteingirish@gmail.com>
Co-authored-by: cell-dame <122996026+dame-cell@users.noreply.github.com>
* Update README.md
Unsloth Dynamic 4-bit Quantization Update
* Fix vision model tokenizer padding side.
* Update vision.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Datta Nimmaturi <datta.nimmaturi@nutanix.com>
Co-authored-by: Edwin Fennell <edwinfennell1@gmail.com>
Co-authored-by: root <root@ieeres.chu.cam.ac.uk>
Co-authored-by: Uday Girish Maradana <einsteingirish@gmail.com>
Co-authored-by: cell-dame <122996026+dame-cell@users.noreply.github.com>
Co-authored-by: Michael Han <107991372+shimmyshimmer@users.noreply.github.com>
* Add citation section to README.md (#1377)
* Add citation section to README.md
* Update README.md
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Granite support (#1218)
* [WIP] Support for Granite
* Fixup inference
* Cleanup flex attention
* remove sliding window
* Use torch.add for residual multiplier
* Llama 3.3
* Update llama.py
* Update llama.py
* fullgraph
* Fix loader.py to work on Windows (#1453)
* Update README.md
Llama 3.3 + Reddit
* Update README.md
Apple ML Cross Entropy
* Update README.md
Removing double citation
* Fix loader.py to work on Windows
---------
Co-authored-by: Michael Han <107991372+shimmyshimmer@users.noreply.github.com>
* Update save.py warning message (#1425)
* Update README.md
Llama 3.3 + Reddit
* Update README.md
Apple ML Cross Entropy
* Update README.md
Removing double citation
* Update save.py warning message
---------
Co-authored-by: Michael Han <107991372+shimmyshimmer@users.noreply.github.com>
* Change _fix_chat_template in case a template has both endif and endfor (#1388)
* Update llama and derivatives to pass position embeddings explicitly for transformers v4.47+ (#1442)
* Update save.py
* Update llama.py
* Update mistral.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Temp fix
* Update _utils.py
* Update _utils.py
* Update pyproject.toml
* Name Error Bug Fix - import from packaging.version import Version (#1468)
* Version
* Update pyproject.toml
* Update pyproject.toml
* Version
* Update pyproject.toml
* Update pyproject.toml
* dependencies
* Update pyproject.toml
* Update pyproject.toml
* Update pyproject.toml
* Update pyproject.toml
* Update mistral.py
* Update pyproject.toml
* Update pyproject.toml
* Update pyproject.toml
* Update granite.py
* Update cohere.py
* Triton windows
* Update gemma2.py
* Update pyproject.toml
* Update _utils.py
* Update pyproject.toml
* Residual & LoRA
* Update loader.py
* Update loader.py
* Update loader.py
* Update loader.py
* Bug fix
* Update loader.py
* Update loader.py
* Update loader.py
* Update _utils.py
* Update loader.py
---------
Co-authored-by: Edd <68678137+Erland366@users.noreply.github.com>
Co-authored-by: Datta Nimmaturi <datta.nimmaturi@nutanix.com>
Co-authored-by: Edwin Fennell <edwinfennell1@gmail.com>
Co-authored-by: root <root@ieeres.chu.cam.ac.uk>
Co-authored-by: Uday Girish Maradana <einsteingirish@gmail.com>
Co-authored-by: cell-dame <122996026+dame-cell@users.noreply.github.com>
Co-authored-by: Zewen Shen <zewen.public@gmail.com>
Co-authored-by: Michael Han <107991372+shimmyshimmer@users.noreply.github.com>
Co-authored-by: Scott Phillips <polygonguru@gmail.com>
Co-authored-by: qingy1337 <qxli2@students.everettcc.edu>
Co-authored-by: Giulia Baldini <44327645+giuliabaldini@users.noreply.github.com>
Co-authored-by: Yonghye Kwon <developer.0hye@gmail.com>
|
2024-12-26 01:35:19 -08:00 |
|