Daniel Han
|
407011c7ba
|
Update rl_replacements.py
|
2025-02-14 04:53:06 -08:00 |
|
Daniel Han
|
2642c167b3
|
Update rl_replacements.py
|
2025-02-14 04:49:41 -08:00 |
|
Daniel Han
|
9b773201f2
|
Update rl_replacements.py
|
2025-02-14 04:45:48 -08:00 |
|
Daniel Han
|
705fd769a3
|
Update rl.py
|
2025-02-14 04:44:03 -08:00 |
|
Daniel Han
|
6d1991df1d
|
Update rl.py
|
2025-02-14 04:42:05 -08:00 |
|
Daniel Han
|
3a9b3cac9a
|
Update rl.py
|
2025-02-14 04:38:03 -08:00 |
|
Daniel Han
|
4d8cc00592
|
Update rl.py
|
2025-02-14 04:35:03 -08:00 |
|
Daniel Han
|
f0c45aa818
|
Update rl_replacements.py
|
2025-02-14 04:33:41 -08:00 |
|
Daniel Han
|
50a3b1d6d7
|
Update rl_replacements.py
|
2025-02-14 04:32:24 -08:00 |
|
Daniel Han
|
4cce7ce242
|
Update rl.py
|
2025-02-14 04:31:27 -08:00 |
|
Daniel Han
|
b94841cd75
|
GRPO optimized
|
2025-02-14 04:30:15 -08:00 |
|
Daniel Han
|
4a72130fc7
|
Merge branch 'main' into nightly
|
2025-02-13 22:18:26 -08:00 |
|
Daniel Han
|
c51f8b41db
|
Fix bugs (#1706)
* Bug fixes
* fix: flash_attn_detection_error (#1556)
* fix: flash_attn_detection_error
* Update _utils.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update mapper.py
* Update gemma.py
* Update gemma.py
* Update gemma.py
* Update gemma.py
* dim fix
* Update _utils.py
* Torch 2.6 support
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Faster inference?
* Update llama.py
* Update llama.py
* Update utils.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update mapper.py
* Fast Inference via vLLM
* Update llama.py
* Update llama.py
* Update utils.py
* Create rl.py
* PatchRL
* Update rl.py
* Update rl.py
* Update rl.py
* PatchRLStatistics
* Update rl.py
* Update rl.py
* Update rl.py
* Update utils.py
* Update utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* RL metrics
* Update rl.py
* RL metrics
* Update __init__.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update chat_templates.py
* Update mapper.py
* Fp8 cache
* Update llama.py
* Update llama.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update __init__.py
* Update loader.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Better TRL handling
* Update rl.py
* Update tokenizer_utils.py
* Auto patching
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* max seq length
* Update rl.py
* Update rl.py
* Patching
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* NEFTune
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Extra replacements
* Update rl_replacements.py
* Update rl.py
* extra RL replacements
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update _utils.py
* Update loader_utils.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* autocast
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update pyproject.toml
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update _utils.py
* Update llama.py
* Update _utils.py
* Update rl_replacements.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
---------
Co-authored-by: Zhe Zhang <2631992879@qq.com>
|
2025-02-13 19:12:19 -08:00 |
|
Daniel Han
|
47892d60d7
|
Update llama.py
|
2025-02-13 19:11:38 -08:00 |
|
Daniel Han
|
2e7a3c5118
|
Update llama.py
|
2025-02-13 17:25:12 -08:00 |
|
Daniel Han
|
8c88b29d74
|
Update llama.py
|
2025-02-13 17:22:39 -08:00 |
|
Daniel Han
|
60bcf68a07
|
Update llama.py
|
2025-02-13 17:18:42 -08:00 |
|
Daniel Han
|
b53617e6cf
|
Update rl_replacements.py
|
2025-02-13 17:15:29 -08:00 |
|
Daniel Han
|
db6d4e0fb7
|
Update llama.py
|
2025-02-13 17:12:06 -08:00 |
|
Daniel Han
|
0d387cbb77
|
Update llama.py
|
2025-02-13 17:11:33 -08:00 |
|
Daniel Han
|
100f2a3242
|
Update llama.py
|
2025-02-13 17:05:04 -08:00 |
|
Daniel Han
|
a899e9a9f1
|
Update llama.py
|
2025-02-13 17:00:14 -08:00 |
|
Daniel Han
|
1e0ebd3761
|
Update rl.py
|
2025-02-13 16:47:27 -08:00 |
|
Daniel Han
|
8fa29e2751
|
Update rl.py
|
2025-02-13 16:38:21 -08:00 |
|
Daniel Han
|
ce95b13c0a
|
Update rl.py
|
2025-02-13 16:37:05 -08:00 |
|
Daniel Han
|
4c520db499
|
Update rl.py
|
2025-02-13 16:35:09 -08:00 |
|
Daniel Han
|
680384fa57
|
Update rl.py
|
2025-02-13 16:27:23 -08:00 |
|
Daniel Han
|
81b1cc3a22
|
Update rl_replacements.py
|
2025-02-13 16:27:02 -08:00 |
|
Daniel Han
|
bf933c7661
|
Update _utils.py
|
2025-02-13 16:23:51 -08:00 |
|
Daniel Han
|
1d7d59fded
|
Update llama.py
|
2025-02-13 16:11:51 -08:00 |
|
Daniel Han
|
3ac3cd2b72
|
Merge branch 'main' into nightly
|
2025-02-13 15:14:35 -08:00 |
|
Daniel Han
|
aaa29ff83f
|
Update _utils.py
|
2025-02-13 15:14:17 -08:00 |
|
Daniel Han
|
9a19723c89
|
Update pyproject.toml
|
2025-02-13 15:13:55 -08:00 |
|
Daniel Han
|
b236867192
|
Merge branch 'main' into nightly
|
2025-02-13 15:02:56 -08:00 |
|
Daniel Han
|
34969ca1e1
|
Update rl.py
|
2025-02-13 15:02:50 -08:00 |
|
Daniel Han
|
3a25f4e02e
|
Merge branch 'main' into nightly
|
2025-02-13 14:59:59 -08:00 |
|
Daniel Han
|
3a2dbad375
|
Update _utils.py
|
2025-02-13 14:59:52 -08:00 |
|
Daniel Han
|
9687e7fdab
|
Update dpo.py
|
2025-02-13 14:59:42 -08:00 |
|
Daniel Han
|
4dc044808f
|
Merge branch 'main' into nightly
|
2025-02-13 14:57:58 -08:00 |
|
Daniel Han
|
49bdb690e9
|
Update __init__.py
|
2025-02-13 14:55:14 -08:00 |
|
Daniel Han
|
5826e5855f
|
Update _utils.py
|
2025-02-13 14:54:49 -08:00 |
|
Daniel Han
|
47b81fdd23
|
Fix bugs (#1701)
* Phi 4
* Update llama.py
* Torch.Cuda Is Available Condition and Warning (#1545)
* check for torch.cuda and triton if available
on my machine(mac m3) the cuda were not available
* Update pyproject.toml
* Update __init__.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update mistral.py
* Update mistral.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Update _utils.py
* Fix
* Bug fixes
* Update mapper.py
* Add dropout to granite to match HF's implementation (#1557)
Signed-off-by: datta0 <venkatadattasainimmaturi@gmail.com>
* Update llama.py
* Update llama.py
* Bug fixes
* fix: flash_attn_detection_error (#1556)
* fix: flash_attn_detection_error
* Update _utils.py
---------
Co-authored-by: Daniel Han <danielhanchen@gmail.com>
* Update mapper.py
* Update gemma.py
* Update gemma.py
* Update gemma.py
* Update gemma.py
* dim fix
* Update _utils.py
* Torch 2.6 support
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Faster inference?
* Update llama.py
* Update llama.py
* Update utils.py
* Update llama.py
* Update llama.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update utils.py
* Update mapper.py
* Fast Inference via vLLM
* Update llama.py
* Update llama.py
* Update utils.py
* Create rl.py
* PatchRL
* Update rl.py
* Update rl.py
* Update rl.py
* PatchRLStatistics
* Update rl.py
* Update rl.py
* Update rl.py
* Update utils.py
* Update utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* RL metrics
* Update rl.py
* RL metrics
* Update __init__.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update chat_templates.py
* Update mapper.py
* Fp8 cache
* Update llama.py
* Update llama.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update __init__.py
* Update loader.py
* Update rl.py
* Update rl.py
* Update _utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Better TRL handling
* Update rl.py
* Update tokenizer_utils.py
* Auto patching
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update tokenizer_utils.py
* Update rl.py
* Update rl.py
* Update rl.py
* max seq length
* Update rl.py
* Update rl.py
* Patching
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* NEFTune
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Update rl.py
* Extra replacements
* Update rl_replacements.py
* Update rl.py
* extra RL replacements
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update _utils.py
* Update loader_utils.py
* Update rl.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* autocast
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update pyproject.toml
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update rl_replacements.py
* Update llama.py
* Update _utils.py
---------
Signed-off-by: datta0 <venkatadattasainimmaturi@gmail.com>
Co-authored-by: AminWhat <88392440+aminwhat@users.noreply.github.com>
Co-authored-by: Datta Nimmaturi <datta.nimmaturi@nutanix.com>
Co-authored-by: Zhe Zhang <2631992879@qq.com>
|
2025-02-13 14:50:44 -08:00 |
|
Daniel Han
|
8eb45ec7a8
|
Update _utils.py
|
2025-02-13 14:47:54 -08:00 |
|
Daniel Han
|
8034edf925
|
Update llama.py
|
2025-02-13 14:42:38 -08:00 |
|
Daniel Han
|
aa3df04412
|
Merge branch 'main' into nightly
|
2025-02-13 14:40:49 -08:00 |
|
Daniel Han
|
0287d03414
|
Update rl_replacements.py
|
2025-02-13 04:44:21 -08:00 |
|
Daniel Han
|
18fe5aa01a
|
Update rl_replacements.py
|
2025-02-13 04:40:53 -08:00 |
|
Daniel Han
|
cedb6c15d9
|
Update rl_replacements.py
|
2025-02-13 04:40:42 -08:00 |
|
Daniel Han
|
c8b303ea5b
|
Update rl_replacements.py
|
2025-02-13 04:34:13 -08:00 |
|
Daniel Han
|
19a0c3fe32
|
Update rl_replacements.py
|
2025-02-13 04:25:56 -08:00 |
|