|
__init__.py
|
Formatting & bug fixes (#3563)
|
2025-11-07 06:00:22 -08:00 |
|
dpo.py
|
Formatting & bug fixes (#3563)
|
2025-11-07 06:00:22 -08:00 |
|
llama4.py
|
Qwen 3
|
2025-05-02 03:09:44 -07:00 |
|
loader.py
|
Keep 4bit flag for fast_inference
|
2026-01-04 13:18:15 +00:00 |
|
mapper.py
|
FunctionGemma
|
2025-12-18 09:27:46 -08:00 |
|
qwen3.py
|
SFT sample packing (#3566)
|
2025-12-09 17:36:45 -08:00 |
|
rl.py
|
use non lora model as base for RL
|
2026-01-15 11:23:21 +00:00 |
|
rl_replacements.py
|
Revert rl_replacements GRPO edits
|
2026-01-05 13:55:08 +00:00 |
|
vision.py
|
Respect user quantization_config
|
2026-01-04 13:03:06 +00:00 |