From cb741f82327860ccc7baf1dc07cb13f26d5ddbd5 Mon Sep 17 00:00:00 2001 From: Roland Tannous Date: Mon, 9 Mar 2026 09:54:52 +0000 Subject: [PATCH] add trust_remote_code defaults to all model configs --- studio/backend/assets/configs/model_defaults/default.yaml | 2 ++ .../model_defaults/ernie/unsloth_ERNIE-4.5-21B-A3B-PT.yaml | 3 +++ .../model_defaults/ernie/unsloth_ERNIE-4.5-VL-28B-A3B-PT.yaml | 2 ++ .../model_defaults/falcon/tiiuae_Falcon-H1-0.5B-Instruct.yaml | 3 +++ .../model_defaults/gemma/unsloth_codegemma-7b-bnb-4bit.yaml | 2 ++ .../model_defaults/gemma/unsloth_functiongemma-270m-it.yaml | 2 ++ .../model_defaults/gemma/unsloth_gemma-2-27b-bnb-4bit.yaml | 3 +++ .../configs/model_defaults/gemma/unsloth_gemma-2-2b.yaml | 3 +++ .../configs/model_defaults/gemma/unsloth_gemma-3-270m-it.yaml | 2 ++ .../configs/model_defaults/gemma/unsloth_gemma-3-27b-it.yaml | 2 ++ .../configs/model_defaults/gemma/unsloth_gemma-3-4b-it.yaml | 2 ++ .../configs/model_defaults/gemma/unsloth_gemma-3-4b-pt.yaml | 2 ++ .../configs/model_defaults/gemma/unsloth_gemma-3n-E4B-it.yaml | 2 ++ .../configs/model_defaults/gemma/unsloth_gemma-3n-E4B.yaml | 2 ++ .../configs/model_defaults/gpt-oss/unsloth_gpt-oss-120b.yaml | 2 ++ .../configs/model_defaults/gpt-oss/unsloth_gpt-oss-20b.yaml | 2 ++ .../granite/unsloth_granite-4.0-350m-unsloth-bnb-4bit.yaml | 2 ++ .../model_defaults/granite/unsloth_granite-4.0-h-micro.yaml | 2 ++ .../llama/unsloth_Llama-3.2-11B-Vision-Instruct.yaml | 2 ++ .../model_defaults/llama/unsloth_Llama-3.2-1B-Instruct.yaml | 3 +++ .../model_defaults/llama/unsloth_Llama-3.2-3B-Instruct.yaml | 2 ++ .../model_defaults/llama/unsloth_Llama-3.3-70B-Instruct.yaml | 2 ++ .../llama/unsloth_Meta-Llama-3.1-70B-bnb-4bit.yaml | 3 +++ .../llama/unsloth_Meta-Llama-3.1-8B-Instruct-bnb-4bit.yaml | 4 +++- .../llama/unsloth_llama-3-8b-Instruct-bnb-4bit.yaml | 3 +++ .../model_defaults/llama/unsloth_llama-3-8b-bnb-4bit.yaml | 3 +++ .../assets/configs/model_defaults/llasa/unsloth_Llasa-3B.yaml | 2 ++ .../unsloth_Magistral-Small-2509-unsloth-bnb-4bit.yaml | 2 ++ .../mistral/unsloth_Ministral-3-3B-Instruct-2512.yaml | 2 ++ .../mistral/unsloth_Mistral-Nemo-Base-2407-bnb-4bit.yaml | 4 +++- .../mistral/unsloth_Mistral-Small-Instruct-2409.yaml | 3 +++ .../model_defaults/mistral/unsloth_Pixtral-12B-2409.yaml | 2 ++ .../mistral/unsloth_mistral-7b-instruct-v0.3-bnb-4bit.yaml | 4 +++- .../mistral/unsloth_mistral-7b-v0.3-bnb-4bit.yaml | 4 +++- .../model_defaults/other/OuteAI_Llama-OuteTTS-1.0-1B.yaml | 2 ++ .../configs/model_defaults/other/Spark-TTS-0.5B_LLM.yaml | 2 ++ .../assets/configs/model_defaults/other/sesame_csm-1b.yaml | 3 +++ .../configs/model_defaults/other/unsloth_GLM-4.7-Flash.yaml | 2 ++ .../configs/model_defaults/other/unsloth_LFM2-1.2B.yaml | 2 ++ .../model_defaults/other/unsloth_Nemotron-3-Nano-30B-A3B.yaml | 2 ++ .../configs/model_defaults/other/unsloth_PaddleOCR-VL.yaml | 2 ++ .../other/unsloth_answerdotai_ModernBERT-large.yaml | 3 +++ .../model_defaults/other/unsloth_orpheus-3b-0.1-ft.yaml | 2 ++ .../model_defaults/other/unsloth_tinyllama-bnb-4bit.yaml | 3 +++ .../model_defaults/other/unsloth_whisper-large-v3.yaml | 3 +++ .../model_defaults/phi/unsloth_Phi-3-medium-4k-instruct.yaml | 4 +++- .../model_defaults/phi/unsloth_Phi-3.5-mini-instruct.yaml | 4 +++- .../assets/configs/model_defaults/phi/unsloth_Phi-4.yaml | 2 ++ .../qwen/imdatta0_tiny_qwen3_moe_2.8B_0.7B.yaml | 2 ++ .../assets/configs/model_defaults/qwen/unsloth_Qwen2-7B.yaml | 3 +++ .../model_defaults/qwen/unsloth_Qwen2-VL-7B-Instruct.yaml | 2 ++ .../model_defaults/qwen/unsloth_Qwen2.5-1.5B-Instruct.yaml | 3 +++ .../configs/model_defaults/qwen/unsloth_Qwen2.5-7B.yaml | 3 +++ .../qwen/unsloth_Qwen2.5-Coder-1.5B-Instruct.yaml | 3 +++ .../qwen/unsloth_Qwen2.5-Coder-14B-Instruct.yaml | 2 ++ .../qwen/unsloth_Qwen2.5-Coder-7B-Instruct-bnb-4bit.yaml | 3 +++ .../qwen/unsloth_Qwen2.5-VL-7B-Instruct-bnb-4bit.yaml | 2 ++ .../configs/model_defaults/qwen/unsloth_Qwen3-0.6B.yaml | 2 ++ .../qwen/unsloth_Qwen3-14B-Base-unsloth-bnb-4bit.yaml | 2 ++ .../assets/configs/model_defaults/qwen/unsloth_Qwen3-14B.yaml | 2 ++ .../qwen/unsloth_Qwen3-30B-A3B-Instruct-2507.yaml | 2 ++ .../assets/configs/model_defaults/qwen/unsloth_Qwen3-32B.yaml | 2 ++ .../model_defaults/qwen/unsloth_Qwen3-4B-Instruct-2507.yaml | 2 ++ .../model_defaults/qwen/unsloth_Qwen3-4B-Thinking-2507.yaml | 2 ++ .../qwen/unsloth_Qwen3-VL-8B-Instruct-unsloth-bnb-4bit.yaml | 2 ++ 65 files changed, 154 insertions(+), 6 deletions(-) diff --git a/studio/backend/assets/configs/model_defaults/default.yaml b/studio/backend/assets/configs/model_defaults/default.yaml index ceb332bc14..d96e5077b2 100644 --- a/studio/backend/assets/configs/model_defaults/default.yaml +++ b/studio/backend/assets/configs/model_defaults/default.yaml @@ -2,6 +2,7 @@ # Used for models without specific configurations training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -47,6 +48,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.7 top_p: 0.95 top_k: -1 diff --git a/studio/backend/assets/configs/model_defaults/ernie/unsloth_ERNIE-4.5-21B-A3B-PT.yaml b/studio/backend/assets/configs/model_defaults/ernie/unsloth_ERNIE-4.5-21B-A3B-PT.yaml index dc2f12837a..52511c6eaf 100644 --- a/studio/backend/assets/configs/model_defaults/ernie/unsloth_ERNIE-4.5-21B-A3B-PT.yaml +++ b/studio/backend/assets/configs/model_defaults/ernie/unsloth_ERNIE-4.5-21B-A3B-PT.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/ERNIE-4.5-21B-A3B-PT training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/ernie/unsloth_ERNIE-4.5-VL-28B-A3B-PT.yaml b/studio/backend/assets/configs/model_defaults/ernie/unsloth_ERNIE-4.5-VL-28B-A3B-PT.yaml index 1032449e8c..524a723dc2 100644 --- a/studio/backend/assets/configs/model_defaults/ernie/unsloth_ERNIE-4.5-VL-28B-A3B-PT.yaml +++ b/studio/backend/assets/configs/model_defaults/ernie/unsloth_ERNIE-4.5-VL-28B-A3B-PT.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: true max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -48,6 +49,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: true temperature: 1.5 min_p: 0.1 diff --git a/studio/backend/assets/configs/model_defaults/falcon/tiiuae_Falcon-H1-0.5B-Instruct.yaml b/studio/backend/assets/configs/model_defaults/falcon/tiiuae_Falcon-H1-0.5B-Instruct.yaml index 06b283c480..c45b71b4ae 100644 --- a/studio/backend/assets/configs/model_defaults/falcon/tiiuae_Falcon-H1-0.5B-Instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/falcon/tiiuae_Falcon-H1-0.5B-Instruct.yaml @@ -3,6 +3,7 @@ # Also applies to: tiiuae/Falcon-H1-0.5B-Instruct, unsloth/Falcon-H1-0.5B-Instruct training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_codegemma-7b-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_codegemma-7b-bnb-4bit.yaml index 251409c29d..62836dc0cd 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_codegemma-7b-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_codegemma-7b-bnb-4bit.yaml @@ -4,6 +4,7 @@ # added inference parameters from Ollama training: + trust_remote_code: false max_seq_length: 4096 # num_epochs: 4 num_epochs: 0 @@ -44,5 +45,6 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0 top_p: 0.9 diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_functiongemma-270m-it.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_functiongemma-270m-it.yaml index 89b1d7f938..f97a842d2a 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_functiongemma-270m-it.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_functiongemma-270m-it.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 4096 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.0 top_k: 64 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-2-27b-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-2-27b-bnb-4bit.yaml index ba50f7d1f8..56f10cdc4f 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-2-27b-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-2-27b-bnb-4bit.yaml @@ -2,6 +2,7 @@ # Based on Gemma2_(9B)-Alpaca.ipynb (same defaults for larger models) training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -41,3 +42,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-2-2b.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-2-2b.yaml index 413e7465d3..f8f78f5edc 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-2-2b.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-2-2b.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/gemma-2-2b-bnb-4bit, google/gemma-2-2b training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-270m-it.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-270m-it.yaml index bda5471643..455407abf8 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-270m-it.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-270m-it.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.0 top_k: 64 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-27b-it.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-27b-it.yaml index 18392568bd..2bcdf67c15 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-27b-it.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-27b-it.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,6 +43,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.0 top_k: 64 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-4b-it.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-4b-it.yaml index 434ac41b46..7c123da0b8 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-4b-it.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-4b-it.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,6 +43,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.0 top_k: 64 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-4b-pt.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-4b-pt.yaml index 5f0a7b26ce..492c42812e 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-4b-pt.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3-4b-pt.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 2 num_epochs: 0 @@ -42,6 +43,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.0 top_k: 64 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3n-E4B-it.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3n-E4B-it.yaml index dd5ae51ab0..23d00df752 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3n-E4B-it.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3n-E4B-it.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 1024 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: audio_input: true inference: + trust_remote_code: false temperature: 1.0 top_k: 64 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3n-E4B.yaml b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3n-E4B.yaml index e53e163a04..bf5e111b7d 100644 --- a/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3n-E4B.yaml +++ b/studio/backend/assets/configs/model_defaults/gemma/unsloth_gemma-3n-E4B.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 2 num_epochs: 0 @@ -44,6 +45,7 @@ logging: audio_input: true inference: + trust_remote_code: false temperature: 1.0 top_k: 64 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/gpt-oss/unsloth_gpt-oss-120b.yaml b/studio/backend/assets/configs/model_defaults/gpt-oss/unsloth_gpt-oss-120b.yaml index e2d67bcb0b..bd39e70a96 100644 --- a/studio/backend/assets/configs/model_defaults/gpt-oss/unsloth_gpt-oss-120b.yaml +++ b/studio/backend/assets/configs/model_defaults/gpt-oss/unsloth_gpt-oss-120b.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 4096 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.0 top_p: 1.0 top_k: 0 diff --git a/studio/backend/assets/configs/model_defaults/gpt-oss/unsloth_gpt-oss-20b.yaml b/studio/backend/assets/configs/model_defaults/gpt-oss/unsloth_gpt-oss-20b.yaml index aa436117a1..839e9a5b75 100644 --- a/studio/backend/assets/configs/model_defaults/gpt-oss/unsloth_gpt-oss-20b.yaml +++ b/studio/backend/assets/configs/model_defaults/gpt-oss/unsloth_gpt-oss-20b.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 1024 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.0 top_p: 1.0 top_k: 0 diff --git a/studio/backend/assets/configs/model_defaults/granite/unsloth_granite-4.0-350m-unsloth-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/granite/unsloth_granite-4.0-350m-unsloth-bnb-4bit.yaml index 3f2cb84a94..9557fc296f 100644 --- a/studio/backend/assets/configs/model_defaults/granite/unsloth_granite-4.0-350m-unsloth-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/granite/unsloth_granite-4.0-350m-unsloth-bnb-4bit.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -46,6 +47,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.0 top_p: 1.0 top_k: 0 diff --git a/studio/backend/assets/configs/model_defaults/granite/unsloth_granite-4.0-h-micro.yaml b/studio/backend/assets/configs/model_defaults/granite/unsloth_granite-4.0-h-micro.yaml index ab756fe764..ce73c6a8ee 100644 --- a/studio/backend/assets/configs/model_defaults/granite/unsloth_granite-4.0-h-micro.yaml +++ b/studio/backend/assets/configs/model_defaults/granite/unsloth_granite-4.0-h-micro.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -46,6 +47,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.0 top_p: 1.0 top_k: 0 diff --git a/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-11B-Vision-Instruct.yaml b/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-11B-Vision-Instruct.yaml index 1a7a91e56f..d9a75c391d 100644 --- a/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-11B-Vision-Instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-11B-Vision-Instruct.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,6 +43,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.5 min_p: 0.1 diff --git a/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-1B-Instruct.yaml b/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-1B-Instruct.yaml index 53e82c5609..3938f10627 100644 --- a/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-1B-Instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-1B-Instruct.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/Llama-3.2-1B-Instruct-unsloth-bnb-4bit, meta-llama/Llama-3.2-1B-Instruct, unsloth/Llama-3.2-1B-Instruct-bnb-4bit, RedHatAI/Llama-3.2-1B-Instruct-FP8, unsloth/Llama-3.2-1B-Instruct-FP8-Block, unsloth/Llama-3.2-1B-Instruct-FP8-Dynamic training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 5 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-3B-Instruct.yaml b/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-3B-Instruct.yaml index f73b0c09b6..82091c7d35 100644 --- a/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-3B-Instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.2-3B-Instruct.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.5 min_p: 0.1 diff --git a/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.3-70B-Instruct.yaml b/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.3-70B-Instruct.yaml index ffefb29e24..5a014a63bf 100644 --- a/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.3-70B-Instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/llama/unsloth_Llama-3.3-70B-Instruct.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.5 min_p: 0.1 diff --git a/studio/backend/assets/configs/model_defaults/llama/unsloth_Meta-Llama-3.1-70B-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/llama/unsloth_Meta-Llama-3.1-70B-bnb-4bit.yaml index 5f9da41a95..885f7b47fd 100644 --- a/studio/backend/assets/configs/model_defaults/llama/unsloth_Meta-Llama-3.1-70B-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/llama/unsloth_Meta-Llama-3.1-70B-bnb-4bit.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/Meta-Llama-3.1-8B-bnb-4bit, unsloth/Meta-Llama-3.1-8B-unsloth-bnb-4bit, meta-llama/Meta-Llama-3.1-8B, unsloth/Meta-Llama-3.1-8B, unsloth/Meta-Llama-3.1-70B, meta-llama/Meta-Llama-3.1-70B, unsloth/Meta-Llama-3.1-405B-bnb-4bit, meta-llama/Meta-Llama-3.1-405B training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/llama/unsloth_Meta-Llama-3.1-8B-Instruct-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/llama/unsloth_Meta-Llama-3.1-8B-Instruct-bnb-4bit.yaml index d20470b0a3..1ff06cca6f 100644 --- a/studio/backend/assets/configs/model_defaults/llama/unsloth_Meta-Llama-3.1-8B-Instruct-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/llama/unsloth_Meta-Llama-3.1-8B-Instruct-bnb-4bit.yaml @@ -3,6 +3,7 @@ # Also applies to: "unsloth/Meta-Llama-3.1-8B-Instruct-unsloth-bnb-4bit", "meta-llama/Meta-Llama-3.1-8B-Instruct", "unsloth/Meta-Llama-3.1-8B-Instruct","RedHatAI/Llama-3.1-8B-Instruct-FP8","unsloth/Llama-3.1-8B-Instruct-FP8-Block","unsloth/Llama-3.1-8B-Instruct-FP8-Dynamic" training: + trust_remote_code: false max_seq_length: 8192 # num_epochs: 4 num_epochs: 0 @@ -42,4 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 - +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/llama/unsloth_llama-3-8b-Instruct-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/llama/unsloth_llama-3-8b-Instruct-bnb-4bit.yaml index 1956495f7d..95ee5ead5c 100644 --- a/studio/backend/assets/configs/model_defaults/llama/unsloth_llama-3-8b-Instruct-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/llama/unsloth_llama-3-8b-Instruct-bnb-4bit.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/llama-3-8b-Instruct, meta-llama/Meta-Llama-3-8B-Instruct training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/llama/unsloth_llama-3-8b-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/llama/unsloth_llama-3-8b-bnb-4bit.yaml index 15869497b7..a05ac86f43 100644 --- a/studio/backend/assets/configs/model_defaults/llama/unsloth_llama-3-8b-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/llama/unsloth_llama-3-8b-bnb-4bit.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/llama-3-8b, meta-llama/Meta-Llama-3-8B training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/llasa/unsloth_Llasa-3B.yaml b/studio/backend/assets/configs/model_defaults/llasa/unsloth_Llasa-3B.yaml index 6bba9c9633..1f473c3af1 100644 --- a/studio/backend/assets/configs/model_defaults/llasa/unsloth_Llasa-3B.yaml +++ b/studio/backend/assets/configs/model_defaults/llasa/unsloth_Llasa-3B.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -39,6 +40,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.2 top_p: 1.2 diff --git a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Magistral-Small-2509-unsloth-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Magistral-Small-2509-unsloth-bnb-4bit.yaml index f9833ce705..5a53bb52eb 100644 --- a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Magistral-Small-2509-unsloth-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Magistral-Small-2509-unsloth-bnb-4bit.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -48,6 +49,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.7 min_p: 0.01 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Ministral-3-3B-Instruct-2512.yaml b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Ministral-3-3B-Instruct-2512.yaml index ca6609cda8..c9f771fd23 100644 --- a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Ministral-3-3B-Instruct-2512.yaml +++ b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Ministral-3-3B-Instruct-2512.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -48,6 +49,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.15 top_p: default diff --git a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Mistral-Nemo-Base-2407-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Mistral-Nemo-Base-2407-bnb-4bit.yaml index 1048bd2469..abdac62c0c 100644 --- a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Mistral-Nemo-Base-2407-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Mistral-Nemo-Base-2407-bnb-4bit.yaml @@ -3,6 +3,7 @@ # Also applies to: "unsloth/Mistral-Nemo-Base-2407", "mistralai/Mistral-Nemo-Base-2407", "unsloth/Mistral-Nemo-Instruct-2407-bnb-4bit", "unsloth/Mistral-Nemo-Instruct-2407", "mistralai/Mistral-Nemo-Instruct-2407", training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,4 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 - +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Mistral-Small-Instruct-2409.yaml b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Mistral-Small-Instruct-2409.yaml index 26c58a61f1..149f2a24f1 100644 --- a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Mistral-Small-Instruct-2409.yaml +++ b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Mistral-Small-Instruct-2409.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/Mistral-Small-Instruct-2409-bnb-4bit, mistralai/Mistral-Small-Instruct-2409 training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Pixtral-12B-2409.yaml b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Pixtral-12B-2409.yaml index bcd0d20c8c..3976cd0aa0 100644 --- a/studio/backend/assets/configs/model_defaults/mistral/unsloth_Pixtral-12B-2409.yaml +++ b/studio/backend/assets/configs/model_defaults/mistral/unsloth_Pixtral-12B-2409.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,6 +43,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.5 min_p: 0.1 diff --git a/studio/backend/assets/configs/model_defaults/mistral/unsloth_mistral-7b-instruct-v0.3-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/mistral/unsloth_mistral-7b-instruct-v0.3-bnb-4bit.yaml index 2e1c76468e..55d5dd289b 100644 --- a/studio/backend/assets/configs/model_defaults/mistral/unsloth_mistral-7b-instruct-v0.3-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/mistral/unsloth_mistral-7b-instruct-v0.3-bnb-4bit.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/mistral-7b-instruct-v0.3, mistralai/Mistral-7B-Instruct-v0.3 training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,4 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 - +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/mistral/unsloth_mistral-7b-v0.3-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/mistral/unsloth_mistral-7b-v0.3-bnb-4bit.yaml index 37275fc37b..5b24f5b581 100644 --- a/studio/backend/assets/configs/model_defaults/mistral/unsloth_mistral-7b-v0.3-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/mistral/unsloth_mistral-7b-v0.3-bnb-4bit.yaml @@ -2,6 +2,7 @@ # Based on Mistral_v0.3_(7B)-Alpaca.ipynb # Also applies to: "unsloth/mistral-7b-v0.3", "mistralai/Mistral-7B-v0.3", training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -41,4 +42,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 - +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/other/OuteAI_Llama-OuteTTS-1.0-1B.yaml b/studio/backend/assets/configs/model_defaults/other/OuteAI_Llama-OuteTTS-1.0-1B.yaml index 72b5b018e1..87b94ce67c 100644 --- a/studio/backend/assets/configs/model_defaults/other/OuteAI_Llama-OuteTTS-1.0-1B.yaml +++ b/studio/backend/assets/configs/model_defaults/other/OuteAI_Llama-OuteTTS-1.0-1B.yaml @@ -6,6 +6,7 @@ audio_type: dac training: + trust_remote_code: false eval_steps: 0 max_seq_length: 2048 # num_epochs: 4 @@ -42,6 +43,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.4 top_k: 40 top_p: 0.9 diff --git a/studio/backend/assets/configs/model_defaults/other/Spark-TTS-0.5B_LLM.yaml b/studio/backend/assets/configs/model_defaults/other/Spark-TTS-0.5B_LLM.yaml index d20751b0c7..03748cd5fd 100644 --- a/studio/backend/assets/configs/model_defaults/other/Spark-TTS-0.5B_LLM.yaml +++ b/studio/backend/assets/configs/model_defaults/other/Spark-TTS-0.5B_LLM.yaml @@ -6,6 +6,7 @@ audio_type: bicodec training: + trust_remote_code: false eval_steps: 0 max_seq_length: 2048 # num_epochs: 4 @@ -47,6 +48,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.8 top_k: 50 top_p: 1.0 diff --git a/studio/backend/assets/configs/model_defaults/other/sesame_csm-1b.yaml b/studio/backend/assets/configs/model_defaults/other/sesame_csm-1b.yaml index f5f49fe1e6..5c1e180f8c 100644 --- a/studio/backend/assets/configs/model_defaults/other/sesame_csm-1b.yaml +++ b/studio/backend/assets/configs/model_defaults/other/sesame_csm-1b.yaml @@ -5,6 +5,7 @@ audio_type: csm training: + trust_remote_code: false eval_steps: 0 max_seq_length: 2048 # num_epochs: 4 @@ -45,3 +46,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/other/unsloth_GLM-4.7-Flash.yaml b/studio/backend/assets/configs/model_defaults/other/unsloth_GLM-4.7-Flash.yaml index a973c2d4e4..6d8be3656f 100644 --- a/studio/backend/assets/configs/model_defaults/other/unsloth_GLM-4.7-Flash.yaml +++ b/studio/backend/assets/configs/model_defaults/other/unsloth_GLM-4.7-Flash.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/GLM-4.7-Flash-unsloth-bnb-4bit, unsloth/GLM-4.7-Flash-bnb-4bit, THUDM/GLM-4.7-Flash training: + trust_remote_code: true max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: true temperature: 0.7 top_p: 0.8 top_k: 20 diff --git a/studio/backend/assets/configs/model_defaults/other/unsloth_LFM2-1.2B.yaml b/studio/backend/assets/configs/model_defaults/other/unsloth_LFM2-1.2B.yaml index b0feafbd6e..39a2fe0a5b 100644 --- a/studio/backend/assets/configs/model_defaults/other/unsloth_LFM2-1.2B.yaml +++ b/studio/backend/assets/configs/model_defaults/other/unsloth_LFM2-1.2B.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -38,6 +39,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.3 min_p: 0.15 diff --git a/studio/backend/assets/configs/model_defaults/other/unsloth_Nemotron-3-Nano-30B-A3B.yaml b/studio/backend/assets/configs/model_defaults/other/unsloth_Nemotron-3-Nano-30B-A3B.yaml index 2c44c91eab..663ce87d5f 100644 --- a/studio/backend/assets/configs/model_defaults/other/unsloth_Nemotron-3-Nano-30B-A3B.yaml +++ b/studio/backend/assets/configs/model_defaults/other/unsloth_Nemotron-3-Nano-30B-A3B.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: true max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -46,6 +47,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: true temperature: 1.0 top_p: 1.0 diff --git a/studio/backend/assets/configs/model_defaults/other/unsloth_PaddleOCR-VL.yaml b/studio/backend/assets/configs/model_defaults/other/unsloth_PaddleOCR-VL.yaml index e1fbc08e4d..b7587bbd91 100644 --- a/studio/backend/assets/configs/model_defaults/other/unsloth_PaddleOCR-VL.yaml +++ b/studio/backend/assets/configs/model_defaults/other/unsloth_PaddleOCR-VL.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: true max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -48,6 +49,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: true temperature: 1.5 min_p: 0.1 diff --git a/studio/backend/assets/configs/model_defaults/other/unsloth_answerdotai_ModernBERT-large.yaml b/studio/backend/assets/configs/model_defaults/other/unsloth_answerdotai_ModernBERT-large.yaml index cae8dd3c40..cc5d130bfa 100644 --- a/studio/backend/assets/configs/model_defaults/other/unsloth_answerdotai_ModernBERT-large.yaml +++ b/studio/backend/assets/configs/model_defaults/other/unsloth_answerdotai_ModernBERT-large.yaml @@ -2,6 +2,7 @@ # Based on bert_classification.ipynb training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 1 num_epochs: 0 @@ -41,3 +42,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/other/unsloth_orpheus-3b-0.1-ft.yaml b/studio/backend/assets/configs/model_defaults/other/unsloth_orpheus-3b-0.1-ft.yaml index 5a3c4abb48..883761675f 100644 --- a/studio/backend/assets/configs/model_defaults/other/unsloth_orpheus-3b-0.1-ft.yaml +++ b/studio/backend/assets/configs/model_defaults/other/unsloth_orpheus-3b-0.1-ft.yaml @@ -6,6 +6,7 @@ audio_type: snac training: + trust_remote_code: false eval_steps: 0 max_seq_length: 2048 # num_epochs: 4 @@ -47,6 +48,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.6 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/other/unsloth_tinyllama-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/other/unsloth_tinyllama-bnb-4bit.yaml index c3b966fa06..35c850c71f 100644 --- a/studio/backend/assets/configs/model_defaults/other/unsloth_tinyllama-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/other/unsloth_tinyllama-bnb-4bit.yaml @@ -3,6 +3,7 @@ # Also applies to: TinyLlama/TinyLlama-1.1B-intermediate-step-1431k-3T training: + trust_remote_code: false max_seq_length: 4096 # num_epochs: 1 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/other/unsloth_whisper-large-v3.yaml b/studio/backend/assets/configs/model_defaults/other/unsloth_whisper-large-v3.yaml index 1906ecda51..9140878e0e 100644 --- a/studio/backend/assets/configs/model_defaults/other/unsloth_whisper-large-v3.yaml +++ b/studio/backend/assets/configs/model_defaults/other/unsloth_whisper-large-v3.yaml @@ -6,6 +6,7 @@ audio_type: whisper audio_input: true training: + trust_remote_code: false eval_steps: 5 max_seq_length: 448 # num_epochs: 4 @@ -41,3 +42,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-3-medium-4k-instruct.yaml b/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-3-medium-4k-instruct.yaml index 14af711f78..1088df7796 100644 --- a/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-3-medium-4k-instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-3-medium-4k-instruct.yaml @@ -3,6 +3,7 @@ # Also applies to: "unsloth/Phi-3-medium-4k-instruct-bnb-4bit", "microsoft/Phi-3-medium-4k-instruct", training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,4 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 - +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-3.5-mini-instruct.yaml b/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-3.5-mini-instruct.yaml index b0593300ab..79812a74c4 100644 --- a/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-3.5-mini-instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-3.5-mini-instruct.yaml @@ -3,6 +3,7 @@ # Also applies to: "unsloth/Phi-3.5-mini-instruct-bnb-4bit", "microsoft/Phi-3.5-mini-instruct" training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,4 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 - +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-4.yaml b/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-4.yaml index 4de3d9437d..aaa4feac45 100644 --- a/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-4.yaml +++ b/studio/backend/assets/configs/model_defaults/phi/unsloth_Phi-4.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.8 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/qwen/imdatta0_tiny_qwen3_moe_2.8B_0.7B.yaml b/studio/backend/assets/configs/model_defaults/qwen/imdatta0_tiny_qwen3_moe_2.8B_0.7B.yaml index bb75b3ce52..fa7b9c4e8b 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/imdatta0_tiny_qwen3_moe_2.8B_0.7B.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/imdatta0_tiny_qwen3_moe_2.8B_0.7B.yaml @@ -4,6 +4,7 @@ # MoE model - includes gate_up_proj for MoE layers training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -45,6 +46,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.6 top_k: 20 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2-7B.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2-7B.yaml index 140484eb9c..3e64a6ca48 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2-7B.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2-7B.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/Qwen2-7B-bnb-4bit, Qwen/Qwen2-7B training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2-VL-7B-Instruct.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2-VL-7B-Instruct.yaml index 6cee3d0949..894751bed1 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2-VL-7B-Instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2-VL-7B-Instruct.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,6 +43,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.5 min_p: 0.1 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-1.5B-Instruct.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-1.5B-Instruct.yaml index 5ecb154e4c..1d37cc9829 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-1.5B-Instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-1.5B-Instruct.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/Qwen2.5-1.5B-Instruct-unsloth-bnb-4bit, Qwen/Qwen2.5-1.5B-Instruct, unsloth/Qwen2.5-1.5B-Instruct-bnb-4bit training: + trust_remote_code: false max_seq_length: 4096 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-7B.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-7B.yaml index 5bbe543517..99f3a66e23 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-7B.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-7B.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/Qwen2.5-7B-unsloth-bnb-4bit, Qwen/Qwen2.5-7B, unsloth/Qwen2.5-7B-bnb-4bit training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-1.5B-Instruct.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-1.5B-Instruct.yaml index 16c4367223..c48b943cba 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-1.5B-Instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-1.5B-Instruct.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/Qwen2.5-Coder-1.5B-Instruct-bnb-4bit, Qwen/Qwen2.5-Coder-1.5B-Instruct training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-14B-Instruct.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-14B-Instruct.yaml index 856db0c1b3..830bfcf1cb 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-14B-Instruct.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-14B-Instruct.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.5 min_p: 0.1 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-7B-Instruct-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-7B-Instruct-bnb-4bit.yaml index bb0b0ed1c6..db88c3b033 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-7B-Instruct-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-Coder-7B-Instruct-bnb-4bit.yaml @@ -3,6 +3,7 @@ # Also applies to: unsloth/Qwen2.5-Coder-7B-Instruct, Qwen/Qwen2.5-Coder-7B-Instruct training: + trust_remote_code: false max_seq_length: 32768 # num_epochs: 4 num_epochs: 0 @@ -42,3 +43,5 @@ logging: tensorboard_dir: "runs" log_frequency: 10 +inference: + trust_remote_code: false diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-VL-7B-Instruct-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-VL-7B-Instruct-bnb-4bit.yaml index bd54b1d015..cb9bcb104b 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-VL-7B-Instruct-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen2.5-VL-7B-Instruct-bnb-4bit.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth notebook training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,6 +43,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 1.5 min_p: 0.1 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-0.6B.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-0.6B.yaml index 9feb6dcaae..13f066a27d 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-0.6B.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-0.6B.yaml @@ -4,6 +4,7 @@ # added inference parameters from Ollama training: + trust_remote_code: false max_seq_length: 1024 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.6 top_k: 20 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-14B-Base-unsloth-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-14B-Base-unsloth-bnb-4bit.yaml index e61c7b5045..1b942004f6 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-14B-Base-unsloth-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-14B-Base-unsloth-bnb-4bit.yaml @@ -4,6 +4,7 @@ # added inference parameters from Ollama training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.6 top_k: 20 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-14B.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-14B.yaml index c130771c32..a8ecbb4365 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-14B.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-14B.yaml @@ -4,6 +4,7 @@ # added inference parameters from Ollama training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.6 top_k: 20 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-30B-A3B-Instruct-2507.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-30B-A3B-Instruct-2507.yaml index 2fb3a95c30..485dd7a111 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-30B-A3B-Instruct-2507.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-30B-A3B-Instruct-2507.yaml @@ -4,6 +4,7 @@ # MoE model - includes gate_up_proj for MoE layers training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -45,6 +46,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.6 top_k: 20 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-32B.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-32B.yaml index 152f4ae06a..0de64d50ae 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-32B.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-32B.yaml @@ -4,6 +4,7 @@ # added inference parameters from Ollama training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.6 top_k: 20 top_p: 0.95 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-4B-Instruct-2507.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-4B-Instruct-2507.yaml index 94fe000708..dc5940d58c 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-4B-Instruct-2507.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-4B-Instruct-2507.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.7 top_p: 0.80 top_k: 20 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-4B-Thinking-2507.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-4B-Thinking-2507.yaml index 3c325485d2..6392ee0ae9 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-4B-Thinking-2507.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-4B-Thinking-2507.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -44,6 +45,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.6 top_p: 0.95 top_k: 20 diff --git a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-VL-8B-Instruct-unsloth-bnb-4bit.yaml b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-VL-8B-Instruct-unsloth-bnb-4bit.yaml index 5b47c3bdd2..ef52fad763 100644 --- a/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-VL-8B-Instruct-unsloth-bnb-4bit.yaml +++ b/studio/backend/assets/configs/model_defaults/qwen/unsloth_Qwen3-VL-8B-Instruct-unsloth-bnb-4bit.yaml @@ -4,6 +4,7 @@ # added inference parameters from unsloth guides training: + trust_remote_code: false max_seq_length: 2048 # num_epochs: 4 num_epochs: 0 @@ -42,6 +43,7 @@ logging: log_frequency: 10 inference: + trust_remote_code: false temperature: 0.7 top_p: 0.8 top_k: 20