unsloth/studio/backend/utils
Roland Tannous c6bd55ec61
fix(llm_assist): disable thinking mode for helper model JSON output (#4358)
* fix(llm_assist): disable thinking mode for helper model JSON output

Pass enable_thinking=False to generate_chat_completion() in both
_run_with_helper() and _generate_with_backend() so the Qwen3.5-4B
helper model produces clean JSON instead of wrapping responses in
<think> tags.

* fix(llm_assist): log per-request enable_thinking=False override

Add info-level log lines so the user can see that each helper/advisor
request overrides the server-level thinking default to False.

* [pre-commit.ci] auto fixes from pre-commit.com hooks

for more information, see https://pre-commit.ci

---------

Co-authored-by: pre-commit-ci[bot] <66853113+pre-commit-ci[bot]@users.noreply.github.com>
2026-03-17 15:58:08 +04:00
..
datasets fix(llm_assist): disable thinking mode for helper model JSON output (#4358) 2026-03-17 15:58:08 +04:00
hardware studio: web search, KV cache dtype, training progress, inference fixes 2026-03-17 00:30:01 -07:00
inference studio: per-model inference defaults, GGUF slider fix, reasoning toggle (#4325) 2026-03-16 06:37:55 -07:00
models Fix vision detection subprocess using undefined logger 2026-03-16 02:46:56 -07:00
paths [pre-commit.ci] auto fixes from pre-commit.com hooks 2026-03-15 05:24:06 -07:00
.gitkeep root studio folder 2026-02-02 09:13:49 +00:00
__init__.py Final cleanup 2026-03-12 18:28:04 +00:00
cache_cleanup.py Final cleanup 2026-03-12 18:28:04 +00:00
transformers_version.py Final cleanup 2026-03-12 18:28:04 +00:00
utils.py Final cleanup 2026-03-12 18:28:04 +00:00