diff --git a/studio/install_llama_prebuilt.py b/studio/install_llama_prebuilt.py index 91afe0d3ba..1b02729649 100755 --- a/studio/install_llama_prebuilt.py +++ b/studio/install_llama_prebuilt.py @@ -60,6 +60,10 @@ def env_int(name: str, default: int, *, minimum: int | None = None) -> int: return value +# Prefer "latest" over "master" -- "master" bypasses the prebuilt resolver +# (no matching GitHub release), forces a source build, and causes HTTP 422 +# errors. Only use "master" temporarily when the latest release is missing +# support for a new model architecture. DEFAULT_LLAMA_TAG = os.environ.get("UNSLOTH_LLAMA_TAG", "latest") # Force all installs to use mainline llama.cpp from ggml-org. # Previously: DEFAULT_PUBLISHED_REPO = os.environ.get("UNSLOTH_LLAMA_RELEASE_REPO", "unslothai/llama.cpp") diff --git a/studio/setup.ps1 b/studio/setup.ps1 index e26acd040a..d478319098 100644 --- a/studio/setup.ps1 +++ b/studio/setup.ps1 @@ -27,6 +27,10 @@ $PackageDir = Split-Path -Parent $ScriptDir # Change these in the GitHub-hosted script so users get updated defaults. # User env vars always override these baked-in values. # -------------------------------------------------------------------------- +# Prefer "latest" over "master" -- "master" bypasses the prebuilt resolver +# (no matching GitHub release), forces a source build, and causes HTTP 422 +# errors. Only use "master" temporarily when the latest release is missing +# support for a new model architecture. $DefaultLlamaPrForce = "" $DefaultLlamaSource = "https://github.com/ggml-org/llama.cpp" $DefaultLlamaTag = "latest" diff --git a/studio/setup.sh b/studio/setup.sh index b8505fcb13..d9ce73661f 100755 --- a/studio/setup.sh +++ b/studio/setup.sh @@ -16,6 +16,11 @@ RULE=$(printf '\342\224\200%.0s' {1..52}) # _DEFAULT_LLAMA_SOURCE : git clone URL for source builds # _DEFAULT_LLAMA_TAG : llama.cpp ref to build ("latest" = newest release, # "master" = bleeding-edge, "bNNNN" = specific tag) +# Prefer "latest" over "master" -- "master" bypasses +# the prebuilt resolver (no matching GitHub release), +# forces a source build, and causes HTTP 422 errors. +# Only use "master" temporarily when the latest release +# is missing support for a new model architecture. # ────────────────────────────────────────────────────────────────────────── _DEFAULT_LLAMA_PR_FORCE="" _DEFAULT_LLAMA_SOURCE="https://github.com/ggml-org/llama.cpp"