feat(provider/llamacpp): update default larger local model to Qwen3.8-27B-Uncensored-Aggressive-Q4_K_M.gguf

This commit is contained in:
Louistiti
2026-08-16 11:08:31 +08:00
parent 2526187ef9
commit 1bad747f3f
3 changed files with 6 additions and 5 deletions
+2 -2
View File
@@ -19,8 +19,8 @@ llm:
# Examples:
# default: openai/gpt-5.6-sol
# default: openrouter/z-ai/glm-5.2
# default: llamacpp/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf
# default: sglang/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf
# default: llamacpp/Qwen3.8-27B-Uncensored-Aggressive-Q4_K_M.gguf
# default: sglang/Qwen3.8-27B-Uncensored-Aggressive-Q4_K_M.gguf
# default: /absolute/path/model.gguf
default: null
# Optional per-mode overrides. Null values fall back to llm.default.
+3 -3
View File
@@ -25,11 +25,11 @@ import { createSetupStatus } from './setup-status'
const DEFAULT_LLM_OPTIONS = [
{
minimumTotalVRAM: LLM_HIGH_TIER_MINIMUM_TOTAL_VRAM,
name: 'Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive',
name: 'Qwen3.8-27B-Uncensored-Aggressive',
version: 'Q4_K_M',
fileName: 'Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf',
fileName: 'Qwen3.8-27B-Uncensored-Aggressive-Q4_K_M.gguf',
downloadURL:
'https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive/resolve/main/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf?download=true'
'https://huggingface.co/0xKitkat/Qwen3.8-27B-Uncensored-Aggressive/resolve/main/Qwen3.8-27B-Uncensored-Aggressive-Q4_K_M.gguf?download=true'
},
{
minimumTotalVRAM: LLM_MINIMUM_TOTAL_VRAM,
@@ -794,6 +794,7 @@ export default class LlamaCPPLLMProvider extends AISDKRemoteLLMProvider {
String(getURLPort(runtimeServerURL)),
'--ctx-size',
String(LOCAL_LLM_CONTEXT_WINDOW_TOKENS),
'--jinja',
'--flash-attn',
'on',
'--cache-type-k',