whisper.cpp large-v3-turbo on :11435 (CPU, OpenAI transcriptions path) so ASR does not take GTT from llama-server. Flash-Next is the cygnal IQ4_XS-NGQ4 GGUF (~98 GB, gfx1151), qwen4exp, mmproj pinned; unload Laguna before loading.
whisper.cpp large-v3-turbo on :11435 (CPU, OpenAI transcriptions path) so ASR does not take GTT from llama-server. Flash-Next is the cygnal IQ4_XS-NGQ4 GGUF (~98 GB, gfx1151), qwen4exp, mmproj pinned; unload Laguna before loading.