Denk gewoon van huggingface?
Heb zelf net mn Qwen 3.6_Q8 vervangen met deze Qwen 3.8_Q8 en laad gewoon in en werkt perfect, niks kwa parameters te hoeven aan te passen in llama.cpp :-) nogsteeds rond de 60-80 tk/s.
Zal gedurende de week wel merken of het beter werkt dan 3.6 (wat ongeloogelijk is, als dat zo is, want 3.6 vond ik al eindeloos geweldig, erg veel software mee gemaakt :))
Heb zelf net mn Qwen 3.6_Q8 vervangen met deze Qwen 3.8_Q8 en laad gewoon in en werkt perfect, niks kwa parameters te hoeven aan te passen in llama.cpp :-) nogsteeds rond de 60-80 tk/s.
Zal gedurende de week wel merken of het beter werkt dan 3.6 (wat ongeloogelijk is, als dat zo is, want 3.6 vond ik al eindeloos geweldig, erg veel software mee gemaakt :))