6 ms·
The Llama.cpp Fork That Enables Qwen 3.8 27B Large Contexts for 16GB VRAM GPU
- dazhbog 19d agoA video I found covering the improvements https://www.youtube.com/watch?v=n_ggLjIgRcM https://www.youtube.com/watch?v=n_ggLjIgRcM
- akshay_akula 19d agoWill this perform better than lmstudio-community/Qwen3.8-27B-MLX-4bit on my m5 max 48gb memory mac?
- deleted 19d ago[deleted]