Hacker News
new
top
best
ask
show
job
The Llama.cpp Fork That Enables Qwen 3.8 27B Large Contexts for 16GB VRAM GPU
(
github.com
)
4 points
by
dazhbog
2 hours ago
3 comments
dazhbog
2 hours ago
A video I found covering the improvements
https://www.youtube.com/watch?v=n_ggLjIgRcM
akshay_akula
2 hours ago
Will this perform better than lmstudio-community/Qwen3.8-27B-MLX-4bit on my m5 max 48gb memory mac?
2 hours ago
undefined