3000 tok/s prefill; 120 tok/s decode on Strix Halo. This is a fork of gufo to support Qwen 3.6 35B A3B for workloads that prioritizes speed over intelligence. - NinjaPear/gufo-Qwen3.6-35B-A3B-Q6dense

1 points•nubela•about 3 hours ago•0 comments•

0 comments

No comments yet.

Related stories