I pushed Qwen3.8-27B to 99 tps on a single request and 1150 on batch on a 3090
Posted 58 minutes ago by
mess1337
1
points
https://github.com/syv-ai/qwen38-27b-rtx3090
1
comments
Loading..