I pushed Qwen3.8-27B to 99 tps on a single request and 1150 on batch on a 3090

  • Posted 58 minutes ago by mess1337
  • 1 points
https://github.com/syv-ai/qwen38-27b-rtx3090

1 comments

    Loading..