Custom Inference Engine Achieves 65 Tokens Per Second for Qwen3.8-Flash-Next on 12GB VRAM | HACKOBAR_