Photon 2.6 adds FP8 inference and speculative decoding; Qwen3.5-27B is claimed to run at over 400 tokens/sec on one B200 · Digg