AIDeepSeek-AI and Peking University open-source DSpark, using speculative decoding to boost LLM inference throughput by up to 400%The method also accelerates Gemma and Qwen model inference.5 Sources, 101d ago, first seen 101d agoCombined views37.2K5 Sources, first seen 101d ago407 likesCombined views37.2K5 Sources, first seen 101d ago407 likes