DSpark and DFlash2 draft models for faster inference with speculative decoding
Yosef Worku Alemneh
rasyosef
AI & ML interests
Pretraining, Supervised Fine Tuning, Direct Preference Optimization, Retrieval Augmented Generation (RAG), Function Calling
Recent Activity
new activity about 6 hours ago
Qwen/Qwen3-1.7B:Qwen3-1.7B-DSpark: A DSpark draft model for Qwen3-1.7B (upto 3x speedup; 220 --> 646 tokens/sec) updated a model about 7 hours ago
rasyosef/Qwen3.5-2B-DSpark updated a model about 8 hours ago
rasyosef/Qwen3-1.7B-DSpark