DSpark logra speedups de 2,27x a 3,06x según el modelo y hardware, con reducción de latencia en function-calling del 57%, manteniendo idéntica calidad de salida. La técnica combina backbone paralelo tipo DFlash, cabeza Markov para coherencia entre tokens y verificador con schedule de confianza, usando draft models de ~300M parámetros.