DeepSeek lança DSpark: decodificação especulativa que acelera o V4 em 60-85% por usuário
A DeepSeek liberou hoje o DSpark, um framework de decodificação especulativa (otimização de serving, não um modelo novo). Os checkpoints DeepSeek-V4-Pro-DSpark e -Flash-DSpark reaproveitam os pesos do V4 com um módulo "draft" acoplado, acelerando a geração por usuário em 60-85% no Flash e ~57-78% no Pro sobre o baseline MTP-1. Usa um método "semi-paralelo" que gera vários tokens candidatos de uma vez e verifica só os promissores. A equipe também abriu o DeepSpec, codebase MIT para treinar/avaliar drafters de speculative decoding.
Modelos · marktechpost · deepseek, dspark, deepseek-v4, decodificacao-especulativa, speculative-decoding, inferencia