DeepSeek presenta DSpark: un nuevo método de decodificación especulativa para DeepSeek V4 Flash y DeepSeek V4 Pro, que aumenta el rendimiento de inferencia en un 51–400%.
DeepSeek presenta DSpark: un nuevo método de decodificación especulativa para DeepSeek V4 Flash y DeepSeek V4 Pro, que aumenta el rendimiento de inferencia en un 51–400%.
DeepSeek ha anunciado DSpark, un nuevo método de decodificación especulativa que mejora significativamente la eficiencia de la inferencia de modelos.
Según los desarrolladores, DSpark funciona bien no solo con modelos de DeepSeek, sino también con otros LLM abiertos, incluidos Gemma y Qwen.
Junto con el anuncio, la compañía publicó el código fuente del proyecto, publicó un artículo científico que describe el método y subió un modelo listo para usar en Hugging Face.
Por qué es importante
АналітикаLa implementación de DSpark podría mejorar significativamente el rendimiento de la inferencia en varios LLM, abriendo nuevas oportunidades para desarrolladores e investigadores en el campo de la inteligencia artificial.
Debatir en la comunidad
Діліться своїм досвідом та думками з ШІ-розробниками