DeepSeek представила DSpark — новий метод спекулятивного декодування для DeepSeek V4 Flash і DeepSeek V4 Pro, який збільшує пропускну здатність інференсу на 51–400%.
DeepSeek представила DSpark — новий метод спекулятивного декодування для DeepSeek V4 Flash і DeepSeek V4 Pro, який збільшує пропускну здатність інференсу на 51–400%.
DeepSeek анонсувала DSpark, новий метод спекулятивного декодування, що значно підвищує ефективність інференсу моделей.
За даними розробників, DSpark добре працює не лише з моделями DeepSeek, але й з іншими відкритими LLM, включаючи Gemma і Qwen.
Разом з анонсом компанія відкрила вихідний код проєкту, опублікувала наукову статтю з описом методу та виклала готову модель на Hugging Face.
Чому це важливо
АналітикаВпровадження DSpark може суттєво підвищити продуктивність інференсу в різних LLM, що відкриває нові можливості для розробників і дослідників у сфері штучного інтелекту.
Обговорити новину у спільноті
Діліться своїм досвідом та думками з ШІ-розробниками