DeepSeek представила DSpark — новый метод спекулятивного декодирования для DeepSeek V4 Flash и DeepSeek V4 Pro, который увеличивает пропускную способность инференса на 51–400%.
DeepSeek представила DSpark — новый метод спекулятивного декодирования для DeepSeek V4 Flash и DeepSeek V4 Pro, который увеличивает пропускную способность инференса на 51–400%.
DeepSeek анонсировала DSpark, новый метод спекулятивного декодирования, который значительно повышает эффективность инференса моделей.
По данным разработчиков, DSpark хорошо работает не только с моделями DeepSeek, но и с другими открытыми LLM, включая Gemma и Qwen.
Вместе с анонсом компания открыла исходный код проекта, опубликовала научную статью с описанием метода и выложила готовую модель на Hugging Face.
Почему это важно
АналітикаВнедрение DSpark может существенно повысить производительность инференса в различных LLM, что открывает новые возможности для разработчиков и исследователей в области искусственного интеллекта.
Обсудить в сообществе
Діліться своїм досвідом та думками з ШІ-розробниками