نسخه رسمی 0731 دیپسیک وی۴ فلش با دیکود گمانهزنی DSpark
دیپسیک نسخه رسمی مدل V4-Flash با کد 0731 را منتشر کرده که جای نسخه پیشنمایش قبلی را میگیرد. این نسخه با ماژول دیکود گمانهزنی DSpark همراه است و روی بنچمارکهای عاملمحور و کدنویسی نتایج مشخصی گزارش کرده است.
دیپسیک نسخه رسمی مدل V4-Flash با کد 0731 را منتشر کرده که جای نسخه پیشنمایش قبلی را میگیرد. این نسخه با ماژول دیکود گمانهزنی DSpark همراه است و روی بنچمارکهای عاملمحور و کدنویسی نتایج مشخصی گزارش کرده است.
مشخصات
- ساختار مدل: مشابه DeepSeek-V4-Flash-DSpark
- سطوح reasoning_effort: low، high، max
- لایسنس: MIT License
- روش گمانهزنی در vLLM: dspark
- الگوریتم گمانهزنی در SGLang: DSPARK
- حداکثر طول خروجی پیشنهادی: 384K توکن برای سطوح high و max
- DeepSeek-V4-Flash-0731 نسخه رسمی است که جای نسخه پیشنمایش قبلی DeepSeek-V4-Flash را میگیرد.
- ساختار مدل با DeepSeek-V4-Flash-DSpark یکسان معرفی شده است.
- یک ماژول دیکود گمانهزنی به مدل ضمیمه شده است.
- روی Terminal Bench 2.1 امتیاز 82.7 گرفته است.
- روی NL2Repo امتیاز 54.2، روی Cybergym امتیاز 76.7، و روی DeepSWE امتیاز 54.4 ثبت شده است.
- روی Toolathlon-Verified امتیاز 70.3، روی Agents' Last Exam امتیاز 25.2، و روی AutomationBench Public امتیاز 25.1 گزارش شده است.
- روی DSBench-FullStack امتیاز 68.7 و روی DSBench-Hard امتیاز 59.6 ثبت شده است.
- این نسخه قالب Jinja برای چت ندارد.
- یک پوشه encoding شامل اسکریپتهای پایتون و تستکیس ارائه شده است.
- پارامتر reasoning_effort سه سطح low، high و max را پشتیبانی میکند.
- فعالسازی DSpark در vLLM با روش dspark و در نمونه ارائهشده با هفت توکن گمانهزنی انجام میشود.
- SGLang با الگوریتم DSPARK و با استفاده از وزنهای target و draft از یک checkpoint یکسان پیکربندی شده است.
- وزنهای مدل تحت لایسنس MIT منتشر شدهاند.
- این هارنس مناسبِ کسانی است که با ابزارهای vLLM یا SGLang روی زیرساخت استنتاج مدلهای زبانی کار میکنند.
- توسعهدهندگانی که به بنچمارکهای عاملمحور و کدنویسی مانند Terminal Bench، Cybergym یا DSBench علاقه دارند.
- کسانی که به دنبال مدلی با پشتیبانی رسمی از دیکود گمانهزنی DSpark هستند.
- افرادی که برای پروژههای خود به مدلی با لایسنس MIT نیاز دارند.
وزنهای DeepSeek-V4-Flash-0731 در صفحه هاگینگفیس deepseek-ai/DeepSeek-V4-Flash-0731 قرار دارد. برای اجرا با vLLM، گمانهزنی DSpark را با تنظیم speculative_config روی method دیپاسپارک (dspark) و num_speculative_tokens برابر هفت فعال کنید. در SGLang، پارامتر speculative-algorithm را روی DSPARK بگذارید و وزنهای target و draft را از همان چکپوینت مدل بارگذاری کنید. برای کنترل عمق استدلال، پارامتر reasoning_effort را روی یکی از مقادیر low، high یا max تنظیم کنید و برای سطوح high و max طول خروجی را تا سقف 384K توکن در نظر بگیرید.
منابع
- DeepSeek-V4-Flash-0731 model card — Hugging Face
