🧠 DeepSeek V4: открытые модели с 1М контекста по умолчанию Сегодня DeepSeek выложили в открытый доступ V4-Pro (1.6 трлн
Сегодня DeepSeek выложили в открытый доступ V4-Pro (1.6 трлн параметров, 49 млрд активных) и V4-Flash (284 млрд, 13 млрд активных) — обе на Hugging Face, обе с миллионом токенов контекста без доплаты.
Главная техническая находка — токенная компрессия и DeepSeek Sparse Attention, которые сделали длинный контекст реально дешёвым. Не «возможным за $5 за запрос», а стандартной опцией.
Что по бенчмаркам:
- V4-Pro претендует на открытый SOTA в агентном кодинге
- Тащит математику и STEM
- В общих знаниях уступает только Gemini 3.1 Pro
- Flash-версия почти не отстаёт в ризонинге, но быстрее и дешевле
Инфраструктурный подтекст:
В релизе упомянуты «950 supernodes» — это отсылка к Huawei Atlas 950 SuperPoD на чипах Ascend. DeepSeek планируют гонять инференс на китайском железе, а не на Nvidia, и обещают снижение цены Pro во второй половине 2026 года.
API поддерживает форматы OpenAI ChatCompletions и Anthropic с переключением режимов Thinking/Non-Thinking. Старые deepseek-chat и deepseek-reasoner отключат 24 июля 2026 — у команд три месяца на миграцию.
📄 Tech Report: huggingface.co/deepseek-ai/DeepSeek-V4-Pro
🧠 Нейросети и Технологии. Подписаться