13 августа 2026 года китайская компания DeepSeek официально выпустила свою флагманскую модель V4-Pro.
Релиз стал доступен сразу в трех каналах: веб-чате, мобильном приложении и через API. Модель хорошо справляется с программированием, анализом документов и агентными сценариями.
В этой статье разберем, чем DeepSeek-V4-Pro отличается от предыдущих версий, какие задачи по силам модели, сколько стоит доступ и как быстро подключить ИИ к своим проектам.
Что такое DeepSeek-V4-Pro
DeepSeek V4 — это новое поколение больших языковых моделей китайской компании DeepSeek, пришедшее на смену V3/R1. Это программа, которая принимает текстовый запрос и на его основе генерирует текст: пишет, объясняет, переводит, создает код и т.д.
Модель разработала китайская компания DeepSeek, которую основал в июле 2023 года предприниматель Лянем Вэньфэн в Китае.
Новости о DeepSeek облетели мир в январе 2025 года, когда 20 января вышла модель DeepSeek‑R1. В конце месяца приложение компании стало самым скачиваемым в App Store США, а акции ряда крупных технологических компаний, резко упали: рынок отреагировал на то, что китайская модель показывала результаты уровня ведущих западных аналогов, но требовала в разы меньше затрат на обучение и работу.
DeepSeek-V4-Pro — новая и самая мощная модель в линейке V4, которую компания выпустила в 2026 году. Она построена по архитектуре Mixture of Experts (MoE) и содержит около 1,6 трлн параметров — числовых значений, которые модель настраивает в процессе обучения и использует для анализа информации и формирования ответов.
При этом для обработки каждого отдельного токена нужна не вся модель, а около 49 млрд параметров. Такой подход позволяет сочетать большую общую емкость модели с относительно умеренными вычислительными затратами.
Вместе с Pro-версией DeepSeek выпустила облегченную модель — V4-Flash. Она содержит 284 млрд параметров, но для обработки каждого фрагмента текста задействует только около 13 млрд из них. Сейчас вышла уже следующая версия — V4.1-Flash, о ней мы поговорим ниже.
По собственным данным Дипсик, V4-Pro имеет расширенные возможности для агентного программирования и показывает лучшие результаты среди открытых моделей. Модель уверенно работает с широким спектром технологий, превосходя другие открытые решения и уступая только Gemini 3.1 Pro.
В задачах, требующих сложных рассуждений, — математике, науке и программировании — V4-Pro также опережает другие открытые модели и соперничает с ведущими моделями с закрытым исходным кодом:
Сравнение Дипсик V4 Pro с другими моделями. Изображение с сайта: deepseek.com
Но это оценка самой компании, независимые рейтинги показывают более скромные результаты. Например, по версии Artificial Analysis, DeepSeek-V4-Pro имеет индекс искусственного интеллекта 36 и уступает многим другим моделям:
Позиция DeepSeek-V4-Pro в индексе интеллекта artificialanalysis.ai.
Издание также отмечает, что решение дорогое по сравнению с другими моделями аналогичного размера с открытым исходным кодом. DeepSeek-V4-Pro быстрее среднего, хотя и несколько многословна.
Что нового в V4-Pro по сравнению с предыдущими версиями DeepSeek
Если сравнивать с предыдущим поколением — V3.2 и R1, у V4-Pro можно наблюдать следующие изменения:
- Контекст вырос почти в восемь раз. По сравнению с предыдущим поколением (V3.2 и R1 с окном контекста 128K токенов) у DeepSeek‑V4‑Pro максимальный контекст до 1 млн токенов.
- Цена стала зависеть от времени суток — вместо фиксированной ставки DeepSeek ввел пиковые и непиковые часы.
- API обновился под индустриальные стандарты — добавлена нативная поддержка формата OpenAI Responses API и интеграция с Codex.
Разберем каждый пункт подробнее.
Архитектура и режим рассуждений
В V4-Pro DeepSeek использовала два механизма для эффективной работы с длинным контекстом: сжатие токенов и разреженное внимание DSA. Они позволяют модели обрабатывать до 1 млн токенов, значительно снижая нагрузку на память и вычислительные ресурсы по сравнению с традиционными подходами.
Режим глубокого мышления (DeepThink) включается отдельно: модель думает перед ответом, что повышает качество на задачах по математике, логике и коду, но и увеличивает время и стоимость генерации. Для рутинных задач лучше подходит модель без рассуждения.
Контекстное окно и работа с длинными документами
Один миллион токенов — это около 700–800 текста в одном запросе. Максимальная длина ответа при этом ограничена 384 тыс. токенов.
На практике это значит, что в модель можно целиком загрузить огромный договор, техническую документацию или несколько отчетов и попросить сравнить их между собой без деления текста на части.
Скорость и стоимость генерации
С 16 августа 2026 года DeepSeek перешел на тарификацию по времени суток. В пиковые часы (01:00-04:00 и 06:00-10:00 UTC) цена на входные и выходные токены V4-Pro примерно вдвое выше, чем в остальное время.
Подробные цифры — в разделе про тарифы ниже. При этом стоит учитывать, что повторяющиеся фрагменты промпта (например, системная инструкция или один и тот же документ в нескольких запросах) кэшируются и обходятся в разы дешевле обычного ввода.
Новая модель V4.1-Flash
10 сентября DeepSeek представила V4.1-Flash — модель, которая заменила V4-Flash и экспериментальную V4-Flash-Vision-Exp.
1. Модель работает экономнее. Внутри нее, как и в других моделях DeepSeek, используется архитектура MoE: на конкретный запрос реагируют только нужные эксперты, а не вся сеть сразу.
У V4.1-Flash 552 млрд параметров, но для обработки запроса активируется только 8 млрд, а для генерации ответа — 16 млрд. Проще говоря: модель знает очень много, но не тратит на каждый вопрос все свои ресурсы, поэтому работает быстрее и дешевле.
2. Модели нужно меньше памяти на запоминание диалога. Пока идет разговор, модель держит в памяти его историю — это называется кешем. У V4.1-Flash такой кеш стал в 4 раза компактнее по оперативной видеопамяти (HBM) по сравнению с предыдущей версией, а место, которое он занимает на диске (SSD), — в 8 раз меньше. Для пользователя это значит, что запускать и обслуживать модель дешевле, поэтому ответы через API стоят меньше.
3. По тестам в ряде метрик обгоняет старшую модель V4-Pro. Разработчики проверяют качество моделей на стандартных тестах — бенчмарках, где ИИ решает задачи по программированию и логике, а результат сравнивают в баллах. Младшая и более дешевая V4.1-Flash показала результат выше, чем более мощная и дорогая V4-Pro.
4. Модель обучена на собственных данных. DeepSeek заявляет, что предварительно обучила V4.1-Flash с нуля на собственных данных и новой архитектуре. Это важно уточнение, ведь недавно спецслужбы США обвинили китайские компании в массовом использовании дистилляции — обучения своей модели на ответах чужой, более сильной модели, без разрешения.
Возможности DeepSeek-V4-Pro
Разберем подробнее возможности Deepseek-V4-Pro, которые пригодятся предпринимателям и специалистам.
Работа с текстом и переводы
Модель создает и редактирует статьи, письма, описания товаров, презентации и посты, умеет менять стиль текста под аудиторию и переводить между языками.
Deepseek-V4-Pro на русском языке пишет в сдержанном и деловом стиле. Модель хорошо справляется с рабочими и техническими текстами, но в задачах, требующих художественной выразительности и тонкой стилизации, может уступать специализированным решениям.
Например, такой текст нейросеть создала для сервиса по ремонту бытовых услуг:
Скриншот с сайта chat.deepseek.com
Анализ файлов, таблиц и отчетов
Можно загрузить договор, регламент, финансовый отчет или несколько документов сразу и попросить модель:
- подготовить краткое содержание;
- найти противоречия между документами;
- выделить риски и ключевые условия;
- свести данные из нескольких таблиц в одну.
Поиск и работа с актуальными данными
У Дипсик V4 есть функция «Умного поиска» (Search), которая ищет ответ на основе актуальных данных из интернета. Это полезно для анализа цен, новостей, законов, где важна свежая информация, а не только внутренние знания модели.
Например, нейросеть выдала актуальные данные по курсу валют:
Динамика курса валют. Скриншот с сайта chat.deepseek.com
Написание и разбор кода
Модель пишет новый код, ищет ошибки, объясняет работу функций, готовит тесты и разбирает крупные репозитории целиком благодаря миллионному контексту.
API нативно поддерживает формат OpenAI Responses и адаптирован под Codex, что упрощает встраивание модели в существующие процессы разработки.
Как пользоваться DeepSeek-V4-Pro: пошаговая инструкция
Через веб-версию
1. Откройте chat.deepseek.com и зарегистрируйтесь по номеру телефона, электронной почте или через аккаунт Google.
2. На сайте DeepSeek компания указывает, что для доступа к модели V4-Pro нужно выбрать экспертный режим (Expert Mode). Однако у нас не получилось сделать это: в интерфейсе не оказалось нужной кнопки:
Скриншот с сайта chat.deepseek.com
3. Получите результат и при необходимости уточните, что нужно улучшить в ответе DeepSeek.
Результат выполнения задачи. Скриншот с сайта chat.deepseek.com
Через мобильное приложение
Приложение DeepSeek доступно для iOS и Android, полностью повторяет возможности веб-версии и по умолчанию использует интерфейс на русском языке. Чтобы начать пользоваться нейросетью:
- Скачайте ее из магазина приложений.
- Войдите в аккаунт.
- Введите свой запрос. Здесь также доступен режим рассуждения и поиск в сети. В мобильном приложении вы можете использовать голосовой ввод.
Через API
- Получите API‑ключ. Зарегистрируйтесь на platform.deepseek.com и создайте ключ в разделе API Keys. Сохраните ключ сразу после создания.
- Пополните баланс. Отдельной подписки для API нет: стоимость запросов списывается с баланса в зависимости от количества входных и выходных токенов.
- Подключите SDK. API DeepSeek совместим с форматом OpenAI. Укажите адрес API https://api.deepseek.com, свой ключ и название модели Deepseek-V4-Pro.
- Отправьте первый запрос. Базовый вариант (без явного включения режима рассуждений):
from openai import OpenAI
client = OpenAI(
api_key="ВАШ_API_КЛЮЧ",
base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[
{"role": "user", "content": "Привет!"}
]
)
print(response.choices[0].message.content)
Если нужен режим рассуждений (thinking mode), включите его явно и задайте уровень усилий:
python
response = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[
{"role": "user", "content": "Реши задачу с подробным рассуждением."}
],
reasoning_effort="high", # low / high / max
extra_body={"thinking": {"type": "enabled"}}
)
По умолчанию поведение модели зависит от текущих настроек сервиса. Если указать reasoning_effort и thinking явно, это сделает результат предсказуемым. Чем выше уровень рассуждений, тем больше вычислений требуется модели, что может влиять на скорость ответа и расход токенов.
*Важно: с 14 сентября 2026 года DeepSeek начнет постепенно выводить V4‑Pro из обращения. После 12:00 по пекинскому времени (UTC+8) запросы к DeepSeek-V4-Pro API будут автоматически обрабатываться моделью V4.1-Flash и тарифицироваться по цене Flash. Это продлится до выхода V4.1-Pro. Менять название модели в коде не нужно.*
Тарифы и стоимость DeepSeek V4
Фиксированной ежемесячной подписки у DeepSeek нет. Веб-чат и приложение бесплатны, однако за доступ через API нужно платить.
| Модель | Входные токены | Выходные токены | Кэшированный вход |
|---|---|---|---|
DeepSeek-V4-Pro — пиковые часы | $1,32 / 1 млн | $3,96 / 1 млн | $0,044 / 1 млн |
DeepSeek-V4-Pro — непиковые часы | $0,66 / 1 млн | $1,98 / 1 млн | $0,022 / 1 млн |
DeepSeek Flash — пиковые часы | $0,30 / 1 млн | $1,20 / 1 млн | $0,006 / 1 млн |
DeepSeek Flash — непиковые часы | $0,15 / 1 млн | $0,60 / 1 млн | $0,003 / 1 млн |
Пиковые часы: с 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу. Все остальное время считается непиковым. Непиковый тариф стоит в два раза ниже пикового.
Как читать таблицу:
- Входные токены — текст запроса, инструкции и переданный контекст.
- Выходные токены — ответ модели.
- Кэшированный вход — часть ранее использованного контекста, которую система смогла взять из кэша. Он стоит значительно дешевле обычного входа.
- Контекст — максимальный объем текста, который модель может учитывать в одном запросе.
Например, если в пиковые часы API обработал 1 млн входных токенов и сгенерировал 1 млн выходных токенов в V4 Pro, стоимость составит $5,28 без учета кэширования: $1,32 за вход плюс $3,96 за выход.
Важно, что прямая оплата картой российского банка на сайте DeepSeek не проходит. Нужно использовать зарубежные карты или сервис-посредник с оплатой в рублях.
Сравнение DeepSeek-V4-Pro с альтернативами
Часто у специалистов возникает вопрос: что использовать — Deepseek-V4-Pro или ChatGPT.
Однозначного ответа здесь нет: многое зависит от бюджета, языка и задач. Сравним V4 Pro с основными конкурентами:
| Критерий | DeepSeek V4 Pro | ChatGPT (GPT-5.6 Sol) | Gemini (3.1 Pro Preview) | GigaChat 2 Pro | Qwen3.8 Max |
|---|---|---|---|---|---|
| Цена API, вход/выход за 1М токенов (без учета кэша) | $0,66–$1,32 / $1,98–$3.96 | От $4 / от $20 | $2–4 / $12–18 | ≈500 ₽ в синхронном режиме (цена за 1 млн суммарно обработанных токенов) | $2 / $6 |
| Контекстное окно | 1 млн токенов | ~1,05 млн токенов | 1 млн токенов | 128 тыс. токенов | 1 млн токенов |
| Качество русского языка | среднее | сильное | сильное | сильное, оптимизировано для русского языка | среднее |
| Доступность в РФ | чат бесплатен и доступен в РФ, оплата API через посредников | доступен при смене IP-адреса или через сервисы-посредники | доступен при смене IP-адреса через сервисы-посредники | полная, российская разработка | Чат бесплатен и доступен в РФ |
| Открытость весов | открытые веса, MIT | закрытая модель | закрытая модель | закрытая модель | открытые веса; отдельная лицензия Qwen 3.8-Max |
Ограничения и риски DeepSeek-V4-Pro
1. Галлюцинации никуда не делись. Как и другие нейросети, DeepSeek может уверенно приводить неверные цифры, даты и ссылки, особенно в узкоспециализированных темах.
По данным независимого бенчмарка AA-Omniscience от Artificial Analysis, DeepSeek V4 Pro 0813 демонстрирует показатель галлюцинаций около 94.83% — один из самых высоких:
Уровень галлюцинаций моделей. Скриншот с сайта artificialanalysis.ai
Метрика рассчитывается не от всех ответов, а только от некорректных: она показывает, как часто модель отвечает неправильно в ситуациях, где ей следовало признать, что она не знает ответа.
Для сравнения, итоговый индекс фактологической надежности DeepSeek-V4—Pro составил всего 1 балл против 22 баллов у ChatGPT-5.6 Sol (max). Поэтому нужно обязательно перепроверять утверждения модели.
2. Данные и приватность. Согласно официальной политике конфиденциальности DeepSeek, сервис может обрабатывать текст запросов, загруженные файлы, данные об устройстве, IP-адрес и другие технические сведения.
Для рабочих сценариев это означает, что в чаты и API не стоит передавать персональные данные клиентов, финансовую информацию, коммерческую тайну и внутренние документы.
Перед использованием сервиса следует отдельно проверить условия хранения, обработки и удаления данных в актуальной политике конфиденциальности DeepSeek. Помните, что важно соблюдать закон о персональных данных №152-ФЗ.
3. Оплата из России затруднена. Пополнение баланса DeepSeek API российскими банковскими картами не проходит из-за ограничений платежной инфраструктуры. Поэтому стоит использовать сервисы-посредники или зарубежные карты.
4. Длинный контекст не устраняет ошибки. DeepSeek-V4-Pro заявляет контекстное окно до 1 млн токенов и максимальный объем вывода до 384 тыс. токенов. Это помогает работать с большими документами, но не гарантирует, что модель правильно извлечет факты из длинного файла, не смешает разные фрагменты или не сделает ошибочный вывод.
5. Непонятно, как выбрать модель DeepSeek-V4-Pro в приложении и веб-чате. Сейчас отсутствует переключатель между моделями и нейросеть сама решает, какую модель использовать. Вы не можете знать, в какой момент ИИ изменит последнюю модель на одну из предыдущих.
К тому же DeepSeek уже не раз переименовывала и объединяла модели в API, сохраняя старое название как псевдоним — так, с 14 сентября 2026 года запросы к DeepSeek-V4-Pro автоматически начнут обрабатываться другой моделью.
Главное о DeepSeek-V4-Pro
- Решает широкий круг рабочих задач. Модель пишет и редактирует тексты с переводом на разные языки, анализирует договоры и таблицы, ищет актуальную информацию в интернете через функцию «Умного поиска», а также пишет и разбирает код.
- Контекст вырос почти в восемь раз с 128К до 1 млн токенов — это позволяет загружать в модель крупные договоры и подборки документов целиком.
- Цена на API теперь зависит от времени суток. С 16 августа 2026 года DeepSeek ввел пиковые и непиковые часы: в пиковое время (01:00-04:00 и 06:00-10:00 UTC) токены стоят почти вдвое дороже.
- Вышла облегченная версия V4.1-Flash. Она заменила V4-Flash и Flash-Vision-Exp, работает экономнее, а по ряду бенчмарков обгоняет старшую модель V4-Pro.
- Русский язык модель тянет средне. Тексты получаются в сдержанном деловом стиле, но по художественной выразительности уступают ChatGPT и Claude.
.png?x-image-process=image%2Fauto-orient%2C1%2Fresize%2Cm_lfit%2Cw_1920%2Fsharpen%2C100%2Fformat%2Cwebp%2Fmarker%2Cu_plus)
