DeepSeek V4 GA: важные изменения, о которых мы не знали

DeepSeek V4 GA: важные изменения, о которых мы не знали

DeepSeek V4 GA - хороший пример того, как вокруг реального технического события вырастает лишний шум. Многие ждут "новую модель 24 июля", но официальные документы говорят о другом: DeepSeek V4 уже была выпущена 24 апреля 2026 года, а 24 июля заканчивается жизнь старых API-имен deepseek-chat и deepseek-reasoner.

То есть DeepSeek V4 GA - скорее момент стабилизации и миграции, чем новый фейерверк. Но это не делает событие скучным: V4 остается одной из самых важных open-weight линеек года.

Что подтверждено

В официальном changelog DeepSeek за 24 апреля 2026 года указаны две модели:

  • deepseek-v4-pro;
  • deepseek-v4-flash.

Обе доступны через OpenAI ChatCompletions interface и Anthropic-compatible interface. Старые имена deepseek-chat и deepseek-reasoner во время переходного периода указывали на non-thinking и thinking режимы deepseek-v4-flash, но должны быть прекращены 24 июля 2026 года.

На странице прозрачности DeepSeek V4.0 отмечена как выпущенная 24 апреля 2026 года. В pricing docs указаны 1M context, до 384K max output, JSON output, tool calls, chat prefix completion и FIM completion для non-thinking mode.

V4-Pro и V4-Flash

Логика семейства понятная:

  • V4-Pro - более сильный вариант для сложного reasoning, coding и agentic задач;
  • V4-Flash - быстрый и дешевый вариант для массового production.

Официальная цена на момент проверки:

  • DeepSeek V4-Flash: $0.14 за 1M input cache miss, $0.0028 cache hit, $0.28 output;
  • DeepSeek V4-Pro: $0.435 за 1M input cache miss, $0.003625 cache hit, $0.87 output.

Даже если цены изменятся, порядок важен: DeepSeek продолжает давить рынок не только открытостью, но и агрессивной экономикой.

Что такое GA в этом контексте

Слово GA обычно означает general availability: стабильный релиз для production. Но у DeepSeek в публичных документах вокруг V4 чаще встречается preview/available, а не четкий маркетинговый "GA launch".

Поэтому "DeepSeek V4 GA" лучше читать как community-ярлык для этапа, когда:

  • новые V4 ID уже нужно использовать напрямую;
  • старые alias уходят;
  • цены и лимиты опубликованы;
  • веса и API достаточно зрелые для серьезной оценки;
  • вокруг API замечают возможные checkpoint updates или grayscale rollout.

Это не означает, что 24 июля выходит DeepSeek V5 или новый скрытый флагман.

Слух о grayscale-тесте

В середине июля пользователи начали обсуждать, что ответы deepseek-v4-pro стали заметно лучше при том же model ID. Отсюда родилась теория о "grayscale rollout" - постепенном переключении части трафика на обновленный checkpoint.

Был и более дикий слух: будто DeepSeek тайно маршрутизирует запросы к Anthropic Claude Fable 5. Технических доказательств этому нет. Похожий стиль ответов у сильных моделей не доказывает proxying. Более правдоподобно, что DeepSeek тестирует новый post-training checkpoint, instruction tuning или routing policy.

Пока это не подтверждено официально, корректная формулировка такая: пользователи сообщают об изменении качества, но конкретный механизм неизвестен.

Почему V4 технически важна

DeepSeek V4 интересна не только параметрами. По сторонним техническим разборам и Hugging Face материалам, ключевой сюжет - long-context efficiency: 1M контекст, MoE, гибридное внимание, более удобная работа для агентов.

Для coding agents это критично. Большая часть проблем в долгих задачах - не "модель не знает синтаксис", а контекст и стоимость: repo files, logs, tool output, test failures, intermediate plans. Если модель дешевле держит длинную рабочую память, она становится практичнее.

Еще один плюс - Anthropic-compatible endpoint. Это снижает friction для пользователей Claude Code-подобных инструментов: заменить provider проще, чем переписывать весь harness.

Что делать разработчикам

Если вы еще используете deepseek-chat или deepseek-reasoner, надо мигрировать на V4 ID. Для новых интеграций логика простая:

  • начинать с deepseek-v4-flash;
  • включать thinking там, где нужно;
  • переходить на deepseek-v4-pro, если Flash не держит сложность;
  • отдельно измерять cache hit rate;
  • не бенчмаркать production API во время возможного grayscale rollout без фиксации версии.

И главное: проверять не "красивость ответа", а стоимость успешного workflow.

Мнение

DeepSeek V4 GA - не столько релиз модели, сколько тест зрелости экосистемы DeepSeek. У компании уже есть сильный open-weight narrative, огромный ценовой прессинг и удобные API-форматы. Теперь вопрос в стабильности: версии, миграции, docs, SLA, поведение на длинных задачах.

Если DeepSeek удержит качество и не сломает доверие к версиям, V4 останется одним из главных вариантов для команд, которым нужны большие контексты и низкая цена. Если вокруг "GA" будет слишком много неявных переключений, серьезные пользователи уйдут в self-hosted weights или более предсказуемых провайдеров.

Где попробовать DeepSeek V4

  • Официальный веб-чатchat.deepseek.com: бесплатный, но с лимитами использования.
  • API DeepSeekplatform.deepseek.com для разработчиков, тарификация за токены.
  • Открытые веса — предыдущие релизы DeepSeek публиковались на Hugging Face, и V4 позиционируется как open-weight линейка, так что self-hosted сценарий тоже на столе.
  • В GPTunneL без VPNDeepSeek V4 Pro и DeepSeek V4 Flash стоят рядом с GPT, Claude и Gemini в одном интерфейсе. Оплата российскими картами в рублях, подписка не нужна.

Сколько стоит DeepSeek V4

В GPTunneL оплата за токены: V4 Pro — 88 ₽ вход / 174 ₽ выход за 1M токенов, V4 Flash — 28 ₽ / 56 ₽ за 1M. У обеих версий контекст 1M токенов. Пополняешь баланс и платишь только за то, что использовал, — без обязательной подписки; точный расчёт под свои объёмы — на странице цен.

Частые вопросы о DeepSeek V4

DeepSeek бесплатный? Веб-чат вендора на chat.deepseek.com бесплатный, но с лимитами. В GPTunneL — оплата за токены, зато без лимитов чата и с V4 рядом с другими топ-моделями в одном интерфейсе.

DeepSeek работает на русском? Да, свободно: понимает вопросы и отвечает на русском без специальных настроек.

Нужен ли VPN для DeepSeek? Сам веб-чат из России обычно открывается, но оплатить API российской картой не получится. В GPTunneL обе версии V4 доступны без VPN, оплата российскими картами в рублях.

Чем V4 Pro отличается от Flash? Pro — более сильный вариант для сложного reasoning, кодинга и агентных задач; Flash — быстрее и примерно втрое дешевле, для массовых повседневных задач. Контекст 1M — у обеих.

Попробуй сам

Самый быстрый способ понять, какая версия закрывает твои задачи, — прогнать один и тот же промпт через обе: открой DeepSeek V4 Pro в GPTunneL и сравни ответ с V4 Flash по качеству и цене результата.