← Все статьи

DeepSeek V4 Pro 0813 - это исторический переломный момент

Светящийся цифровой кит — DeepSeek V4 Pro в финальной версии

Коротко о главном (BLUF)

В этой статье мы рассказываем о важных новостях и функциях платформы NeuralSpace. Узнайте, как наши нейросети могут помочь вам в решении повседневных задач, сэкономят время и откроют новые возможности для творчества.

Сегодня DeepSeek выкатил финальную версию V4 Pro — ревизию 0813. Без конференций и счётчиков обратного отсчёта: просто обновился API. Кто уже работал с `deepseek-v4-pro`, тот автоматически получил новую модель, ничего не меняя в коде. Апрельская была превью, эта — GA, и разница заметна прежде всего там, где от модели ждут не ответа в чате, а связной работы.

Светящийся цифровой кит — DeepSeek V4 Pro в финальной версии

Сегодня тот день, когда кодинг уровня Opus стал реально доступным. Вот это предложение ещё утром было бы мечтой маркетолога, а вечером — факт с бенчмарками в придачу.

В NeuralSpace модель уже стоит: в чате, в разделе «Код» и в API. Никакого «ждём раскатку» — открываешь и пользуешься.

Что за модель

Технически это тот же зверь, что и в апреле: Mixture-of-Experts на 1,6 трлн параметров, из которых на каждом шаге активны 49 млрд. Контекст — миллион токенов, а выдать модель способна до 384 тысяч токенов за один ответ. Для сравнения: это примерно в двадцать раз больше, чем у большинства моделей в соседних вкладках.

Модель умеет думать в двух режимах — thinking и non-thinking, а у reasoning_effort теперь три ступени: max, high, low. На практике это значит, что мелкий вопрос можно прогнать дёшево, а сложную цепочку — на максимальных раздумьях, не меняя модель.

Бенчмарки: что именно подросло

Рост бенчмарков DeepSeek V4 Pro после выхода финальной версии

Artificial Analysis перемерил финальную версию. Intelligence Index вырос с 43,7 до 45,3. Coding Index — с 58,7 до 59,4. А вот Agentic Index подпрыгнул сильнее всего: с 35,3 до 37,8. Это не случайность — ревизию 0813 правили именно под агентные сценарии, где модель не отвечает в один присест, а ходит туда-сюда: читает файлы, зовёт инструменты, смотрит на результат и поправляет сама себя.

По скорости всё на уровне прошлой версии: около 76 токенов в секунду на выходе, первый токен прилетает где-то через полторы-две секунды. Для модели такого размера это быстро. Минус честный: модель болтливая. На замерах AA она выплёскивает в полтора-два раза больше токенов, чем средняя по рынку, — считайте, что за развёрнутые рассуждения вы платите и лишними токенами, и лишними секундами ожидания.

Против Claude и GPT: честная арифметика

Самое заметное в свежей таблице — строчка с Claude Opus 4.8, прежним флагманом Anthropic. DeepSeek V4 Pro 0813 обошёл его в кодинг-бенчмарках с обеих сторон: Terminal-Bench 2.1 — 87,9 против 85,0, DeepSWE — 62,7 против 58,0. При этом Opus 4.8 стоит $5 за миллион входных токенов и $25 за миллион выходных — в 11 и 29 раз дороже. Вот эта таблица:

Таблица кодинг-бенчмарков: DeepSeek V4 Pro 0813 обходит Claude Opus 4.8 в Terminal-Bench 2.1 и DeepSWE

Ближе всего финальная версия подобралась к Claude Fable 5: 87,9 против 88,0 в Terminal-Bench — разница в одну десятую. По DeepSWE Fable впереди заметнее: 70,0 против 62,7. Если считать все десять агентных бенчмарков из таблицы DeepSeek, Fable впереди в среднем на 5,3% — но на двух из десяти DeepSeek выигрывает, а без единственного выброса (Humanity's Last Exam без инструментов: 42,7 против 53,3) средний отрыв сжимается до 2,8%.

Цена при этом различается не на проценты, а в разы. Fable 5 стоит $10 за миллион входных и $50 за миллион выходных токенов; у V4 Pro — $0,435 и $0,87. По смешанному тарифу получается около $30 против $0,65. То есть за разницу в единицы процентов на тестах Anthropic просит платить примерно в 46 раз больше. Оговорки честности: сравнительную таблицу DeepSeek замерял сам, на своей же неопубликованной инфраструктуре, два теста из десяти — внутренние, а независимых замеров 0813 пока нет — модель вышла только сегодня.

Чтобы понять масштаб, вспомните Kimi K3. Месяц назад она первой из китайских моделей обогнала Claude Opus — это была сенсация. Но Kimi K3 — модель с триллионами параметров, для её запуска нужен дорогущий сервер, поэтому в рознице она всего в три раза дешевле Claude Fable и лишь на 40% дешевле Claude Opus. Впечатляет, но демократизации в этом нет.

А вот DeepSeek V4 Pro — реально исторический момент. Реально догоняя Opus по кодингу, он стоит в 30 раз дешевле Opus и в 60 раз дешевле Fable. Сегодня вайбкодинг стал доступен всем — не в рекламном смысле «доступен», а по цене входа в него.

С GPT расклад сложнее. GPT-5.5 набирает в индексе Artificial Analysis 56,3 против 45,3 у DeepSeek — отрыв честно заметный. Зато тарифы несопоставимы: $5/$30 за миллион против $0,435/$0,87. А вот удешевлённая GPT-5.6 Luna стоит уже $0,10/$0,60 — то есть дешевле DeepSeek — и набирает 52,3. Получается, «самый дешёвый из больших» больше не единственный: по цене V4 Pro конкурирует с Luna, а по баллам проигрывает и Terra, и Sol.

Добавлю трезвую цитату со стороны: в свежей оценке американского NIST (CAISI) говорилось, что V4 Pro отстаёт от лидеров рынка примерно на восемь месяцев. Замеряли, правда, превью-версию. Сократила ли 0813 этот разрыв — покажут независимые бенчмарки, а их ещё нет.

Цена не изменилась. Пока

Вход — $0,435 за миллион токенов, выход — $0,87. Кэш-хит по-прежнему почти бесплатный: $0,003625 за миллион, в 120 раз дешевле обычного входа. Для агентных цепочек это главный пункт: контекст проекта перечитывается снова и снова, и именно кэш решает, сколько стоит час работы агента.

Одна оговорка: DeepSeek уже предупредил в документации, что собирается поднимать цены на свой API в целом. Когда и на сколько — не сказано. Пока действуют апрельские тарифы, и это заметно ниже, чем у западных аналогов сравнимого класса.

Где это попробовать прямо сейчас

  • Чат: открываете страницу модели — финальная 0813 уже стоит по умолчанию.
  • Код: в разделе «Код» модель подключается к проекту и работает с репозиторием, файлами и терминалом.
  • API: ключ выдаётся в разделе API-ключи NeuralSpace, формат совместим с OpenAI.

Оплата — рублями из общего баланса, без подписки, VPN и зарубежной карты. Списывается фактическое использование, а не пакет «на месяц вперёд».

Чего модель не умеет — так это смотреть картинки: вход только текстовый. Если нужен разбор скриншота или фото, это к другим моделям. Зато для текста, кода и долгих агентных задач финальный V4 Pro сейчас — одно из самых честных предложений по соотношению силы и цены. Проверить можно в чате, а если нужно встроить в свой продукт — ключ берётся на странице API-ключей.

Часто задаваемые вопросы (FAQ)

Вопрос: Как начать работу? Ответ: Зарегистрируйтесь на платформе и получите бесплатные токены для тестирования.

Вопрос: Подходят ли сгенерированные материалы для коммерческого использования? Ответ: Да, вы получаете полные коммерческие права на весь созданный контент.