Запрос «какой deepseek лучше» почти всегда означает выбор внутри линейки: человек видит несколько названий и не понимает, какое из них брать. За 2026 год линейка сильно изменилась, и большинство советов, которые попадаются в поиске, описывают уже несуществующий набор моделей. Ниже разобрано, какие модели DeepSeek доступны сейчас по официальной документации, чем V4-Pro отличается от V4-Flash, как устроены режимы размышления, сколько стоит доступ по API, почему сервис иногда не отвечает и что компания пишет в своих документах про данные пользователей. Все сведения — из первоисточников DeepSeek, снятых 18 августа 2026 года.
Какие модели DeepSeek есть сейчас
В API DeepSeek сегодня доступны два имени: deepseek-v4-pro (чекпоинт 0813) и deepseek-v4-flash (чекпоинт 0731). Других вариантов в таблице цен из документации нет.
Обе модели работают с контекстом в один миллион токенов, максимальная длина одного ответа — 384 тысячи токенов. В карточке модели компания описывает их так: «two strong Mixture-of-Experts (MoE) language models… both supporting a context length of one million tokens» — две модели со смешанной архитектурой, где на каждый запрос работает не вся сеть, а часть её блоков.
Хронология выпусков по официальному журналу обновлений выглядит так. 24 апреля 2026 года вышел предварительный релиз V4 — сразу обе версии, Pro и Flash, с открытыми весами. 31 июля обновилась Flash, это и есть чекпоинт 0731. 13 августа состоялся общий релиз Pro с чекпоинтом 0813.
Главное, что стоит знать при выборе: старые имена моделей отключены. В анонсе V4 сказано дословно: «deepseek-chat & deepseek-reasoner will be fully retired and inaccessible after Jul 24th, 2026, 15:59 (UTC Time)» — то есть после 24 июля 2026 года обращения к ним по API не проходят.
Отсюда прямой практический вывод. Советы вида «берите R1, когда нужны рассуждения, и V3 для обычного общения» относятся к состоянию сервиса, которого больше нет. R1 как продукт в API отсутствует; модель осталась в виде открытых весов на Hugging Face, и запустить её можно только самостоятельно на своём оборудовании. Если статья или видео предлагают выбрать между V4 Pro, Flash, V3.2 и R1 — это описание прошлого состояния линейки, а не текущего.
Про сами веса компания пишет отдельно: «we publicly release all model weights, parameters, and inference tool code… under the permissive MIT License» — веса, параметры и код запуска выложены под лицензией MIT. К вопросу домашнего запуска ещё вернёмся ниже, потому что открытая лицензия и возможность запустить у себя — это не одно и то же.
Pro или Flash: чем отличаются
Разница между двумя моделями DeepSeek прежде всего в размере. У V4-Pro 1,6 триллиона параметров, из них на обработку одного запроса задействуется 49 миллиардов. У V4-Flash — 284 миллиарда параметров и 13 миллиардов активных. Контекст и предельная длина ответа при этом одинаковые, так что по объёму материала, который можно загрузить, модели равны.
Сама компания описывает соотношение осторожно: «DeepSeek-V4-Flash-Max achieves comparable reasoning performance to the Pro version when given a larger thinking budget, though its smaller parameter scale naturally places it slightly behind on pure knowledge tasks and the most complex agentic workflows». Смысл такой: если дать Flash больший бюджет на размышление, по способности рассуждать она сопоставима с Pro, но меньший размер сети сказывается на задачах, где нужны знания сами по себе, и на самых сложных сценариях, где модель работает длинной цепочкой действий с внешними инструментами.
Есть и техническое различие, важное для тех, кто встраивает модель в свой продукт. Лимит одновременных запросов на аккаунт у Pro — 500, у Flash — 2500. То есть Flash рассчитана на поток обращений, Pro — на меньшее количество более тяжёлых задач.
Практический ориентир из этих двух фактов получается такой. Если задача массовая и однотипная, а важна пропускная способность и цена, официальные параметры указывают на Flash. Если задача упирается в фактические знания или в длинную последовательность шагов с инструментами, вендор сам признаёт отставание Flash — значит, смотреть в сторону Pro. Сравнение DeepSeek с моделями других разработчиков — отдельная тема, она разобрана в материале DeepSeek или ChatGPT.
Режимы размышления
Дипсик режимы — второй источник путаницы. Раньше линейка делилась на обычную модель для диалога и отдельную рассуждающую модель. Сейчас такого деления нет: обе модели V4 гибридные, и режим размышления в них переключается параметром запроса.
По умолчанию режим включён, причём на высоком уровне усилия. В документации это сформулировано так: «Thinking mode is enabled by default, with the default effort being high». Уровней усилия три — low, high и max. Размышление можно выключить целиком, передав в запросе {"thinking": {"type": "disabled"}}.
В приложении те же настройки называются иначе: Instant Mode и Expert Mode. V4-Pro доступна в Expert Mode.
Насколько режим влияет на результат, видно по цифрам из карточки модели. Это самозаявленные показатели — их публикует сам разработчик, независимой проверки за ними нет. Три колонки — это выключенное размышление, уровень high и уровень max.
| Набор задач | Без размышления | High | Max |
|---|---|---|---|
| GPQA Diamond | 72.9 | 89.1 | 90.1 |
| LiveCodeBench | 56.8 | 89.8 | 93.5 |
| HLE | 7.7 | 34.5 | 37.7 |
Из таблицы следует вещь, которая обычно теряется в обсуждениях выбора модели: на сложных задачах переключатель режима меняет результат сильнее, чем переход с одной модели на другую. Разрыв между выключенным размышлением и уровнем high на наборе HLE — в разы, а не на проценты. При этом между high и max разница уже небольшая, а вот стоимость и время ответа растут вместе с длиной рассуждения, потому что рассуждение — это тоже выходные токены, за которые идёт оплата.
Отсюда рабочий подход: не искать «лучшую модель линейки» вообще, а сначала проверить, в каком режиме вы её используете. Если ответ на сложный вопрос вышел слабым, а размышление было отключено ради скорости, дело может быть вовсе не в выборе между Pro и Flash.
Сколько стоит API
Цены DeepSeek публикует в документации, в долларах за миллион токенов. Действующая цена вступила в силу 16 августа 2026 года в 16:00 UTC, значения ниже сняты 18 августа 2026 года. «Кэш-хит» означает, что часть запроса уже встречалась раньше и обрабатывается по льготной ставке; «промах» — что весь ввод обрабатывается заново.
| Модель | Период | Вход, кэш-хит | Вход, промах | Выход |
|---|---|---|---|---|
| v4-flash | непиковый | 0,007 | 0,22 | 0,66 |
| v4-flash | пиковый | 0,014 | 0,44 | 1,32 |
| v4-pro | непиковый | 0,022 | 0,66 | 1,98 |
| v4-pro | пиковый | 0,044 | 1,32 | 3,96 |
Здесь есть особенность, из-за которой легко ошибиться в расчётах. Сноска в документации звучит дословно: «Off-peak rates are half of the peak rates. Peak hours are 01:00–04:00 and 06:00–10:00 UTC». То есть базовым является непиковый тариф, а в двух окнах в течение суток цена удваивается. По московскому времени эти окна приходятся на 04:00–07:00 и 09:00–13:00.
Привычная логика «ночью дешевле, днём дороже» тут не работает. Описания, где говорится про ночную скидку в половину цены, построены на прежней схеме тарификации и текущей цене не соответствуют. Если у вас есть фоновые задачи, которые можно запускать по расписанию, имеет смысл просто не попадать в эти два окна.
Бесплатный доступ: что известно официально
На главной странице DeepSeek есть кнопка с подписью «Chat Now — Free access to DeepSeek». Это единственное официальное утверждение про бесплатность, которое компания делает сегодня.
Дальше начинается зона, где честнее сказать «неизвестно». Количественных лимитов бесплатного чата DeepSeek не публикует нигде: ни на сайте, ни в справочном центре, ни в пользовательском соглашении, ни в документации по API. Проверены все четыре источника. Поэтому конкретные цифры вроде «столько-то сообщений в день» или «столько-то запросов в час», которые встречаются в обзорах, взяты не из официального источника, и опираться на них при планировании работы не стоит.
Отдельно про обещание «100% FREE — no ads, no in-app purchases». Такая формулировка действительно была, но она датирована январём 2025 года и относилась к приложению на модели V3. Подавать её как действующую гарантию для сегодняшней версии сервиса нельзя — компания её для V4 не повторяла.
Практический вывод простой: бесплатный чат существует, границы его не объявлены, и рассчитывать на него как на предсказуемый ресурс для работы не получится. Если объём обращений имеет значение, считать нужно по тарифам API из предыдущего раздела.
Почему не работает: сбои и лимиты
Вопрос «почему не работает дипсик» люди задают достаточно часто, чтобы он стал отдельным поисковым кустом. У компании есть официальная страница статуса, и это единственный источник, где перебои признаются публично.
Показатели доступности за май–август 2026 года по этой странице: API Pro — 99,88%, API Flash — 99,79%, чат — 99,80%. Цифры высокие, но за ними стоит неравномерная картина. В журнале инцидентов за август 2026 года зафиксировано 12 записей, за июль — 8, а в июне сбоев не было вовсе. Среди августовских инцидентов есть деградация API длительностью два дня — 4 августа, по модели Flash — и отдельные сбои поиска.
То есть высокий средний показатель за квартал и спокойная работа в конкретную неделю — разные вещи. Если сервис перестал отвечать, первое действие — открыть страницу статуса и посмотреть, есть ли открытый инцидент, а не перебирать настройки у себя.
Важная оговорка: отдельного официального заявления про сообщение «server is busy» у компании не существует. Объяснения этой надписи, которые ходят по обзорам, официального подтверждения не имеют. Признание перегрузки идёт только через страницу статуса.
Ещё одна деталь, которая объясняет часть обрывов, есть в документации API: «If the request has not started inference after 10 minutes, the server will close the connection». Если запрос простоял в очереди десять минут и обработка так и не началась, сервер закрывает соединение сам. Для тяжёлых запросов в часы нагрузки это штатное поведение, а не ошибка в вашем коде.
Регистрация: почему не приходит доступ
Войти можно по почте или через сторонний аккаунт — Gmail, Apple ID. Телефон тоже используется: он перечислен в политике конфиденциальности среди собираемых данных.
При регистрации по почте часть пользователей получает ошибку «Login failed. Your email domain is currently not supported for registration». Это единственное ограничение доступа, которое компания подтверждает официально. Ответ справочного центра на эту ошибку звучит дословно так: «The email domain you are currently using is not on the support list. We recommend signing up with a major international email provider such as Gmail, Outlook, Hotmail, or Yahoo».
Список неподдерживаемых доменов при этом не опубликован. Поэтому заранее сказать, пройдёт ли регистрация с конкретного адреса на российском домене, по документам нельзя — проверяется только попыткой. Рекомендация компании сводится к тому, чтобы использовать почту одного из четырёх перечисленных крупных международных сервисов.
Что касается доступности сервиса по странам — официального списка у DeepSeek нет. В пользовательском соглашении есть только общая оговорка: «We make no warranty that the Services are available or will continue to be available in certain jurisdictions», плюс раздел про экспортный контроль и санкции. Применимое право — законы КНР. Утверждать со ссылкой на документы, что сервис официально работает или официально не работает в конкретной стране, оснований нет.
Что с данными: по официальным документам
Дипсик данные — тема, вокруг которой много шума и мало проверяемого. Поэтому здесь только формулировки из действующей политики конфиденциальности, обновлённой 10 февраля 2026 года. Оценок «безопасно» или «опасно» ниже не будет: документы приведены как есть, вывод каждый делает под свою задачу.
Кто оператор и где хранятся данные. Оператор сервиса — Hangzhou DeepSeek Artificial Intelligence Co., Ltd., компания, зарегистрированная в Китае. О хранении в политике сказано дословно: «The Personal Data we collect from you may be stored on a server located outside of the country where you live. To provide you with our services, we directly collect, process and store your Personal Data in People’s Republic of China». Для пользователей Европейской экономической зоны, Швейцарии и Великобритании формулировка в документе та же — отдельного исключения для них нет.
Что именно собирается. Политика перечисляет: «text input, voice input, prompt, uploaded files, photos, feedback, chat history» — введённый текст, голосовой ввод, промпты, загруженные файлы, фотографии, обратная связь и история переписки. Отдельная оговорка: голосовые отпечатки и биометрические характеристики из голосового ввода не извлекаются.
Используется ли переписка для обучения. Среди целей обработки указано «To improve and develop the Services and to train and improve our technology». В документе о механике обучения есть уточнение: пары «вопрос — ответ» «are produced by our research team, with a small portion potentially based on user input», то есть готовятся исследовательской командой, и лишь небольшая часть потенциально опирается на пользовательский ввод. Там же сказано, что применяются «secure encryption, strict de-identification, and anonymization» — шифрование, обезличивание и анонимизация, и что «Users are also given the right to opt out».
Как отказаться. В перечне прав пользователя значится «the right to opt-out of using your Personal Data for training our models or optimizing our technologies». Реализуется это право обращением на адрес privacy@deepseek.com. Отдельной галочки в настройках приложения или личного кабинета в документах не описано — способ отказа в них указан только письмом.
Кому данные могут передать. Политика говорит: «We may access, preserve, and share the Personal Data… with law enforcement agencies, public authorities, copyright holders, or other third parties» — с правоохранительными органами, государственными органами, правообладателями и иными третьими лицами, при добросовестной уверенности в законной необходимости такого раскрытия.
Прямое предупреждение вендора. В политике есть отдельная фраза: «We do not ask for, and you should not provide sensitive Personal Data to the Services» — компания не запрашивает чувствительные персональные данные и просит их не передавать.
Публичные ссылки на диалоги. Пользовательское соглашение в пункте 1.6 отдельно предупреждает: если поделиться ссылкой на переписку, её содержимое становится доступно любому, кто получит эту ссылку, и «such risks cannot be entirely eliminated» — риски полностью устранить нельзя.
Что политика не покрывает. Действие политики конфиденциальности DeepSeek не распространяется на конечных пользователей сторонних приложений, которые разработчики построили на её API. Там условия обработки данных определяет владелец приложения, и смотреть нужно его документы.
Локальный запуск: миф и реальность
Открытая лицензия рождает ожидание, что модель можно поставить себе и не отправлять переписку наружу. Формально веса действительно открыты под MIT, а запускать их можно через Transformers, vLLM, SGLang или готовый образ Docker.
Дальше начинается реальность железа. В официальной инструкции по запуску сказано: «the command below serves the model with vLLM on a single 4×GB300 node» — то есть пример рассчитан на узел из четырёх серверных ускорителей NVIDIA GB300. Это оборудование дата-центра. Разговор про «поставить V4-Pro на домашний компьютер» на этом заканчивается: речь идёт о моделях, где только активная часть сети — десятки миллиардов параметров, а полный объём весов измеряется сотнями миллиардов и триллионами.
Есть и техническая деталь, о которую спотыкаются те, кто всё же берётся за самостоятельный запуск: чат-шаблона в формате Jinja в релизе нет. Форматировать диалог нужно скриптами кодирования из папки вендора, а не привычным механизмом шаблонов.
Практический итог: открытые веса дают возможность развернуть модель в своём контуре, но это задача для инфраструктуры с серверными ускорителями, а не для рабочего ноутбука.
Если нужен другой доступ
Из всего перечисленного складывается понятная развилка. Веб-интерфейс и приложение — самый простой путь, но с ним связаны условия обработки данных, описанные выше, и неизвестные границы бесплатного доступа. Собственный сервер снимает вопрос передачи данных наружу, но требует оборудования дата-центра. Между этими крайностями находится работа по API, где вы отправляете конкретные запросы из своего кода или своего инструмента, а не ведёте переписку в чужом веб-интерфейсе, и где условия оплаты и лимиты описаны в документации заранее.
Для доступа к моделям по API из России есть шлюзы с оплатой рублями. GEN202 — один из них: один ключ ко всему каталогу, где собраны GPT-5.6, Claude, Gemini и Grok. Скажем прямо: DeepSeek в каталоге GEN202 нет, поэтому если нужна именно эта модель — путь только через её собственный API. Если же задача решается любой сильной моделью, работает обычная схема с оплатой за токены: например, Claude Sonnet 5 стоит 180 ₽ за миллион входящих токенов и 900 ₽ за миллион исходящих. При регистрации начисляется 50 приветственных кредитов (25 ₽) — их хватает, чтобы прогнать свои реальные задачи и сравнить ответы, прежде чем что-то решать. Проверить их на своей задаче можно в чате, не собирая запрос в коде: вопрос пишется словами, нужное имя выбирается из списка, а вся переписка остаётся в истории. Полный список моделей и цен — в разделе каталог.
Если интересуют именно сервисы с русским интерфейсом и российской оплатой, отдельная подборка собрана в обзоре лучших нейросетей на русском языке.
Частые вопросы
Какой DeepSeek лучше — Pro или Flash? Зависит от задачи. По официальному описанию вендора, Flash при большем бюджете на размышление сопоставима с Pro по способности рассуждать, но уступает на задачах, требующих знаний, и на самых сложных сценариях с цепочками действий. Лимит одновременных запросов у Flash выше — 2500 против 500 у Pro, а цена вдвое-втрое ниже по всем позициям таблицы цен. Массовый поток однотипных обращений — аргумент за Flash, тяжёлые единичные задачи — за Pro.
Что стало с R1 и другими старыми моделями?
Имена deepseek-chat и deepseek-reasoner отключены в API после 24 июля 2026 года, 15:59 UTC. Обратиться к ним через API больше нельзя. Веса R1 остались опубликованными на Hugging Face, то есть модель можно развернуть самостоятельно, но как продукт в сервисе её нет. Любые инструкции по выбору между R1, V3 и V4 описывают прежнее состояние линейки.
Почему дипсик не отвечает? Официальный источник один — страница статуса DeepSeek. По ней доступность за май–август 2026 года составила 99,79–99,88% для API и 99,80% для чата, но в августе зафиксировано 12 инцидентов, включая двухдневную деградацию API 4 августа, тогда как в июне сбоев не было ни одного. Отдельного официального объяснения сообщения «server is busy» компания не публиковала. Ещё одна причина обрывов описана в документации: если запрос не начал обрабатываться в течение десяти минут, сервер закрывает соединение.
Где хранятся данные пользователей? В политике конфиденциальности от 10 февраля 2026 года сказано, что данные собираются, обрабатываются и хранятся в Китайской Народной Республике; для пользователей Европейской экономической зоны, Швейцарии и Великобритании формулировка та же. Оператор — Hangzhou DeepSeek Artificial Intelligence Co., Ltd. Среди собираемых данных перечислены текстовый и голосовой ввод, промпты, загруженные файлы, фотографии и история переписки. Право отказаться от использования данных для обучения моделей в политике есть, реализуется письмом на privacy@deepseek.com.
Можно ли запустить DeepSeek на своём компьютере? Веса опубликованы под лицензией MIT, поддерживаются Transformers, vLLM, SGLang и Docker. Но официальный пример запуска V4-Pro рассчитан на узел из четырёх серверных ускорителей NVIDIA GB300 — это оборудование дата-центра. Для домашнего компьютера такой запуск не предназначен. Дополнительно: чат-шаблона в формате Jinja в релизе нет, форматирование диалога делается скриптами вендора.