Модели DeepSeek
Чем отличаются V4 Flash и V4 Pro
DeepSeek-V4 Flash — модель общего назначения: обрабатывает чат, тексты и большинство запросов по коду быстро и по низкой цене. DeepSeek-V4 Pro решает те же задачи точнее на многошаговых рассуждениях и агентных сценариях, где важна глубина анализа, а не скорость ответа. Обе модели делят одну архитектуру контекста — 1M токенов входа и до 384K токенов на выходе.
| Параметр | DeepSeek-V4 Flash | DeepSeek-V4 Pro |
|---|---|---|
| Контекст | 1M токенов | 1M токенов |
| Максимальный вывод | 384K токенов | 384K токенов |
| Цена входа (cache miss) | $0.14 за 1M (≈11 ₽) | $0.435 за 1M (≈34 ₽) |
| Цена выхода | $0.28 за 1M (≈22 ₽) | $0.87 за 1M (≈68 ₽) |
| Лимит одновременных запросов | 2500 на аккаунт | 500 на аккаунт |
| Для чего брать | Чат, типовой код, массовые запросы через API | Сложные рассуждения, агентные сценарии, точность важнее цены |
На практике большинству задач хватает V4 Flash: разница в цене — почти в три раза по выходным токенам, а по качеству на типовых запросах модели заметно не расходятся. V4 Pro стоит подключать точечно — там, где ошибка в рассуждении дорого стоит: сложная аналитика, многошаговый код, задачи с длинной цепочкой логики.
DeepSeek-R1
DeepSeek-R1, запущенная 20 января 2025 года, стала первой моделью линейки с явным пошаговым режимом рассуждений — перед финальным ответом модель выписывает цепочку промежуточных шагов. В отличие от V4, веса R1 и предшествующей V3 опубликованы в открытом доступе на Hugging Face и GitHub: их можно скачать и развернуть на своём сервере без обращения к API DeepSeek. Для V4 Flash и V4 Pro такой публикации на момент выхода линейки не было — актуальные топовые модели работают только через официальный сервис.
Разница практическая: если важна независимость от API и полный контроль над данными — берут R1 или V3 локально, пусть и с более скромными результатами, чем у V4. Если важны свежесть и максимальное качество — используют V4 Flash/Pro через API или бесплатный чат.
Какую модель выбрать под задачу
- Чат и повседневные вопросы. Бесплатный чат на chat.deepseek.com уже работает на V4 Flash/Pro — платить за API не нужно.
- Массовые запросы через API (боты, автоматизация текста). V4 Flash: разница в цене против V4 Pro ощутима при больших объёмах.
- Сложная аналитика, многошаговый код, агентные цепочки. V4 Pro — точность важнее экономии на токене.
- Локальный запуск без передачи данных на сторону. DeepSeek-R1 или V3 из открытых весов, через LM Studio или Ollama.
Полный расчёт цены по обеим моделям — на странице тарифы DeepSeek.