Вендор / команда DeepSeek
Официально $0.21
Среднее по листингу $0.21
Ключевая метрика 1.0M ctx
Место 72

Следующие шаги на AI Hippo

Снимок open weights

deepseek-ai/deepseek-v4-flash

Библиотека: transformers

Задача text-generation

Загрузки
3.0M
Лайки
1.8k
Параметры
0B

Тренд 90д

Источник весов

О модели

DeepSeek: DeepSeek V4 Flash занимает место №72 в нашем глобальном рейтинге моделей. Указан как LLM с 1.0M ctx и типичной ценой в снимке около $0.21 за 1M токенов. Используйте «Сравнение» для выбора рядом или hub Token для проверенных цен нескольких провайдеров из того же снимка.

Также можно посмотреть больше моделей от DeepSeek и другие варианты из 🇨🇳 China .

Возможности и характеристики

Модальность
text->text
Входные модальности
text
Поддерживаемые параметры API
frequency_penalty, include_reasoning, logit_bias, logprobs, max_tokens, min_p, presence_penalty, reasoning, reasoning_effort, repetition_penalty, response_format, seed, stop, structured_outputs, temperature, tool_choice, tools, top_a, top_k, top_logprobs, top_p

Описание в каталоге: DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and...

Token-цены по провайдерам

Сравните token-цены этой модели у доступных провайдеров.

Провайдер Вход / 1M токенов Выход / 1M токенов Задержка Статус
DeepInfra $0.09 $0.18 Проверено · 2026-08-02
DeepSeek $0.14 $0.28 Снимок · 2026-08-02
Fireworks $0.14 $0.28 Проверено · 2026-08-02
OpenRouter $0.14 $0.28 Проверено · 2026-08-02
SiliconFlow $0.13 $0.28 Проверено · 2026-08-02

Цены берутся из набора сравнения токенов и могут меняться между снимками.

Альтернативы

Выберите ещё одну-две модели в глобальном рейтинге и используйте «Сравнение», чтобы посмотреть рядом.

FAQ

Почему нет официальной цены?

Официальные строки требуют проверенную цену прямого вендора или облачного API. Если модель есть только у агрегаторов, Official показывает —; проверенные котировки — в таблице токенов.

Чем контекст отличается от макс. вывода?

Контекст — объём входа на запрос. Макс. выходных токенов — лимит генерации на ответ, часто намного меньше окна контекста.

Откуда цены нескольких провайдеров?

Из краулов/синхронизации OpenRouter, Groq, Together и др., объединённых в датасет сравнения инфраструктуры. Проверенные строки показывают дату захвата в колонке статуса.

Источник данных и методология
Source
Каталог OpenRouter, проверенные краулы вендоров и снимки Hugging Face.
Metrics
Контекст, смешанная цена за 1M токенов, макс. вывод и поля возможностей из OpenRouter models API.
Update cadence
Ежедневное обновление пайплайна; цены провайдеров могут меняться между снимками.
Fetched at
2026-08-02
Method
Составной ранг использует вес контекст × цена на сайте (не ELO LMSYS Arena).