Fornecedor / equipe DeepSeek
Oficial $0.38
Média do listado $0.13
Métrica principal 1,048,576 ctx
Posição Sem ranking

Próximos passos no AI Hippo

Snapshot de pesos abertos

deepseek-ai/deepseek-v4-flash

Biblioteca: transformers

Tarefa text-generation

Downloads
3.0M
Curtidas
1.8k
Parâmetros
0B

Tendência 90d

Ver fonte de pesos

Este modelo vem do snapshot de catálogo e pode ainda não estar incluído no ranking mais recente.

Sobre este modelo

DeepSeek: DeepSeek V4 Flash 0423 aparece no catálogo como modelo LLM, com métrica principal 1,048,576 ctx e preço médio de snapshot em torno de $0.13 por 1M de tokens. As tabelas abaixo resumem o snapshot mais recente; use Comparar ou o hub Token para aprofundar.

Tambem pode explorar mais modelos de DeepSeek e ver mais opcoes de 🇨🇳 China .

Capacidades e especificações

Modalidade
text->text
Modalidades de entrada
text
Parâmetros de API suportados
frequency_penalty, include_reasoning, logit_bias, logprobs, max_completion_tokens, max_tokens, min_p, presence_penalty, reasoning, reasoning_effort, repetition_penalty, response_format, seed, stop, structured_outputs, temperature, tool_choice, tools, top_a, top_k, top_logprobs, top_p

Descrição do catálogo: DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and...

Preço de token por provedor

Compare os preços de token deste modelo entre provedores disponíveis.

Provedor Entrada / 1M tokens Saída / 1M tokens Latência Status
DeepInfra $0.09 $0.18 Verificado · 2026-09-23
DeepSeek $0.15 $0.60 Verificado · 2026-09-23
Fireworks $0.22 $0.66 Verificado · 2026-09-23
OpenRouter $0.09 $0.18 Verificado · 2026-09-23
SiliconFlow $0.13 $0.28 Verificado · 2026-09-23
Together $0.14 $0.28 Verificado · 2026-09-23

Os preços vêm do dataset de comparação de tokens e podem mudar entre snapshots.

Alternativas

Escolha mais um ou dois modelos no ranking global e use Comparar para vê-los lado a lado.

FAQ

Por que falta o preço oficial?

Linhas oficiais exigem preço verificado de API direta ou cloud. Se só agregadores listam o modelo, Official mostra —; cotações verificadas aparecem na tabela de tokens.

Diferença entre contexto e máx. saída?

Contexto é a entrada aceita por requisição. Máx. tokens de saída é o teto de geração por resposta—geralmente muito menor que a janela de contexto.

De onde vêm os preços multi-provedor?

De crawls/sync de OpenRouter, Groq, Together e outros, fundidos no dataset de comparação de infraestrutura. Linhas verificadas mostram a data de captura na coluna de status.

Fonte de dados e metodologia
Source
Catálogo OpenRouter, crawls de fornecedores verificados e snapshots Hugging Face.
Metrics
Janela de contexto, preço misto por 1M tokens, máx. saída e campos de capacidade da API de modelos OpenRouter.
Update cadence
Atualização diária do pipeline; preços podem mudar entre snapshots.
Fetched at
2026-09-23
Method
Ranking composto usa ponderação contexto × preço no site (não ELO LMSYS Arena).